Anthropic이 “너무 강한 모델”을 공개하지 않기로 했다 — Claude Mythos Preview와 Project Glasswing
— SWE-bench 93.9%, 제로데이 수천 개, 그리고 1억 달러짜리 방어 프로젝트
LLM과 에이전트를 설계하는 실무 실험실
LLM(대규모 언어모델)을 실제 제품에 붙이며 남긴 기록. API 비용 최적화, 프롬프트 캐싱, 모델 선택, 토큰 계산처럼 현업에서 바로 부딪히는 문제를 1인칭 경험과 실측값으로 다룬다.
— SWE-bench 93.9%, 제로데이 수천 개, 그리고 1억 달러짜리 방어 프로젝트
GPT-5.4, Claude, Gemini의 토큰 단가를 실제 숫자로 비교하고, 프롬프트 캐싱과 Batch API로 LLM API 비용을 줄이는 방법까지 정리했다.
Claude Code의 멀티 에이전트 기능 Agent Teams를 직접 써보고 정리했다. Subagent와의 차이, 활성화 방법, 팀 리더와 메일박스 구조, 병렬 코드 리뷰 사용 사례와 주의점 4가지.
멀티 에이전트에서 ‘통제자’의 역할을 분리하며 배운 것들 Orchestrator(오케스트레이터)는 원래 ‘지휘자’라는 뜻이다. 소프트웨어에서는 여러 구성 요소를 정해진 순서와 조건에 따라 호출하고, 결과를 보고 다음 단계로 넘길지 멈출지를 결정하는 통제 코드를 가리킨다. 쿠버네티스나 워크플로 엔진에서 말하는 ‘오케스트레이션’도 같은 말이다. 멀티 에이전트에서는 각 Agent가 판단을 맡고, Orchestrator가 결정을 맡는다. 이 글은 그 결정을 LLM이 아니라 코드에 맡겨야 한다고 … 더 읽기