Skip to content
AI-Daily-Builder

태그 · #agents

LLM 에이전트의 작업 간 기술 이전: 하위 작업과 텍스트의 승리

읽어야 하는 이유 자율 에이전트를 개발하는 개발자는 메모리를 텍스트 형식의 하위 작업으로 구조화하여 신뢰성을 높일 수 있습니다. 제안된 유틸리티 점수는 효과적인 기술을 선별하기 위한 실행 전 진단 기능을 제공합니다.

연구에 따르면 하위 작업 수준의 유도 및 텍스트 형식이 코드 기반 방법보다 더 나은 성능을 보이는 LLM 에이전트의 신뢰할 수 있는 기술 이전을 가능하게 합니다.

Anthropic Code with Claude 런던: 에이전트 플랫폼 성숙 —— Dreaming, Outcomes, Finance

읽어야 하는 이유 테마는 「더 나은 모델」에서 「신뢰할 수 있는 자율성」으로의 전환. Outcomes(에이전트 실행을 채점하는 grader loop)와 Dreaming(스케줄 메모리 큐레이션)은 무인으로 돌릴 수 있는 에이전트의 인프라 —— 그것이 엔터프라이즈 배포의 진짜 장벽이지 모델 IQ가 아니다.

Code with Claude 런던(5/20-21)에서 Anthropic이 5개 에이전트 기능 —— Dreaming, Outcomes, 멀티 에이전트 오케스트레이션, Claude Finance, Add-ins —— 와 Small Business 통합을 출시.

Exa, $2.5억 Series C 조달, 밸류 $22억 —— 인간이 아닌 AI 에이전트를 위한 웹 검색

읽어야 하는 이유 테제는 볼륨에 대한 진짜 베팅: CEO Will Bryk는 에이전트 검색 수요가 Google 인간 총량의 수천 배를 넘을 것이라 주장. 에이전트가 주요 웹 클라이언트가 되면 검색 계층은 인프라 —— Exa는 에이전트 퍼스트로 구축, 인간 검색엔진 개조가 아니다.

Exa가 $2.5억 Series C를 밸류 $22억에 조달, a16z 리드 —— 작년 가을 $7억 밸류 대비 3배. AI 네이티브 검색 API(Google/Bing 래퍼 아님), 5,000+ 고객에 Cursor, Cognition, HubSpot.

Anthropic, Claude for Small Business 출시 — 15개 워크플로우, 12개 커넥터, 추가 요금 없음

읽어야 하는 이유 Anthropic의 첫 버티컬 제품. 핵심은 기능 목록이 아니라 'Claude for X'가 모델 API가 아닌 패키지 SaaS로 출하되기 시작했다는 점.

Anthropic, Claude for Small Business 출시: 15개 워크플로우, 15개 에이전트 스킬, 12개 SaaS 커넥터(QuickBooks, PayPal, Square 등). 추가 요금 없음.

커피