Skip to content
AI-Daily-Builder

아카이브

Google, Gemini 3.5 Pro 최종 프리뷰 단계 돌입 — 200만 토큰 컨텍스트와 Deep Think 추론

읽어야 하는 이유 개발자가 먼저 확인해야 할 것은 가격과 무료 체험 기간. 입력 100만 토큰당 $15, 출력 $60의 가격은 시험용이 아닌 실전 사용을 위한 설정이다.

Gemini 3.5 Pro가 200만 토큰 컨텍스트 윈도우와 Deep Think 추론을 탑재하고 최종 Vertex 엔터프라이즈 프리뷰에 진입. 2026년 6월 중 GA 출시 임박.

Intel·Foxconn, Computex에서 랙 스케일 AI 파트너십 발표 — Nvidia GB200 정조준

읽어야 하는 이유 Intel은 GPU 성능으로 Nvidia를 이기려는 게 아니라, Foxconn의 제조 규모를 등에 업은 풀스택 대안 공급 전략에 베팅하고 있다. 당일 +4.43% 주가 반응은 투자자들이 이를 신뢰할 만하다고 판단했다는 신호다.

Intel과 Foxconn이 Computex 2026에서 100kW 수냉 Xeon 랙을 앞세운 랙 스케일 AI 공동 개발 파트너십을 발표하며 Nvidia GB200 NVL에 도전장.

Ramp, 440억 달러 밸류에이션으로 7.5억 달러 시리즈 F 완료 — AI 에이전트가 기업 지출 주도할 것

읽어야 하는 이유 가장 핵심적인 데이터: 한 고객사가 4개월 만에 2026년 AI 예산 전체를 소진했다. Ramp는 기업 AI 지출의 가시성·거버넌스 레이어를 구축 중이다 — 1년 전에는 거의 존재하지 않던 카테고리다.

Ramp가 6월 4일 440억 달러 밸류에이션으로 7.5억 달러 시리즈 F를 마감. AI 에이전트가 기업 지출 관리를 재편할 것으로 보고 세계 최초 AI 에이전트 전용 법인 카드도 출시.

Anthropic, Claude Fable 5 출시: 대중이 마침내 만져볼 수 있는 Mythos급 프런티어 모델

읽어야 하는 이유 하나의 프런티어 모델, 두 가지 출시: 가드레일을 두른 공개판과 제한된 완전판. 빌더가 먼저 확인해야 할 것은 가격, 무료 기간, 안전 분류기의 폴백 동작이다.

Anthropic이 최초의 공개 Mythos급 모델 Claude Fable 5를 출시했다. 가격은 100만 토큰당 입력 $10/출력 $50. 제한 해제판 Mythos 5는 심사를 거친 파트너 전용이다.

애플, WWDC 2026에서 새 Foundation Models로 Siri 재구축 — Google Gemini 협력과 12GB 하드웨어 기준

읽어야 하는 이유 Tim Cook의 마지막 기조연설은 진정으로 재구축된 Siri에 실무자가 놓쳐선 안 될 두 가지 단서를 붙인다. 12GB 통합 메모리 기기 기준과 EU·중국 출시 제외다.

WWDC 2026은 차세대 Apple Foundation Models(Google Gemini와 공동 개발) 기반 Siri AI, 전용 앱, 확장된 개발자 프레임워크, 그리고 EU·중국 출시 공백을 공개했다.

마이크로소프트 빌드 2026: 'Microsoft IQ'가 맥락을 플랫폼으로 만들다 — Work IQ·Foundry IQ와 새 Web IQ 가동

읽어야 하는 이유 우리는 뻔한 MAI 모델 헤드라인을 건너뛰었다. 빌드 2026에서 지속될 이야기는 구조적이기 때문이다 — 마이크로소프트는 그라운딩된 맥락을 기능이 아니라 기본 플랫폼 계층으로 만들려 한다. Web IQ를 주목하라. 저토큰 웹 그라운딩 중개자는 기업용 세일즈 포인트를 훨씬 넘어 오픈 웹에 영향을 미친다.

빌드 2026의 조용한 한 수. 마이크로소프트는 그라운딩 기술을 하나의 브랜드 Microsoft IQ로 통합했다 — Work IQ, Foundry IQ, Fabric IQ, 그리고 새로운 Web IQ. 맥락을 관리형 인프라로서 Copilot과 Foundry 전반에 출시한다.

마이크로소프트가 자체 코딩 모델을 GitHub Copilot에 투입하다: MAI-Code-1-Flash가 빌더에게 갖는 의미

읽어야 하는 이유 GitHub Copilot에서 살다시피 한다면, 이번 주 커서 아래의 기본 모델이 조용히 바뀌었을 수 있다. 실제로 무엇이 출시됐고 어떻게 알아보는지 정리한다.

마이크로소프트는 Build 2026에서 5B 자체 코딩 모델을 VS Code에 넣고 35B 추론 모델도 출시했다——둘 다 OpenAI 증류 없이 학습.

마이크로소프트, OpenAI 의존도를 낮추기 위해 첫 추론 모델을 포함한 7개의 자체 MAI 모델 출시

읽어야 하는 이유 대형 플랫폼 소유자가 자사의 추론 모델을 출시하고 이를 OpenAI에 비용을 덜 지불하는 방법이라고 공개적으로 규정하는 것은 단순한 제품 출시가 아니라 구조적인 이야기이다 — 그것은 프런티어 모델 공급망 전체를 다시 가격 매긴다.

6월 2일 Build 2026에서 마이크로소프트는 비용을 낮추고 OpenAI 의존도를 줄이기 위해 추론 모델 MAI-Thinking-1을 필두로 처음부터 구축한 7개의 MAI 모델을 출시했다.

트럼프의 6월 2일 AI 행정명령, 연구소들에 프런티어 모델 30일 조기 접근 요청

읽어야 하는 이유 "자발적인 30일 열람"은 온건하게 들리지만, 이는 가장 유능한 모델들에 대한 공개 전 문지기로 연방정부를 조용히 확립한다——이는 시행 첫날의 작동 방식보다 더 중요한 선례다.

2026년 6월 2일, 트럼프 대통령은 "첨단 인공지능 혁신 및 보안 촉진"에 서명하며, AI 개발자들에게 더 광범위한 공개 전에 사이버 역량 벤치마킹을 위해 프런티어 모델에 대한 최대 30일의 조기 접근권을 정부에 자발적으로 제공할 것을 요청했다. 이 기간은 업계의 반발 이후

Anthropic, 9,650억 달러 가치로 IPO 비공개 신청…2026년 가을 상장 정조준

읽어야 하는 이유 비공개 S-1은 진입로일 뿐 확약이 아니다. 그러나 약 500억 달러 연환산 매출을 넘어선 해에 제출함으로써 Anthropic은 연구소에서 공개시장 규모의 엔터프라이즈 소프트웨어 기업으로 재정의되며, 상장 창구를 두고 OpenAI와 경쟁한다.

Anthropic이 2026년 6월 1일 9,650억 달러 가치로 SEC에 S-1 초안을 비공개 제출했으며, 연환산 매출은 500억 달러에 근접한다.

NVIDIA와 TSMC가 AI를 팹 깊숙이 밀어넣다: cuLitho가 리소그래피 비용 20-50% 절감, FabTwin은 디지털로

읽어야 하는 이유 설비투자 헤드라인이 아니다: NVIDIA는 "NVIDIA 자신의 칩을 만드는" 공급망에 연산을 팔고 있다. cuLitho의 20-50% 리소 비용·사이클타임 절감이 핵심 숫자다 —— 선단 노드 웨이퍼가 얼마나 빠르고 싸게 양산에 닿는지를 좌우한다. 수직 루프다.

GTC 타이베이에서 TSMC가 NVIDIA의 CUDA-X 스택을 리소그래피·시뮬레이션·검사에 전면 채택, cuLitho는 리소 비용을 최대 50% 절감.

xAI, Cursor 개발자 데이터로 튜닝한 1.5조 파라미터 Grok V9-Medium 훈련 완료

읽어야 하는 이유 핵심은 1.5조라는 파라미터 수가 아니라 훈련 코퍼스다. Cursor의 실제 개발자 워크플로로 프런티어 모델을 튜닝하는 것은 Claude와 Codex가 장악한 코딩 계층을 직접 노린 베팅이다. 가중치나 API가 나오기 전까지 벤치마크와 일정은 벤더 발표로 취급하라.

Musk는 xAI의 1.5조 파라미터 Grok V9-Medium이 훈련을 마쳤다고 밝혔다(5/25). 프로덕션 모델의 약 3배이며 Cursor 개발 데이터로 훈련, 6월 중순 공개 예정.

Cognition, 260억 밸류로 10억 달러 조달 —— "에이전트=인력" 베팅, 자사 코드 90%를 AI가 작성

읽어야 하는 이유 약 53배 ARR 배수는 "에이전트=도구"가 아니라 "에이전트=인력"에 거는 베팅이다. 플라이휠은 증명이자 리스크: Cognition은 Devin으로 자사 코드 약 90%를 쓰므로, 성장 스토리와 데모가 같은 것이다 —— 성장이 둔화되기 전까지는.

Devin 코딩 에이전트 개발사 Cognition이 260억 달러 밸류로 10억 달러 이상 조달(5/27) —— 8개월 만에 2.5배, ARR $492M, 자사 코드 약 90%를 AI가 작성.

Google의 AI Threat Defense, 기계 속도로 취약점 자동 패치 — AI 공격자에 대한 방어의 답

읽어야 하는 이유 같은 주, 한 모델은 취약점을 사냥하고 Google은 자동 패치하는 모델을 냈다. 공격과 방어가 모두 기계 속도로 달리면 패치 창은 수 주에서 수 분으로 줄고 — 인간은 운영자에서 에이전트가 쓴 패치의 감사자로 옮겨간다.

Google Cloud가 AI Threat Defense 출시(5/27): Gemini를 핵심으로 Wiz·CodeMender·Mandiant를 결합해 기계 속도로 취약점을 발견·자동 패치한다.

Nvidia·AMD·CoreWeave가 함께 Tensormesh에 투자 —— KV 캐시 재사용이 추론 원시 요소로

읽어야 하는 이유 세 라이벌 —— Nvidia·AMD·CoreWeave —— 가 함께 투자하는 것이 신호다: KV 캐시 재사용(이미 계산한 걸 재계산하지 않기)이 승자독식 제품이 아니라 기반적·중립적 추론 스택 계층으로 다뤄지고 있다. 추론 시대의 경제학이 한 라운드에 응축.

Tensormesh가 Nvidia·AMD·CoreWeave로부터 2000만 달러 조달(5/27), Tensormesh Inference 출시 —— 제품화된 KV 캐시 재사용으로 지연·GPU 비용 최대 10배 절감 주장.

마이크론, 1조 달러 클럽 합류 — HBM이 더 이상 범용 상품이 아닐 때

읽어야 하는 이유 주목할 숫자는 "1조"가 아니라 "구조적"이라는 단어다. UBS의 204% 목표가 인상은 AI 메모리가 탈사이클화됐다는 논지에 기댄다: HBM4 매진, DRAM 58-63% 상승, 가격은 2029까지 고정. 메모리가 정말 사이클을 벗어났다면 반도체 정석 전체가 바뀐다.

마이크론이 5/26 처음으로 시총 1조 달러 돌파 — 역대 5번째 칩 기업 — UBS가 목표가를 $1,625로 3배 넘게 올리고 2026년 HBM4 생산능력이 장기계약으로 매진된 뒤.

OpenAI 추론 모델이 80년 된 에르되시 추측을 반증 — 그것도 수학 전용 모델이 아니다

읽어야 하는 이유 헤드라인은 "AI가 수학을 한다". 진짜 신호는 그것이 수학 전용 시스템이 아니라 범용 추론 모델에서 나왔고, 80년간 아무도 못 찾은 반례를 구성해 통념을 뒤집었다는 점이다. 결과 하나는 혁명이 아니지만, 범용성이 핵심이다.

OpenAI는 내부 추론 모델이 에르되시 1946년 단위거리 추측을 자율적으로 반증했다고 발표(5/20) — AI 최초이며 수학자들이 독립 검증.

OpenRouter, 1.13억 달러 조달 — 모든 AI 모델 사이의 "교환대"를 차지하려는 베팅

읽어야 하는 이유 베팅은 모델이 아니라 그 모두 위에 선 계층이다. OpenRouter가 파는 것은 선택권: 최선·최저가 모델로 라우팅하되 어디에도 묶이지 않는다. 단서는 주주 명단 — 엔비디아에 Snowflake, Databricks, MongoDB, ServiceNow까지 라우팅 계층에 자리를 원한다.

OpenRouter가 CapitalG 주도 1.13억 달러 시리즈 B 단행(5/26), 기업가치 약 13억 달러. 월 100조 토큰을 400+ 모델 사이로 라우팅, 사용자 800만+ — 엔비디아와 4개 데이터 플랫폼도 참여.

AMD의 256코어 EPYC "Venice", TSMC 2nm에서 양산하는 첫 HPC 칩

읽어야 하는 이유 모두가 GPU를 본다. 하지만 AI 클러스터는 여전히 그것을 먹일 호스트 CPU가 필요하고, AMD는 누구보다 먼저 256코어 서버 칩을 최첨단 노드에 올렸다. 진짜 지렛대는 전력 벽 아래의 효율 — 그리고 그 옆을 달리는 조용한 애리조나 자국 생산 이야기다.

AMD가 EPYC "Venice"의 TSMC 2nm 양산을 발표(5/21) — 256코어/512스레드로, 업계 최초의 해당 노드 양산 HPC 제품. Turin 대비 70% 이상 향상.

일본 메가뱅크, Anthropic의 Mythos 접근권 확보 — 프런티어 모델 접근이 국가 전략으로

읽어야 하는 이유 핵심은 모델이 아니라 경로다. Mythos 접근권은 Anthropic 영업이 아니라 미 재무부 방문을 통해 전달됐다. 소프트웨어 취약점을 사냥하는 프런티어 모델은 이제 경제 외교의 도구이며, 제한적·동맹 우선이고, 첫 쿼리 전에 국가 워킹그룹이 통제한다.

일본 3대 메가뱅크(MUFG·미즈호·미쓰이스미토모)가 5월 말까지 Anthropic의 취약점 탐색 모델 Mythos 접근권을 확보할 전망 — 미 재무장관 베센트가 도쿄에서 전달.

커피