AI 경쟁축, 모델에서 칩·전력·에이전트 인프라로 이동
- OpenAI·Google·Anthropic은 에이전트 기능과 노동 전환 의제를 전면화했다
- SemiAnalysis는 2028년 이후 미국 신규 데이터센터 절반 이상이 자가발전으로 갈 수 있다고 봤다
- General Intuition·Patronus AI는 세계모델과 시뮬레이션을 에이전트 훈련 인프라로 끌어올렸다
- IBM·Gemma·Wan-Streamer는 반도체·오픈모델·실시간 멀티모달의 성능 경계를 넓혔다
OpenAI, 사내 출력 토큰 99.8%를 Codex가 처리한다고 공개
주요 사건
OpenAI는 법무·재무·채용을 포함한 전 부서에서 Codex가 주 업무용 AI 도구가 됐다고 밝혔다. 평균 직원의 출력 토큰 중 85% 이상, 사내 전체 주간 출력 토큰의 99.8%가 Codex에서 나온다는 수치를 제시했다.
배경
- 2025-08-01OpenAI 직원 평균 Codex 토큰 비중 10% 미만
- 2025-12-01엔지니어 평균 사용량이 Codex 중심으로 전환
- 2026-04-01법무·재무·채용도 Codex가 주 AI 도구로 전환
- 2026-06-25OpenAI, Codex가 사내 주간 출력 토큰 99.8% 차지한다고 공개
주요 입장
전망
- · OpenAI는 연구 부서의 Codex 토큰 사용이 2025년 11월 대비 56배 늘었다고 밝혔다
- · 기업용 에이전트의 병목은 모델보다 내부 시스템 접근권한과 검증 체계로 이동 중이다
한국 영향
- 에이전트 작업 로그 표준
- 비개발 부서의 코드·데이터 권한 관리
- 국내 기업용 AI 도입 속도
Google, Gemini 3.5 Flash에 화면 조작 기능을 기본 탑재
주요 사건
Google DeepMind는 Gemini 3.5 Flash가 브라우저·모바일·데스크톱 인터페이스를 보고 조작하는 네이티브 computer use 기능을 지원한다고 발표했다.
배경
- 2025-10-01Google, 별도 computer use 모델 제공
- 2026-05-19Gemini 3.5 Flash 공개
- 2026-06-25Gemini 3.5 Flash에 native computer use 탑재 발표
주요 입장
전망
- · 보도에 따르면 Gemini 3.5 Flash는 OSWorld-Verified 78.4점으로 GPT-5.5 78.7점과 근접했다
- · Google은 민감 작업 확인과 간접 프롬프트 인젝션 중단 옵션을 제시했다
한국 영향
- OSWorld 실제 검증
- Workspace·Android 통합
- 프롬프트 인젝션 방어
참고 자료
SemiAnalysis, 2028년 미국 데이터센터 절반 이상 자가발전 전망
주요 사건
SemiAnalysis는 미국 전력망이 AI 데이터센터 수요를 따라가지 못해 2028년 이후 신규 데이터센터의 50% 이상이 behind-the-meter 자가발전으로 갈 수 있다고 분석했다. 2029년 관련 장비 시장은 연 50GW를 넘을 수 있다고 봤다.
배경
- 2023-01-01AI 데이터센터 수요 급증 시작
- 2026-01-01미국 주요 전력 시장에서 접속·장비 지연 심화
- 2026-06-25SemiAnalysis, 40GW+ BTM 데이터센터 전망 제시
- 2028-01-01신규 미국 데이터센터 절반 이상 BTM 전환 가능성
주요 입장
전망
- · SemiAnalysis는 연간 순증 ELCC 용량을 15GW 안팎, 10년 말 20GW+로 추정했다
- · 전력 부족으로 미국 데이터센터 7GW 안팎이 지연·취소됐다는 산업 추적도 있다
한국 영향
- 가스터빈·변압기 리드타임
- 국내 데이터센터 전력망 접속
- 한전·민간 발전 협력 모델
참고 자료
General Intuition, 게임 행동 데이터로 23억달러 세계모델 기업 등극
주요 사건
General Intuition은 3억2000만달러를 조달하며 23억달러 기업가치를 인정받았다. Medal의 게임 클립과 버튼 입력 시점 데이터를 활용해 공간·시간 추론과 행동 모델을 훈련한다는 전략이다.
배경
- 2025-10-16General Intuition, 1억3400만달러 초기 라운드 발표
- 2026-01-01Khosla Ventures 주도 3억2000만달러 라운드 완료
- 2026-06-2523억달러 가치와 API 확장 계획 공개
주요 입장
전망
- · Khosla는 게임의 action/reaction 데이터가 세계모델의 직관 형성에 핵심이라고 평가했다
- · TechCrunch는 sim-to-real 전이가 아직 공개 검증되지 않은 핵심 리스크라고 지적했다
한국 영향
- 게임 데이터 라이선스
- 로봇 전이 성능
- 한국 게임사 AI 파트너십
Patronus AI, 에이전트 시험용 디지털 월드로 5000만달러 유치
주요 사건
Patronus AI가 Greenfield Partners 주도 5000만달러 시리즈B를 유치했다. 웹사이트와 내부 시스템을 복제한 디지털 환경에서 에이전트를 장시간 스트레스 테스트하고 강화학습에 활용한다.
배경
- 2023-01-01Patronus AI 창업
- 2026-06-255000만달러 시리즈B와 Digital World Model 발표
주요 입장
전망
- · Patronus는 장시간 10시간·10일·10주 운용 가능한 에이전트 환경을 목표로 한다고 밝혔다
- · Waymo식 합성 환경 훈련이 소프트웨어 에이전트에도 적용되는 흐름이다
한국 영향
- 장시간 에이전트 실패율
- 산업별 평가 데이터셋
- 국내 규제 샌드박스 연계
IBM, 1000억 트랜지스터 0.7나노급 나노스택 칩 공개
주요 사건
IBM은 손톱 크기 면적에 약 1000억 개 트랜지스터를 넣는 0.7nm급, 즉 7Å 노드 나노스택 구조를 공개했다. 2021년 2nm 기술 대비 성능 50% 향상 또는 에너지 효율 70% 개선 가능성을 제시했다.
배경
- 2015-01-01IBM, 나노시트 트랜지스터 연구 공개
- 2021-01-01IBM, 2nm 노드 기술 발표
- 2026-06-25IBM, 7Å 나노스택 구조 공개
- 2030-01-01IBM, 10년 내 데이터센터 적용 가능성 전망
주요 입장
전망
- · IBM은 2nm 대비 50% 성능 또는 70% 효율 개선을 주장했다
- · MIT Technology Review는 0.7nm가 실제 치수라기보다 노드 명명 관행이라고 설명했다
한국 영향
- 나노스택 수율
- 파운드리 파트너
- SRAM 스케일링 개선폭
참고 자료
Anthropic·OpenAI, 5억달러 AI 노동 전환 연합에 합류
주요 사건
Anthropic은 RAISE US 창립 파트너로 합류했다. 이 비영리 연합은 5억달러 이상을 투입해 AI로 흔들릴 노동시장의 재교육·전직 정책을 주정부와 기업이 함께 실험한다.
배경
- 2026-06-25RAISE US 출범 및 Anthropic·OpenAI Foundation 앵커 파트너 참여
- 2026-06-25초기 4개 주 파트너십 공개
주요 입장
전망
- · Axios는 RAISE US가 5억달러를 확보했고 10억달러까지 확대를 목표로 한다고 보도했다
- · Jack Clark은 AI 경제 영향에 대응할 인프라가 필요하다고 밝혔다
한국 영향
- AI 재교육 성과 지표
- 화이트칼라 자동화 정책
- 국내 AI 고용 영향 조사
Gemma 4, 출시 2.5개월 만에 다운로드 2억건 돌파
주요 사건
Google의 오픈 웨이트 모델 Gemma 4가 출시 2.5개월 만에 다운로드 2억건을 넘었다. Gemma 3 출시 당시 전체 Gemma 계열 누적 다운로드가 1억건이었다는 점에서 확산 속도가 크게 빨라졌다.
배경
- 2026-04-02Gemma 4 출시
- 2026-06-09Google, 다운로드 1억5000만건 및 개발 사례 공개
- 2026-06-25Gemma 4 다운로드 2억건 돌파
주요 입장
전망
- · Google은 Gemma 4가 256K 컨텍스트와 QAT 체크포인트를 제공한다고 밝혔다
- · 다운로드 2억건은 오픈 모델 생태계가 API 중심 시장과 별도 축으로 성장하고 있음을 보여준다
한국 영향
- 한국어 성능
- 상업 라이선스 활용
- 온디바이스 최적화
Wan-Streamer, 550ms 지연의 실시간 음성·영상 AI 모델 공개
주요 사건
Wan-Streamer v0.1은 언어·음성·영상을 하나의 Transformer에서 입력과 출력으로 함께 처리하는 실시간 양방향 멀티모달 모델을 공개했다. 논문은 모델 측 지연 약 200ms, 총 상호작용 지연 약 550ms를 주장한다.
배경
- 2026-06-23Wan-Streamer 논문 제출
- 2026-06-25Hugging Face와 X에서 모델 공개 확산
주요 입장
전망
- · 논문은 25fps에서 160ms 스트리밍 단위와 200ms 모델 측 지연을 제시했다
- · Hugging Face 논문 페이지는 Wan-Streamer를 단일 Transformer 기반 실시간 오디오비주얼 모델로 소개했다
한국 영향
- 한국어 실시간 품질
- 워터마킹
- 모바일 GPU 최적화
OpenAI GPT-5.5 Instant, 의도 파악·복합 제약 대응 강화
주요 사건
OpenAI가 GPT-5.5 Instant 업데이트를 유료 사용자부터 배포하고 무료 사용자로 확대한다. 의도 파악, 대화 중 제약 변경 대응, 쇼핑·지역 추천의 응집성이 개선됐고 API에서는 chat-latest 별칭으로 접근 가능하다.
배경
- 2026-05-05GPT-5.5 Instant, ChatGPT 기본 모델로 공개
- 2026-06-25대화성·복합 제약·추천 개선 업데이트 보도
주요 입장
전망
- · VentureBeat는 이번 업데이트가 메모리 확장보다 의도 파악과 제약 대응에 초점을 뒀다고 분석했다
- · OpenAI는 5월 업데이트에서 GPT-5.5 Instant의 환각 감소 수치를 공개한 바 있다
한국 영향
- 한국 지역 추천 품질
- chat-latest API 안정성
- 개인화 데이터 정책
SemiAnalysis, AI 에이전트가 서버 CPU 수요를 되살린다고 진단
주요 사건
SemiAnalysis는 AI 붐에서 GPU에 가려졌던 서버 CPU 수요가 강화학습, 에이전트, 긴 컨텍스트 메모리, RAG와 코딩 세션으로 다시 커지고 있다고 강조했다. AMD Venice 256코어, Intel Diamond Rapids, Arm Phoenix 등 2026년 CPU 로드맵이 부각됐다.
배경
- 2026-02-09SemiAnalysis, 2026 데이터센터 CPU 분석 공개
- 2026-06-25SemiAnalysis, AI capex의 CPU 과소추정 이슈 재강조
주요 입장
전망
- · SemiAnalysis는 AMD Venice가 192코어 Turin 대비 1.7배 이상 성능/와트를 주장한다고 전했다
- · 분석은 AI capex의 CPU 항목이 한 자릿수 배수로 과소추정됐을 수 있다고 본다
한국 영향
- MRDIMM 채택
- Arm 서버 CPU
- AI 추론 CPU 병목