OpenAI GPT-5.6·ChatGPT Work가 에이전트 경쟁의 기준선을 다시 끌어올렸다
- OpenAI는 GPT-5.6·ChatGPT Work를 출시하고 Atlas를 접으며 업무 에이전트에 제품 전략을 집중했다.
- NVIDIA Rubin NVL72와 Google TPUv8i가 AI 인프라 경쟁을 랙·네트워크 단위로 끌어올렸다.
- Anthropic GRAM·Google AI 광고 표시·NYT 소송은 AI 안전·투명성·저작권 리스크가 기술 경쟁과 동시에 커지고 있음을 보여준다.
OpenAI, GPT-5.6·ChatGPT Work 동시 출시 — 업무 에이전트 경쟁 재점화
주요 사건
OpenAI가 GPT-5.6 Sol·Terra·Luna 모델군과 Codex 기반 ChatGPT Work를 공개했다. Work는 앱·파일 맥락을 읽고 문서, 덱, 분석, 사이트를 몇 시간 단위로 생성하는 장기 실행 업무 에이전트다. OpenAI는 Sol이 Artificial Analysis Coding Agent Index 80점, BrowseComp 90.4~92.2%, OSWorld 2.0 62.6%, Terminal-Bench 2.1 88.8~91.9%를 기록했다고 제시했다.
배경
- 2022-11-30ChatGPT 공개로 대화형 AI 대중화
- 2025-10-01OpenAI, ChatGPT Atlas로 브라우저형 에이전트 시도
- 2026-07-09GPT-5.6와 ChatGPT Work 공개
주요 입장
전망
- · Artificial Analysis는 GPT-5.6 Sol이 Fable 5와 유사한 지능을 약 3분의 1 비용에 제공한다고 평가했다.
- · OpenAI는 GPT-5.6 Sol Ultra가 BrowseComp 92.2%, Terminal-Bench 2.1 91.9%를 기록했다고 밝혔다.
한국 영향
- GPT-5.6 API 가격과 캐시-write 과금 영향
- ChatGPT Work의 엔터프라이즈 권한 모델
- Claude Code 대비 실제 장기 작업 성공률
참고 자료
OpenAI, Atlas 브라우저 접고 Work로 통합 — AI 브라우저 실험 1년 만에 후퇴
주요 사건
OpenAI가 ChatGPT Atlas를 8월 9일께 종료하고 일부 에이전트 브라우징 기능을 데스크톱 앱과 Chrome 확장으로 옮긴다. 이는 별도 브라우저를 배포하기보다 ChatGPT Work 중심의 슈퍼앱으로 사용 흐름을 모으겠다는 선택이다.
배경
- 2025-10-01ChatGPT Atlas 공개
- 2026-03-01OpenAI가 앱·Codex·Atlas 통합 슈퍼앱을 검토했다는 보도
- 2026-07-09Atlas 종료 및 Work 통합 확인
주요 입장
전망
- · The Verge는 Atlas 종료가 OpenAI의 생산성 기능 집중 전략과 맞물린다고 봤다.
- · TechCrunch는 브라우저 야망 자체는 사라지지 않고 데스크톱·확장으로 이동한다고 해석했다.
한국 영향
- ChatGPT 데스크톱 앱의 브라우징 권한
- Chrome 확장 기능의 보안 검증
- AI 브라우저 스타트업의 생존 전략
참고 자료
Anthropic, 위험 지식 분리하는 GRAM 공개 — 듀얼유스 AI에 ‘모듈식 차단’ 제시
주요 사건
Anthropic과 AE Studio가 생물학·사이버·핵물리 등 듀얼유스 지식을 별도 보조 모듈에 격리하는 GRAM 연구를 공개했다. 800M 모델 실험에서 일반 데이터 16B 토큰과 위험 도메인별 약 40M 토큰을 학습시키고, 추론 시 모듈을 제거하면 해당 능력이 데이터 필터링 모델 수준으로 줄어드는 결과를 보였다.
배경
- 2024-01-01AI 생물안보·사이버 오남용 평가가 모델 출시 심사의 핵심으로 부상
- 2026-07-08Anthropic, GRAM 연구 공개
주요 입장
전망
- · Anthropic은 GRAM이 50M~5B 규모에서 data filtering을 근사하며 5개 profile 기준 5배 훈련비 절감 가능성을 보였다고 설명했다.
- · 연구진은 아직 Anthropic 생산 모델에는 적용하지 않은 예비 연구라고 명시했다.
한국 영향
- GRAM의 프런티어 모델 확장성
- 위험 모듈 복구 공격에 대한 저항성
- 국내 AI 안전성 평가 체계 반영 여부
Google, AlphaEvolve를 클라우드 GA로 전환 — 알고리즘 발견을 기업 서비스화
주요 사건
Google DeepMind와 Google Cloud가 Gemini 기반 최적화 에이전트 AlphaEvolve를 Google Cloud에서 일반 제공(GA)으로 전환했다. Google은 TPU 회로 레이아웃 최적화, Spanner LSM compaction 개선으로 write amplification 20% 감소, 저장 공간 약 9% 절감, Willow 양자 회로 오류율 10배 감소 사례를 제시했다.
배경
- 2025-12-10AlphaEvolve private preview
- 2026-07-09AlphaEvolve Google Cloud GA
주요 입장
전망
- · Google Cloud는 AlphaEvolve가 물류, 반도체, 유전체, HPC, 금융서비스에서 테스트됐다고 밝혔다.
- · Pushmeet Kohli는 이런 도구가 생산성 보조를 넘어 발견 엔진으로 이동한다고 평가했다.
한국 영향
- AlphaEvolve 과금·SLA
- 반도체 설계 자동화 적용 범위
- 생성 알고리즘의 IP 소유권
참고 자료
SemiAnalysis, Meta 초지능 1년 점검 — RL 스타트업·초대형 컴퓨트 램프 부각
주요 사건
SemiAnalysis가 Meta Superintelligence 전략 1년 점검 보고서를 공개하며 새 RL 환경 스타트업, 전례 없는 컴퓨트 램프, 2000km 이상 scale-across 네트워크를 핵심 축으로 제시했다. 이는 Meta가 인재 영입뿐 아니라 데이터센터·네트워크·평가 환경을 통째로 재설계하고 있다는 신호다.
배경
- 2025-07-11SemiAnalysis, Meta Superintelligence 인재·컴퓨트 분석
- 2026-07-09Meta Superintelligence 1년 진행 보고서 공개
주요 입장
전망
- · SemiAnalysis는 Meta가 2024년 이후 약 10GW 규모의 데이터센터·클라우드 계약을 체결했다고 분석했다.
- · 이전 보고서는 Meta가 연구자당 컴퓨트를 크게 늘리며 OpenAI 수준의 훈련 FLOPS를 목표로 한다고 봤다.
한국 영향
- Meta 신규 모델 성능
- 오픈웨이트 정책 지속 여부
- AI 데이터센터 전력 조달 방식
참고 자료
NVIDIA Vera Rubin NVL72 세부 공개 — HBM4 20.7TB·NVFP4 3.6EFLOPS 제시
주요 사건
SemiAnalysis가 NVIDIA Vera Rubin NVL72의 아키텍처와 제조 혁신을 분석했다. NVIDIA 공개 사양 기준 한 랙은 Rubin GPU 72개, Vera CPU 36개, HBM4 20.7TB, HBM 대역폭 1,580TB/s, NVFP4 추론 3,600PFLOPS, NVFP4 훈련 2,520PFLOPS, NVLink 6 스위치 대역폭 260TB/s를 제공한다.
배경
- 2024-03-18NVIDIA Blackwell 공개
- 2026-01-05NVIDIA Rubin 플랫폼 세부 공개
- 2026-07-09SemiAnalysis, Vera Rubin NVL72 세부 분석
주요 입장
전망
- · NVIDIA는 Rubin NVL72가 Blackwell 대비 훈련은 4분의 1 GPU, 추론은 10분의 1 비용을 목표로 한다고 홍보한다.
- · 공개 사양은 랙당 72 Rubin GPU와 54TB LPDDR5X CPU 메모리를 제시한다.
한국 영향
- HBM4 양산 수율
- NVL72 실제 전력·냉각 요구
- 미중 수출통제 영향
Google TPUv8i 외부 확산 신호 — BroadFly 1,024칩 7홉 구조가 NVIDIA 견제
주요 사건
SemiAnalysis는 Anthropic의 다섯 차례 이상 Claude 출시가 TPU 학습 성공을 입증했고, Google TPU가 외부 워크로드에서 점유율을 높이고 있다고 평가했다. 특히 TPUv8i BroadFly 토폴로지는 기존 3D torus의 최대 16홉 대신 1,024개 활성 칩을 7홉 반경으로 묶어 통신 지연을 낮춘다.
배경
- 2016-05-18Google TPU 공개
- 2026-04-22Google, 8세대 TPU 8t·8i 공개
- 2026-07-09SemiAnalysis, 외부 TPU traction 분석
주요 입장
전망
- · The Register는 TPU 8i가 1,152칩 중 1,024개 활성 구조와 7홉 BroadFly 네트워크를 갖춘다고 설명했다.
- · SemiAnalysis는 Anthropic의 반복 출시가 TPU 학습 성공의 실증이라고 평가했다.
한국 영향
- TPU v8i 가격
- Claude급 학습에서 TPU 안정성
- 국내 클라우드의 TPU 접근성
xAI Grok 4.5, 비용 대비 성능으로 부상 — 코딩 에이전트 76점 기록
주요 사건
Elon Musk가 Grok 4.5 성능 평가를 재공유하며 사용을 독려했다. Artificial Analysis는 Grok 4.5가 Intelligence Index 54점으로 Fable 5, GPT-5.5, Opus 4.8 뒤 4위에 올랐고, Grok Build 조합에서 Coding Agent Index 76점을 기록해 GPT-5.5 Codex와 유사한 수준이라고 평가했다. 코딩 작업당 비용은 $2.49로 Fable 5 Claude Code $11.80, GPT-5.5 Codex $5.07보다 낮다고 제시했다.
배경
- 2023-07-12xAI 설립
- 2024-09-01Colossus 클러스터 가동
- 2026-07-09Grok 4.5 성능 지표 확산
주요 입장
전망
- · Artificial Analysis는 Grok 4.5가 Grok 4.3 대비 Intelligence Index 16점 상승했다고 밝혔다.
- · 같은 평가에서 Omniscience 정확도는 35%에서 52%로 올랐지만 환각률도 25%에서 54%로 상승했다.
한국 영향
- Grok API 안정성
- 한국어·국내 코드베이스 성능
- 환각률 개선 여부
참고 자료
Meta, Muse Spark 1.1로 코딩 에이전트 전장 진입 — 대규모 마이그레이션 겨냥
주요 사건
Meta가 Muse Spark 1.1을 공개하며 AI 코딩 모델 경쟁에 본격 진입했다. Meta는 계획 모드, 목표 조건화, subagent 등 일반적인 agentic coding 기능을 지원한다고 설명하며, 기업의 버그 수정·대형 코드 마이그레이션을 주요 사용처로 제시했다.
배경
- 2024-01-01AI 코딩 보조가 IDE 플러그인에서 에이전트로 전환
- 2026-07-09Meta Muse Spark 1.1 발표
주요 입장
전망
- · AI Release Tracker는 Muse Spark 1.1이 SWE-Bench Pro, DeepSWE 1.1, Terminal-Bench 2.1 등을 포함한 벤치마크로 평가됐다고 정리했다.
- · TechCrunch는 Meta가 대형 agentic workloads와 코드 마이그레이션을 전면에 세웠다고 보도했다.
한국 영향
- Muse Spark 라이선스·배포 방식
- Claude Code·Codex 대비 한국어 코드 성능
- 대형 레거시 코드 수정 성공률
구글, AI 생성 광고 표시 확대 — 정치 광고 밖 상업 광고까지 투명성 적용
주요 사건
Google이 Search, YouTube, Discover의 My Ad Center에서 광고가 AI로 생성·편집됐는지 확인할 수 있는 ‘How this ad was made’ 표시를 도입한다. Google 생성형 광고 도구를 쓰면 자동 표시되고, 외부 도구로 만든 광고는 광고주가 직접 표시해야 한다.
배경
- 2024-07-02Google, 정치 광고 합성 콘텐츠 공개 규칙 강화
- 2026-07-09AI 생성 광고 표시를 일반 광고로 확대
주요 입장
전망
- · TechCrunch는 Google이 외부 생성 광고를 자체 판별하지 않고 광고주 신고에 의존한다고 지적했다.
- · Google은 정책상 오도 광고를 금지하지만 AI 사용 자체는 허용한다.
한국 영향
- 외부 AI 광고 표시 누락 단속
- 한국 광고 규제 반영
- 콘텐츠 진위 메타데이터 표준
NYT, OpenAI에 증거 은폐 제재 요청 — 저작권 소송 리스크 재부상
주요 사건
뉴욕타임스와 언론사들이 OpenAI가 ChatGPT 로그와 데이터 검색 능력을 숨겼다며 법원에 제재를 요청했다. Ars Technica 보도에 따르면 원고 측은 OpenAI가 1,000만·7,800만 건 규모의 비식별 로그 샘플을 보유·검색했음에도 2년간 대규모 검색이 어렵다고 주장했다고 밝혔다.
배경
- 2023-12-27NYT, OpenAI·Microsoft 저작권 소송 제기
- 2026-07-09NYT 등 원고, 증거 은폐 제재 요청
주요 입장
전망
- · Ars Technica는 원고가 7,800만 로그 샘플과 190억 건 redaction 문제를 제기했다고 보도했다.
- · ABC는 이 소송이 뉴스 산업과 AI의 저작권 경계를 가를 고위험 사건이라고 설명했다.
한국 영향
- 법원의 제재 인용 여부
- OpenAI·언론사 라이선스 합의 확대
- 국내 저작권 소송 파급
참고 자료
Anthropic, 장기공익신탁에 벤 버냉키 합류 — AI 거버넌스에 거시경제 무게 추가
주요 사건
Anthropic의 Long-Term Benefit Trust가 전 연준 의장 벤 버냉키를 새 구성원으로 임명했다. 프런티어 AI 기업 거버넌스가 안전 연구자 중심을 넘어 금융·거시경제 리스크 전문가까지 포섭하는 흐름이다.
배경
- 2021-01-01Anthropic 설립
- 2023-09-01Long-Term Benefit Trust 구조 주목
- 2026-07-09Ben Bernanke LTBT 합류
주요 입장
전망
- · Anthropic은 Long-Term Benefit Trust가 장기 공익 관점에서 회사 방향을 감시한다고 설명해왔다.
- · 버냉키의 합류는 AI가 거시경제 정책 의제라는 신호로 해석된다.
한국 영향
- LTBT의 실제 의결권 범위
- Anthropic 상장 전 거버넌스 변화
- AI 경제 영향 평가 체계