GPT-5.6과 Grok 4.5가 AI 경쟁축을 성능에서 비용·에이전트로 옮긴다
- OpenAI는 GPT-5.6을 의료·업무·Copilot에 확장하며 Luna 비용을 GPT-5.5 대비 25분의 1로 낮췄다
- xAI의 Grok 4.5는 코딩·에이전트 벤치마크에서 선두권 성능을 더 낮은 토큰 비용으로 제시했다
- AI 인프라 병목은 GPU에서 HBM·광인터커넥트·데이터센터 금융 구조로 넓어지고 있다
- Apple-OpenAI 소송과 OpenAI 바이오 바운티 확대는 AI 하드웨어·안전 거버넌스 리스크를 부각했다
OpenAI, GPT-5.6 의료 성능 공개 — Luna 비용 25분의 1로 낮춘다
주요 사건
OpenAI가 GPT-5.6 제품군의 의료·생명과학 성능을 강조했다. 공개 자료 기준 Sol은 HealthBench Professional 60.5%, LifeSciBench 59.9%, GeneBench Pro 28.7%를 기록했고, Luna는 GPT-5.5 최고 추론 설정보다 낮은 비용으로 유사·상회 성능을 내세운다.
배경
- 2017-06-01Transformer 논문 발표
- 2026-07-10OpenAI가 GPT-5.6 의료 성능과 비용 절감을 공개
주요 입장
전망
- · ARC·HealthBench류 벤치마크는 실제 배치 전 사후검증이 필수라는 평가가 많다
- · 저비용 추론은 의료 AI의 파일럿을 운영비 관점에서 가능하게 만든다
한국 영향
- HealthBench 외 한국어 의료 데이터 성능
- 병원 EMR 연동과 개인정보 보호
참고 자료
OpenAI, 바이오 보안 바운티 상설화 — 보상 5만 달러로 두 배 인상
주요 사건
OpenAI가 Bio Bug Bounty를 상설 비공개 프로그램으로 전환하고, 생물안전 과제 우회에 대한 최대 보상을 2만5천 달러에서 5만 달러로 올렸다. GPT-5.6부터 프런티어 모델의 보편적 바이오 jailbreak가 핵심 범위다.
배경
- 2023-10-30미국 AI 행정명령에서 생물·화학 안전 평가 강조
- 2026-07-10OpenAI가 Bio Bounty 상설화와 5만 달러 보상을 발표
주요 입장
전망
- · 바이오 jailbreak는 단일 프롬프트 차단보다 다단계 도구 사용 통제가 중요하다는 견해가 많다
- · 보상 확대는 취약점 공개를 회색시장보다 공식 채널로 유도한다
한국 영향
- 한국 연구자의 글로벌 바운티 참여
- 바이오 데이터 접근통제 기준
Microsoft 365 Copilot, GPT-5.6을 기본 선호 모델로 채택한다
주요 사건
Sam Altman은 GPT-5.6이 Microsoft 365 Copilot의 선호 모델이 됐다고 밝혔다. Microsoft 자료는 Word, Excel, PowerPoint, Chat, Cowork에서 GPT-5.6 제품군을 사용할 수 있다고 설명한다.
배경
- 2023-03-16Microsoft 365 Copilot 공개
- 2026-07-10GPT-5.6이 Copilot 선호 모델로 발표
주요 입장
전망
- · 업무 AI의 승부처는 모델 성능보다 권한·감사·데이터 거버넌스라는 평가가 강하다
- · Office 배포망은 모델 채택 속도를 크게 높인다
한국 영향
- 한국어 문서 품질
- 사내 데이터 반출·감사 로그
참고 자료
GPT-5.6 Sol, ARC-AGI-3 7.8% 기록 — 첫 유의미 돌파 신호 낸다
주요 사건
ARC Prize는 GPT-5.6 Sol이 ARC-AGI-3에서 7.8%를 기록하고 공개 게임 한 개를 해결한 첫 프런티어 모델이라고 밝혔다. ARC-AGI-1 96.5%, ARC-AGI-2 92.5%와 달리 ARC-AGI-3는 새 환경 적응을 보는 고난도 평가다.
배경
- 2019-11-01ARC 벤치마크 제안
- 2026-07-10GPT-5.6 Sol이 ARC-AGI-3 7.8%로 공개
주요 입장
전망
- · ARC Prize는 Sol이 실패 가설을 재계획으로 연결한 점을 핵심 진전으로 봤다
- · 절대 점수 7.8%는 아직 초기 단계라는 보수적 평가도 함께 나온다
한국 영향
- ARC-AGI-3 재현성
- 한국형 장기추론 벤치마크
xAI Grok 4.5, 코딩·에이전트 평가서 비용 대비 선두권에 오른다
주요 사건
Elon Musk는 Grok 4.5의 Perplexity 적용과 Grok Build 성능을 홍보했다. Artificial Analysis는 Grok 4.5가 Intelligence Index 54점, GDPval-AA v2 Elo 1543, τ³-Banking 33%, Coding Agent Index에서 과제당 2.49달러 수준의 비용 효율을 보였다고 평가했다.
배경
- 2023-11-04xAI Grok 초기 공개
- 2026-07-10Grok 4.5가 Perplexity와 Grok Build 성능으로 재부각
주요 입장
전망
- · Artificial Analysis는 Grok 4.5가 비용-성능 Pareto frontier에 있다고 평가했다
- · 코딩 에이전트 평가는 harness와 도구 환경에 민감해 자체 검증이 필요하다
한국 영향
- 한국어·코딩 혼합 과제 성능
- API 안정성과 데이터 정책
SemiAnalysis, Google TPUv9에 2.4T 코히런트 라이트 채택 전망한다
주요 사건
SemiAnalysis는 Google TPUv9 스케일업 네트워크에 Innolight의 2.4T coherent-lite 트랜시버와 Marvell 커스텀 DSP가 채택될 것으로 예상했다. CPO가 2029년 대량 채택 전까지 성숙해야 하는 사이, coherent-lite가 2~20km와 OCS 연동 대역폭 확장의 실용적 해법이라는 주장이다.
배경
- 2021-01-01Google이 coherent-lite 계열 기술을 IEEE에서 제시
- 2026-07-10SemiAnalysis가 TPUv9 2.4T coherent-lite 채택 전망을 공개
주요 입장
전망
- · Marvell은 coherent-lite가 800G/1.6T, 2~20km 캠퍼스 연결을 겨냥한다고 설명한다
- · TrendForce는 800G+ 모듈 비중이 2024년 약 20%에서 2026년 60% 이상으로 늘 수 있다고 봤다
한국 영향
- 2.4T 광모듈 양산 수율
- 삼성·SK HBM과 광인터커넥트 패키징 연계
SK하이닉스, 미국서 265억 달러 조달 — AI 메모리 랠리 정점 찍는다
주요 사건
SK하이닉스가 미국 ADR 발행으로 265억 달러를 조달하며 미국 역사상 최대 외국기업 상장 기록을 세웠다. BBC는 1억7,790만 ADS를 주당 149달러에 팔았고 첫 거래에서 최대 17% 상승했다고 전했다.
배경
- 2023-01-01생성AI 확산으로 HBM 수요 급증
- 2026-07-10SK하이닉스가 미국서 265억 달러 조달
주요 입장
전망
- · BBC는 투자자 수요가 배정 물량의 7배 이상이었다고 전했다
- · AI 인프라 투자가 한국 같은 기술집약 경제를 떠받친다는 분석도 나온다
한국 영향
- HBM4 수율과 고객 다변화
- 미국 fab 투자 조건
참고 자료
Apple, OpenAI에 영업비밀 소송 — AI 하드웨어 경쟁 법정으로 번진다
주요 사건
Apple이 OpenAI와 IO Products, 전 Apple 출신 임직원을 상대로 AI 하드웨어 개발 관련 영업비밀 탈취 소송을 제기했다. TechCrunch·NBC·Axios도 같은 내용을 보도했다.
배경
- 2025-01-01OpenAI가 Jony Ive 계열 AI 하드웨어 전략을 강화
- 2026-07-10Apple이 OpenAI를 상대로 영업비밀 소송 제기
주요 입장
전망
- · 소송은 AI 소프트웨어 기업이 하드웨어로 확장할 때 기존 제조 강자의 IP 장벽을 보여준다
- · 전 직원 이동 사건은 증거개시 과정에서 장기화될 수 있다
한국 영향
- 가처분 여부
- OpenAI 하드웨어 출시 일정
Tencent, HiLS-Attention 공개 — 7B 모델 장문 추론 효율 높인다
주요 사건
AK가 Tencent의 HiLS-Attention 공개를 전했다. 논문은 chunk-wise sparse attention이 언어모델 손실로 chunk 선택을 end-to-end 학습하며, 345M 모델에서 8K 학습 후 4M 컨텍스트 needle retrieval 90% 이상, 7B 모델 전환에 50B 토큰 continued training을 보고했다.
배경
- 2017-06-01Transformer가 full attention 구조를 제시
- 2026-07-10HiLS-Attention이 Hugging Face와 GitHub에서 확산
주요 입장
전망
- · 논문은 64배 이상 길이 외삽과 90% retrieval accuracy를 핵심 지표로 제시했다
- · 실제 대규모 배포에서는 훈련 안정성과 하드웨어 최적화가 관건이다
한국 영향
- 7B 이상 재현 성능
- FlashAttention류 커널 최적화 호환성
Vidu S1, 음성으로 제어하는 실시간 인터랙티브 비디오 모델 제시한다
주요 사건
AK가 Vidu S1 논문을 공유했다. Hugging Face 논문 페이지는 사용자가 음성 입력으로 디지털 캐릭터와 비디오 생성을 지속 제어하는 실시간 인터랙티브 비디오 생성 모델이라고 설명한다.
배경
- 2024-02-15Sora 공개로 고품질 텍스트-비디오 경쟁 가속
- 2026-07-10Vidu S1 논문이 AI 연구 커뮤니티에서 확산
주요 입장
전망
- · 실시간 비디오 모델의 핵심 병목은 지연시간, 캐릭터 정합성, 제어 안정성이다
- · 음성 제어는 비전문가 진입장벽을 크게 낮춘다
한국 영향
- 상용 API 지연시간
- 초상권·음성권 보호 기능
Tencent, Manus 지분 재인수 협상 — Meta의 중국 AI 인수 철회 수순 밟는다
주요 사건
MIT Technology Review의 must-read와 FT·Business Times 보도에 따르면 Tencent가 중국계 AI 스타트업 Manus의 최대 주주가 되는 협상을 진행 중이다. 이는 Beijing이 Meta의 20억 달러 인수를 되돌리도록 한 뒤 기존 투자자 컨소시엄이 같은 가치로 회수하는 구조다.
배경
- 2025-12-01Meta가 Manus 인수에 합의한 것으로 알려짐
- 2026-07-10Tencent가 Manus 최대 주주 협상에 나섰다는 보도 확산
주요 입장
전망
- · TNW는 Tencent가 최대 단일 주주이나 소수지분을 유지해 통제 집중 우려를 낮출 수 있다고 분석했다
- · 거래가 성사돼도 Meta의 배포망을 잃은 Manus는 성장 전략을 다시 세워야 한다
한국 영향
- Manus 최종 지분 구조
- 중국 AI 스타트업 해외 투자 제한