OpenAI·xAI·Cognition, 음성·코딩 에이전트 경쟁을 하루 만에 재점화
- OpenAI가 GPT-Live와 GPT-5.6 Sol 일정을 공개하며 실시간 음성과 고위험 사이버 안전을 동시에 전면에 세웠다
- xAI Grok 4.5와 Cognition SWE-1.7이 비용·속도·코딩 지표를 앞세워 프런티어 모델 경쟁을 가격전으로 옮겼다
- 로봇·반도체 검사·AI 웨어러블·딥페이크 검증 이슈가 모델 성능 경쟁의 실제 산업 파급을 보여줬다
OpenAI, GPT-Live 공개 — 실시간 대화형 음성 AI 전환
주요 사건
OpenAI가 ChatGPT에 새 음성 모델 GPT-Live를 출시했다. 핵심은 full-duplex 구조로, 사용자가 말하는 동안 모델이 동시에 듣고 말할 수 있어 끊김이 적고 통역·검색·추론 위임이 자연스러워진다.
배경
- 2024-05-13OpenAI가 실시간 음성 인터페이스를 대중화
- 2026-07-08GPT-Live가 ChatGPT에 출시
주요 입장
전망
- · The Verge는 GPT-Live-1이 말하고 듣는 동시 처리로 끼어듦을 줄인다고 평가
- · TechCrunch는 full-duplex가 실시간 통역과 자연스러운 interruption을 여는 핵심이라고 설명
한국 영향
- 한국어 실시간 통역 품질
- 음성 데이터 저장·학습 정책
OpenAI, SWE-Bench Pro 30% 결함 지적 — 코딩 평가 신뢰성 흔들림
주요 사건
OpenAI가 대표 코딩 벤치마크 SWE-Bench Pro를 감사한 결과 약 30% 과제가 숨은 요구사항, 모순된 지시, 과도한 테스트, 불완전한 채점 기준 등으로 프런티어 코딩 능력을 안정적으로 측정하지 못한다고 밝혔다.
배경
- 2023-10-01SWE-Bench가 실제 이슈 기반 코딩 평가로 확산
- 2026-07-08OpenAI가 SWE-Bench Pro 권고 철회
주요 입장
전망
- · OpenAI는 모델 기반 조사 에이전트와 5명의 숙련 엔지니어 독립 리뷰를 병행했다고 설명
- · 별도 공개 감사는 최소 15%의 결정 불가능 과제 바닥값을 제시했다
한국 영향
- 결함 과제 비율 재산정
- Codex·Claude Code·Grok Build 실제 성공률
OpenAI, GPT-5.6 Sol 목요일 출시 — 정부 검토 뒤 광범위 배포
주요 사건
샘 올트먼이 GPT-5.6 Sol 출시 일정을 예고했고, 보도와 OpenAI 설명은 미국 정부 검토 이후 광범위 배포가 가능해졌다고 전했다. Sol은 고성능 모델, Terra·Luna는 효율형 라인으로 포지셔닝된다.
배경
- 2026-06-26OpenAI가 GPT-5.6 Sol 제한 preview를 공지
- 2026-07-08목요일 공개 출시 계획 확인
주요 입장
전망
- · Axios는 트럼프 행정부가 GPT-5.6 광범위 출시를 허용했다고 보도
- · OpenAI는 고위험 활동·민감 사이버 요청·반복 오용 보호를 강화했다고 설명
한국 영향
- API 공개 가격
- 한국 기업 계정의 cyber 기능 접근 제한
xAI, Grok 4.5 공개 — 낮은 비용으로 코딩·업무 지표 추격
주요 사건
일론 머스크가 Grok 4.5의 성능·속도·비용 개선을 연속적으로 강조했다. xAI 자료는 DeepSWE pass@1 55.75%, 80 TPS, 입력 100만 토큰당 2달러·출력 6달러를 제시했고, 외부 평가에서는 GDPval+에서 Grok 4.5 29%, GPT-5.5 22%, Claude Opus 4.8 21%가 언급됐다.
배경
- 2025-07-01xAI가 대규모 Colossus 인프라 경쟁에 진입
- 2026-07-08Grok 4.5 성능·가격 지표 공개
주요 입장
전망
- · Snorkel AI는 GDPval+에서 Grok 4.5가 GPT-5.5와 Opus 4.8을 앞섰다고 밝혔다
- · Artificial Analysis 계열 평가는 비용 대비 성능을 주요 차별점으로 제시했다
한국 영향
- 1M 컨텍스트 업그레이드 실제 제공
- 한국어·국내 레포 코딩 성능
Cognition, SWE-1.7 공개 — Devin에 1000 TPS 코딩 모델 탑재
주요 사건
Cognition이 SWE-1.7을 공개했다. 회사는 프런티어 모델에 근접한 코딩 성능을 낮은 비용으로 제공하고, Devin 웹·데스크톱·CLI에서 Cerebras 기반 1000 TPS로 사용할 수 있다고 밝혔다.
배경
- 2024-03-01Devin이 자율 코딩 에이전트 범주를 대중화
- 2026-07-08SWE-1.7 공개 및 Devin 탑재
주요 입장
전망
- · Cognition은 SWE-1.7이 프런티어 지능을 낮은 비용으로 제공한다고 주장
- · swyx는 선전·검열 평가와 보정, 1000 tok/s 서빙을 생산화의 핵심으로 해석했다
한국 영향
- Devin 내 실제 처리속도
- 보안·라이선스 검토 자동화 품질
ZML, 다중 칩 LLM 서버 공개 — 엔비디아 의존 낮추기 시도
주요 사건
프랑스 스타트업 ZML이 ZML/LLMD를 공개했다. Nvidia, AMD, Google TPU, Apple Metal, Intel Arc 등 여러 칩에서 오픈소스 LLM을 실행하도록 돕는 추론 서버로, 초기에는 무료 제품으로 배포된다.
배경
- 2024-09-17ZML이 생산 추론 스택을 공개
- 2026-07-08ZML/LLMD 무료 서버 출시
주요 입장
전망
- · TechCrunch는 ZML/LLMD가 다양한 칩에서 LLM을 최대 속도로 실행하려는 시도라고 보도
- · Yann LeCun은 자체 고성능 이기종 추론 스택 공개를 리트윗하며 주목했다
한국 영향
- 오픈소스 여부와 라이선스
- 국산 NPU 백엔드 지원 가능성
Lovable, 132억달러 가치 논의 — 바이브 코딩 투자 과열 지속
주요 사건
스웨덴 AI 앱 제작 스타트업 Lovable이 3억달러를 132억달러 가치로 조달하는 방안을 논의 중이라고 보도됐다. 지난해 말 66억달러 평가의 약 두 배이며, 연간 반복 매출은 5억달러 수준으로 전해졌다.
배경
- 2025-12-01Lovable이 약 66억달러 가치 Series B를 기록
- 2026-07-08132억달러 가치 신규 라운드 논의 보도
주요 입장
전망
- · Sifted는 Menlo Ventures 주도 가능성과 3억달러 라운드를 보도
- · TNW는 5억달러 ARR과 146명 규모를 밸류에이션 근거로 언급했다
한국 영향
- 보안 취약점 자동 점검
- 한국 결제·인증·공공 클라우드 연동
참고 자료
QuantumDiamonds, EU 지원으로 반도체 검사 병목 공략
주요 사건
독일 스타트업 QuantumDiamonds가 EU·독일 지원을 바탕으로 양자 센서 기반 반도체 검사 장비 생산을 추진한다. 앞서 독일은 7,600만유로 보조금을 승인받았고, EU 첫 양자 센서 기반 반도체 검사 장비 생산시설로 평가된다.
배경
- 2026-06-23EU가 독일의 QuantumDiamonds 7,600만유로 보조금 승인
- 2026-07-08TechCrunch가 칩 제조 가속 목표를 보도
주요 입장
전망
- · eeNews Europe은 해당 시설이 EU 첫 양자 센서 기반 반도체 검사 생산시설이 될 것이라고 설명
- · TechCrunch는 European Chips Act 지원을 받은 제조 병목 해소 시도로 해석했다
한국 영향
- 실제 수율 개선 데이터
- HBM·첨단 패키징 적용 가능성
참고 자료
General Intuition, 게임 데이터로 로봇 파운데이션 모델 구축
주요 사건
General Intuition이 수백만 시간의 비디오게임 플레이 데이터를 활용해 물리 AI 파운데이션 모델을 만들고 있다고 밝혔다. 회사는 8분의 실제 로봇 데이터 미세조정만으로 사족보행 로봇을 구동하는 데모를 제시했고, 지난달 3억2,000만달러를 23억달러 가치로 조달했다.
배경
- 2026-06-25General Intuition이 3억2,000만달러 조달 발표
- 2026-07-08게임 데이터 기반 로봇 전략 공개 인터뷰
주요 입장
전망
- · CEO Pim de Witte는 몇 분의 실제 데이터만으로 충분해지는 일반화 능력을 주장
- · Vinod Khosla는 행동 데이터가 공간·시간 추론의 핵심이라고 봤다
한국 영향
- 현실 환경 안전성
- 한국 제조 현장 데이터와의 전이 성능
참고 자료
Meta, 상시 녹화 AI 안경 시험 — 프라이버시 논란 재점화
주요 사건
Meta가 오디오를 계속 기록하고 몇 초마다 사진을 찍는 ‘super sensing’ AI 안경 프로토타입을 개발 중이라고 보도됐다. 착용자는 Meta AI에 하루의 장면을 물어볼 수 있지만, 경고 LED와 원본 저장 방식이 핵심 논란이다.
배경
- 2013-02-01Google Glass가 착용형 카메라 프라이버시 논란을 촉발
- 2026-07-08Meta super sensing 안경 개발 보도
주요 입장
전망
- · FT는 원본 대신 메타데이터를 서버에서 AI가 검색하는 안이 논의된다고 보도
- · TechCrunch는 Meta의 AI 전략이 더 많은 개인 데이터 수집에 의존한다고 비판했다
한국 영향
- 경고 LED 의무화
- 얼굴·음성 메타데이터 처리 기준
참고 자료
Google SynthID, 매코널 가짜 사진 판별 — 워터마크 실전 첫 성과
주요 사건
Google의 SynthID가 미치 매코널 상원의원이 중환자실에 있는 것처럼 보이는 가짜 이미지를 판별하는 데 사용됐다. 고위 정치인을 겨냥한 AI 이미지에 워터마크 검출이 실제 팩트체크에 기여한 사례다.
배경
- 2023-08-01Google이 SynthID 워터마킹을 공개
- 2026-07-08매코널 가짜 사진 판별 사례 보도
주요 입장
전망
- · TechCrunch는 SynthID가 고위급 딥페이크를 반박한 드문 성과라고 평가
- · Lead Stories는 해당 사진이 실제 장면이 아니며 AI 생성물이라고 판정했다
한국 영향
- 국내 포털·메신저의 워터마크 검출 연동
- 비워터마크 생성물 탐지 정확도