OpenAI·Microsoft·Google·Anthropic, 에이전트를 업무·보안·과학 플랫폼으로 확장
- OpenAI는 Codex 플러그인 6종·62개 앱·110개 스킬과 Sites를 공개하며 코딩 에이전트를 기업 업무 인터페이스로 확장했다.
- Microsoft는 Scout·ASSERT·MAI 모델군을 동시에 내놓고 개인 에이전트, 평가·통제, 자체 모델 스택을 한 번에 강화했다.
- Google DeepMind와 Anthropic은 Co-Scientist와 Project Glasswing으로 과학 가설 생성·취약점 탐지 같은 고위험 전문영역에 AI를 투입했다.
- Cerebras WSE와 H100 가격 지표 논쟁은 AI 인프라 병목이 반도체 수율·메모리·시장 유동성으로 이동했음을 보여준다.
OpenAI, Codex에 62개 앱·110개 스킬 묶은 업무 플러그인 공개
주요 사건
OpenAI가 Codex를 개발자용 코딩 도구에서 영업, 데이터 분석, 디자인, 투자 리서치 등 지식노동용 에이전트 플랫폼으로 확장했다. 새 플러그인은 62개 업무 앱과 110개 스킬을 묶고, Sites는 Business·Enterprise 사용자가 분석·계획을 사내 URL로 공유 가능한 웹앱으로 바꾸게 한다.
배경
- 2021-08-10OpenAI Codex API 공개로 코드 생성 모델 상용화 시작
- 2025-2026에이전트형 코딩 도구가 장시간 작업·도구 호출을 제품화
- 2026-06-02OpenAI가 Codex 플러그인 6종, 62개 앱, 110개 스킬, Sites 프리뷰 공개
주요 입장
전망
- · VentureBeat는 Sites와 플러그인을 엔터프라이즈 워크스페이스로서 Codex의 확장으로 해석했다.
- · TNW는 Codex가 개발자를 넘어 지식노동 기본 인터페이스를 노린다고 평가했다.
한국 영향
- Codex Sites의 권한·감사 기능
- 국내 기업용 SaaS의 에이전트 플러그인 대응
참고 자료
Microsoft, OpenClaw 기반 개인 에이전트 Scout를 M365에 투입
주요 사건
Microsoft가 Build에서 OpenClaw 기술을 기반으로 한 항상 켜진 개인 에이전트 Scout를 공개했다. Scout는 Teams, Outlook, OneDrive, SharePoint, 브라우저, 로컬 리소스, MCP 서버를 연결하고 Frontier 고객에게 실험적으로 제공된다.
배경
- 2026-01OpenClaw가 개인 에이전트 패러다임을 확산
- 2026-06-02Microsoft Scout 공개, Frontier 고객 프리뷰 시작
주요 입장
전망
- · The Verge는 Scout를 Microsoft의 '첫 진짜 개인비서'로 표현했다.
- · TechCrunch는 Scout가 OpenClaw식 유연성을 M365로 가져오는 시도라고 평가했다.
한국 영향
- Frontier 프리뷰 확대 시점
- OpenClaw 정책준수 upstream 기여 범위
Google DeepMind, Co-Scientist를 연구자용 가설 생성 도구로 공개
주요 사건
Google DeepMind가 Gemini 기반 다중 에이전트 시스템 Co-Scientist를 Gemini for Science의 Hypothesis Generation 도구로 연구자에게 제공한다고 밝혔다. 간섬유화, ALS, 노화 연구에서 문헌을 소화하고 검증 가능한 가설을 제안한 사례를 공개했다.
배경
- 2020-11-30AlphaFold2가 단백질 구조 예측에서 큰 도약
- 2026-05-19Co-Scientist 연구와 Gemini for Science 발표
- 2026-06-02Google DeepMind가 Co-Scientist 연구자 제공을 재공지
주요 입장
전망
- · Google은 100개 이상 기관과 시스템을 검증 중이라고 밝혔다.
- · DeepMind는 간섬유화 실험에서 91% 차단 사례를 핵심 성능 신호로 제시했다.
한국 영향
- Hypothesis Generation 접근 범위
- 국내 연구기관의 Gemini for Science 채택
참고 자료
Anthropic, Claude Mythos 보안 프로그램을 15개국 150곳으로 확대
주요 사건
Anthropic이 Project Glasswing을 확대해 Claude Mythos Preview 접근권을 15개국 이상 약 150개 추가 기관에 제공한다. 초기 파트너들은 이미 고·치명도 취약점 1만 건 이상을 찾았고, 새 대상은 전력·수도·의료·통신·하드웨어 등 핵심 인프라 공급자다.
배경
- 2026-04Project Glasswing 초기 약 50개 파트너에게 Claude Mythos Preview 제공
- 2026-05파트너들이 고·치명도 취약점 1만 건 이상 발견
- 2026-06-02약 150개 기관·15개국 이상으로 확대 발표
주요 입장
전망
- · CyberScoop은 새 파트너가 전력·수도·의료·통신 등 초기 코호트가 덜 포괄한 부문을 포함한다고 보도했다.
- · SecurityWeek는 Okta, Samsung, ENISA, NATO가 새 그룹에 포함됐다고 보도했다.
한국 영향
- Cyber Verification Program 확대
- 한국 기관의 제한 모델 접근 여부
백악관 AI 행정명령, 프런티어 모델 사이버 벤치마크 체계 지시
주요 사건
Anthropic이 미국 백악관의 AI 혁신·보안 행정명령을 지지했다. 행정명령은 60일 내 고급 사이버 역량을 평가하는 기밀 벤치마킹 절차와 'covered frontier model' 지정 기준, 민간 개발사와의 자발적 사전 협력 프레임워크 설계를 지시한다.
배경
- 2023-10-30미국 AI 행정명령이 안전성 보고와 표준 수립을 강조
- 2026-03미국 National Cyber Strategy 발표
- 2026-06-02AI 혁신·보안 행정명령 서명
주요 입장
전망
- · 백악관 Fact Sheet는 AI 혁신과 사이버 보안을 동시에 강화하는 조치라고 설명했다.
- · Anthropic은 행정명령이 미국 AI 리더십 강화의 중요한 단계라고 밝혔다.
한국 영향
- covered frontier model 기준
- 신뢰 파트너 선정 조건
참고 자료
SemiAnalysis, Cerebras WSE 한계 돌파 카드로 웨이퍼 적층 지목
주요 사건
SemiAnalysis가 Cerebras의 웨이퍼 스케일 엔진(WSE)을 분석하며 46,225㎟ 단일 웨이퍼, 90만 코어, 44GB SRAM, 결함 우회 설계가 가능하게 한 구조를 설명했다. 동시에 SRAM 확장이 둔화되면서 DRAM 또는 포토닉 웨이퍼를 하이브리드 본딩하는 웨이퍼-on-웨이퍼가 다음 돌파구라고 지적했다.
배경
- 2019Cerebras WSE-1 공개
- 2024WSE-3가 5nm, 90만 코어, 44GB SRAM으로 발표
- 2026-06-02SemiAnalysis가 웨이퍼 적층을 Cerebras의 다음 확장 경로로 분석
주요 입장
전망
- · SemiAnalysis는 WSE-3의 44GB SRAM과 낮은 I/O 대역폭이 장문·대형 모델 추론에 제약이라고 봤다.
- · Cerebras 자료는 WSE-3가 4조 트랜지스터, 90만 코어, 21PB/s 메모리 대역폭을 제공한다고 설명한다.
한국 영향
- Cerebras DRAM 웨이퍼 본딩 실증
- HBM 대비 WSE 추론 비용
Microsoft, 35B 활성 MoE reasoning 모델 MAI-Thinking-1 공개
주요 사건
Microsoft AI가 자체 학습한 MAI 모델군을 공개했다. 핵심인 MAI-Thinking-1은 35B 활성, 약 1T 전체 파라미터의 sparse MoE reasoning 모델로 256k 컨텍스트를 지원하며 AIME 2025 97.0%, AIME 2026 94.5%를 기록했다고 밝혔다.
배경
- 2024-2025Microsoft가 Copilot과 Azure AI에 외부·내부 모델을 병행 도입
- 2026-06-02MAI-Thinking-1 및 이미지·음성·전사 모델군 발표
주요 입장
전망
- · Microsoft는 MAI-Thinking-1이 SWE-Bench Pro에서 Claude Opus 4.6과 맞먹는다고 주장했다.
- · GeekWire는 이번 발표를 Microsoft의 장기적 자립 시도로 해석했다.
한국 영향
- MAI-Thinking-1 공개 프리뷰
- 실제 SWE-Bench·기업 벤치마크 검증
Microsoft ASSERT, 자연어 정책을 AI 에이전트 회귀 테스트로 변환
주요 사건
Microsoft가 ASSERT(Adaptive Spec-driven Scoring for Evaluation and Regression Testing)를 공개했다. 자연어로 쓴 정책·요구사항을 허용/금지 행동, 시나리오, 테스트케이스로 바꾸고 AI 시스템의 중간 도구 호출까지 추적해 점수화한다.
배경
- 2024에이전트 평가와 추적 도구가 개발 워크플로에 확산
- 2026-04-30ASSERT GitHub 프로젝트 생성
- 2026-06-02Microsoft Build에서 ASSERT와 ACS 공개
주요 입장
전망
- · Microsoft Sarah Bird는 신뢰할 수 있는 시스템에는 애플리케이션별 차원의 평가가 필요하다고 말했다.
- · GitHub 설명은 ASSERT가 100개 이상 모델 엔드포인트와 33개 이상 프레임워크 추적을 지원한다고 밝힌다.
한국 영향
- ASSERT 오픈소스 채택
- ACS 표준의 업계 수용
SemiAnalysis, H100 현물가 지수 급락은 얇은 거래 표본 탓이라고 반박
주요 사건
SemiAnalysis가 Ornn의 H100 가격지수 하락을 두고, 실제 H100 온디맨드 가격은 146일간 시간당 2.70~3.01달러 범위에 머물렀다고 반박했다. Ornn OCPI는 인쇄된 거래만 반영해 수요가 매진된 시장의 얇은 잔여 거래에 흔들린다는 주장이다.
배경
- 2023H100 수요 급증과 시간당 GPU 가격 상승
- 2026-03SemiAnalysis H100 온디맨드 지표 약 2.80달러
- 2026-06-02SemiAnalysis가 Ornn 지수 하락 해석을 반박
주요 입장
전망
- · SemiAnalysis는 H100 온디맨드가 수개월간 매진되어 연속적인 spot tape가 없다고 지적했다.
- · Ornn은 OCPI를 GPU 컴퓨트 가격·헤지·정산의 기준가로 소개한다.
한국 영향
- H100/B200 온디맨드 가용성
- 컴퓨트 파생상품 가격지표 채택
Holo 3.1, AndroidWorld 점수 79.3%로 모바일 에이전트 성능 끌어올려
주요 사건
AK가 공유한 Holo 3.1은 컴퓨터 사용 에이전트 모델로, 35B-A3B 모델이 AndroidWorld에서 67%에서 79.3%로 개선됐다고 발표됐다. 4B·9B 소형 모델도 58%에서 72% 안팎으로 올랐다.
배경
- 2024AndroidWorld 벤치마크 공개
- 2026-06-02Holo 3.1이 AndroidWorld 79.3% 성능 발표
주요 입장
전망
- · H Company는 Holo3.1이 Holotab 제품 harness에서 Holo3 대비 25% 이상 개선됐다고 밝혔다.
- · AndroidWorld 연구진은 116개 과제와 동적 변형이 현실적 평가를 가능하게 한다고 설명한다.
한국 영향
- AndroidWorld 외 실제 업무 앱 성능
- 모바일 에이전트 권한 샌드박스
Cyera, ARR 1.5억달러에 120억달러 가치로 보안 투자 과열 재점화
주요 사건
AI 데이터 보안 스타트업 Cyera가 Evolution Equity Partners 주도로 최소 3억달러를 조달하며 120억달러 가치평가를 추진 중이라고 TechCrunch가 보도했다. ARR은 1.5억달러를 넘었지만 아직 수익성은 멀고, 평가배수는 ARR의 80배다.
배경
- 2026-01Cyera가 90억달러 가치로 4억달러 Series F 조달
- 2026-06-02TechCrunch가 120억달러 가치 3억달러 라운드 추진 보도
주요 입장
전망
- · Axios는 Cyera가 decacorn을 앞둔 데이터 보안업체라고 보도했다.
- · TechCrunch는 80배 ARR이 빠르게 성장하는 AI 스타트업보다도 높은 배수라고 지적했다.
한국 영향
- Cyera 라운드 확정 여부
- DSPM·AI 보안 M&A 동향
참고 자료
Google, RCS 핸드셰이크로 AI 딥페이크 전화 사기 탐지 시작
주요 사건
Google이 Android 12 이상 Phone by Google 사용자에게 AI 음성 딥페이크와 번호 스푸핑을 탐지하는 fake call detection을 글로벌 배포한다. 연락처 양측이 Phone by Google·Contacts·Google Messages를 쓰면 RCS 기반 암호화 확인 신호로 실제 기기 발신인지 검증한다.
배경
- 2024FTC가 사칭 사기 손실 29.5억달러 집계
- 2026-05Google이 verified financial calls 기능 출시
- 2026-06-02Android fake call detection 글로벌 배포 발표
주요 입장
전망
- · Ars Technica는 양측 모두 Google 앱 3종과 RCS를 써야 하는 제약을 지적했다.
- · Google은 Phone by Google이 다수 Android 기기의 기본 전화앱이라고 설명했다.
한국 영향
- 삼성 전화앱 연동 여부
- 국내 RCS 기반 발신 인증 도입
참고 자료
SemiAnalysis, AI 서버 ODM이 제조업체에서 설계 파트너로 이동한다고 진단
주요 사건
SemiAnalysis가 hyperscaler의 GPU·XPU·CPU 다양화로 AI 서버 랙과 보드 설계가 복잡해지면서 ODM이 단순 제조에서 설계·조립·테스트 파트너로 역할을 넓히고 있다고 분석했다. 고객 신뢰와 초기 설계 참여가 장기 수주 핵심이 된다는 평가다.
배경
- 2024-2025AI 서버 랙이 GPU·ASIC·액체냉각 중심으로 고밀도화
- 2026-06-02SemiAnalysis가 ODM 역할 확대를 분석
주요 입장
전망
- · SemiAnalysis는 초기 고객 참여와 신뢰가 장기 사업 확보의 핵심이라고 봤다.
- · 관련 분석은 케이블리스·액체냉각 랙이 ODM 역할을 설계·통합으로 확장한다고 설명한다.
한국 영향
- Quanta·Foxconn·Wistron AI 서버 수주
- NVIDIA·AMD 차세대 랙 인증 ODM