GLM-5.2·DSpark·HBM이 AI 경쟁축을 모델 성능에서 인프라 통제로 옮긴다
- 중국 Z.ai GLM-5.2가 사이버 벤치마크에서 Claude Code를 앞서며 오픈웨이트 통제 논쟁을 키웠다.
- DeepSeek DSpark와 Baidu Unlimited-OCR은 추론·문서 처리 비용을 낮추는 오픈 기술 흐름을 보여준다.
- LineShine·Micron·NVIDIA LeptonAI 논란은 AI 병목이 칩·메모리·클라우드 플랫폼으로 이동했음을 확인한다.
Z.ai GLM-5.2, 사이버 벤치마크서 Claude Code 추월
주요 사건
중국 Zhipu AI의 오픈웨이트 GLM-5.2가 일부 취약점 탐지·보안 조사 벤치마크에서 Anthropic Mythos 계열과 맞먹는 성능을 냈다는 보도가 나왔다. Semgrep IDOR 탐지에서는 GLM-5.2가 39% F1로 Claude Code 32%를 앞섰고, Graphistry Botsbench는 28/59 solve rate를 보고했다.
배경
- 2026-06-13Z.ai GLM-5.2 출시
- 2026-06-22Semgrep, GLM-5.2가 IDOR 탐지 39% F1을 기록했다고 공개
- 2026-06-28The Verge, Mythos급 사이버 성능 논란 보도
주요 입장
전망
- · The Verge: China’s Z.ai claims it can match Mythos on cybersecurity
- · Semgrep: GLM 5.2 beats Claude in cyber benchmarks
한국 영향
- GLM-5.2 실제 다운로드·사용 조건
- 국내 망분리 환경에서의 보안 에이전트 도입
- 미국의 오픈웨이트 모델 통제 논의
참고 자료
DeepSeek DSpark, 추론 처리량 60~85% 끌어올린다
주요 사건
DeepSeek이 Qwen3·Gemma-4 계열까지 겨냥한 DSpark·DFlash·Eagle draft 모델 준비 소식이 확산됐다. DSpark는 기존 모델에 draft 모듈을 붙이는 speculative decoding 방식으로, DeepSeek-V4에서 사용자별 생성 속도를 60~85% 높였다는 분석이 나왔다.
배경
- 2023-01-01speculative decoding이 대형언어모델 서빙 최적화로 부상
- 2026-06-27DSpark 공개 분석, 60~85% 속도 향상 보고
- 2026-06-28AK가 DeepSeek draft 모델 확산 소식 공유
주요 입장
전망
- · MarkTechPost: DeepSeek releases DSpark
- · Red Hat: DFlash support and online training
한국 영향
- DSpark 실제 vLLM 통합
- Qwen3·Gemma4 acceptance length
- API 가격 인하 여부
참고 자료
Baidu Unlimited-OCR, 3B 모델로 문서 OCR SOTA 경신
주요 사건
Baidu의 Unlimited-OCR이 Hugging Face 인기 모델 1위에 올랐다. 3B MoE 구조에서 5억 파라미터만 활성화하고 Reference Sliding Window Attention으로 KV 캐시를 평탄하게 유지해 긴 문서를 한 번에 파싱한다.
배경
- 2026-06-22Baidu, Unlimited-OCR 공개
- 2026-06-23arXiv 논문 공개
- 2026-06-28vLLM 지원 및 Hugging Face 인기 1위 확산
주요 입장
전망
- · Hugging Face: baidu/Unlimited-OCR
- · Unlimited OCR Works
한국 영향
- 한글 문서 성능
- vLLM 배포 안정성
- 표·수식 정확도
참고 자료
SemiAnalysis, 엔비디아 LeptonAI 통합 실패설 제기
주요 사건
SemiAnalysis가 엔비디아가 약 7억 달러에 인수한 것으로 알려진 LeptonAI의 창업자/CEO가 1년 만에 떠났고 DGX Lepton이 기대만큼 성공하지 못했다고 주장했다. 이는 GPU 공급자 엔비디아가 클라우드·플랫폼 계층까지 장악하려는 전략의 마찰을 보여준다.
배경
- 2025-03-27엔비디아의 LeptonAI 인수 협상 보도
- 2025-06-13DGX Cloud Lepton 소개
- 2026-06-28SemiAnalysis, 창업자 이탈과 제품 부진 주장
주요 입장
전망
- · SemiAnalysis thread on LeptonAI
- · SiliconANGLE: Nvidia close to acquiring Lepton AI
한국 영향
- DGX Cloud Lepton 실제 고객 수
- NVIDIA의 네오클라우드 공급 정책
- 반독점 조사 가능성
참고 자료
중국 LineShine, 2.198엑사플롭스로 TOP500 1위 탈환
주요 사건
중국 선전의 LineShine이 TOP500에서 2.198 Exaflop/s HPL 성능으로 미국 El Capitan을 제치고 세계 1위에 올랐다. 1,379만 코어 CPU-only 구조, 42.2MW 전력, 52.07 GFLOPS/W 효율이 보고됐다.
배경
- 2017-06-01중국 Sunway TaihuLight 이후 TOP500 1위 공백
- 2026-06-23TOP500 67차 리스트에서 LineShine 1위 발표
- 2026-06-28The Verge, 중국 세계 최고속 슈퍼컴퓨터 보도
주요 입장
전망
- · TOP500: LineShine debuts at No. 1
- · TOP500 June 2026 list
한국 영향
- LineShine HPL-MxP 7.92 Exaflop/s
- 중국 자체 CPU 공급망
- 한국 국가초고성능컴퓨팅 6호기 전략
참고 자료
Ford, AI 품질관리 실패 뒤 베테랑 엔지니어 350명 재고용
주요 사건
Ford가 자동화·AI 품질 시스템만으로 차량 품질을 충분히 끌어올리지 못하자 350명의 베테랑 엔지니어를 재고용했다. 회사는 이들이 젊은 직원 교육과 AI 도구 재프로그래밍을 맡고, 올해 10억 달러 비용 절감에 기여할 것으로 본다.
배경
- 2023-01-01Ford, 품질비용과 자동화 검사 강화
- 2026-06-25Bloomberg, Ford의 베테랑 엔지니어 재고용 보도
- 2026-06-28TechCrunch, AI 실패 이후 조치 보도
주요 입장
전망
- · TechCrunch: Ford rehires gray beard engineers
- · Bloomberg: Ford AI hiccups
한국 영향
- AI 품질검사 실패 사례
- 자동차 소프트웨어 검증 자동화
- JD Power 품질 지표 변화
참고 자료
Micron, AI 메모리 병목 타고 ‘다음 엔비디아’ 후보로 부상
주요 사건
TechCrunch는 월가가 Micron을 차세대 AI 수혜주로 보는 배경을 조명했다. HBM4는 NVIDIA Vera Rubin 플랫폼용으로 2026년 공급이 사실상 배정됐고, HBM 시장은 2027년 1,000억 달러 돌파 전망까지 나왔다.
배경
- 2024-01-01HBM3E 경쟁 본격화
- 2026-03-01Micron HBM4, Vera Rubin 플랫폼용 출하 시작 보도
- 2026-06-28TechCrunch, Micron을 다음 AI 인프라 핵심주로 분석
주요 입장
전망
- · TechCrunch: Why Wall Street thinks Micron is the next Nvidia
- · Futurum: Micron Q3 FY2026 HBM growth
한국 영향
- HBM4 수율과 고객 인증
- 2027년 HBM TAM 1,000억 달러 전망
- DRAM 가격 전이
참고 자료
Suno, 독립 음악가 인큐베이터로 AI 음악 반발 돌파 시도
주요 사건
AI 음악 생성 서비스 Suno가 독립 아티스트 대상 Spark 인큐베이터를 시작했다. 보조금·멘토링·마케팅 지원을 내세웠지만, 참여자의 작품 리믹스 허용과 비비판 조항 등 약관 논란도 함께 제기됐다.
배경
- 2025-06-01독립 아티스트 집단소송 제기
- 2026-06-25Suno Spark 공개
- 2026-06-28The Verge, Spark 약관 논란 보도
주요 입장
전망
- · The Verge: Suno launches Spark
- · Suno: Introducing Spark
한국 영향
- Suno Spark 참여 조건
- UMG·Sony 소송 진행
- AI 음원 표시 의무
참고 자료
AI Engineer World’s Fair, 7천명 매진으로 실전 AI 열기 입증
주요 사건
swyx가 AI Engineer World’s Fair 2026 매진을 알렸다. 행사 측은 6천명 이상, swyx는 7천명 수준 매진을 언급했으며 NVIDIA·로컬 AI·오픈 에이전트 세션이 핵심 트랙으로 부각됐다.
배경
- 2023-01-01AI Engineer 커뮤니티 성장
- 2026-06-28swyx, 2026 World's Fair 매진 공지
- 2026-06-30Moscone Center에서 AI Engineer World’s Fair 개막 예정
주요 입장
전망
- · swyx: AI Engineer World’s Fair sold out
- · AI Engineer World’s Fair 2026
한국 영향
- NVIDIA 로컬 AI 발표
- 오픈 에이전트 프레임워크
- 컨퍼런스 후 공개 세션 자료
참고 자료
인도 UPI, 다음 결제 성장 동력으로 AI 에이전트 지목
주요 사건
인도 결제 인프라 UPI의 핵심 인사가 다음 디지털 결제 성장 국면에서 AI가 크게 관여할 것이라고 말했다. 이는 대화형·에이전트형 결제가 슈퍼앱과 핀테크 경쟁의 새 접점이 될 수 있음을 시사한다.
배경
- 2016-04-01UPI 출범
- 2026-06-28TechCrunch, 인도 결제 AI 전망 보도
주요 입장
전망
- · TechCrunch: Indian payments chief on AI
- · NPCI: UPI product overview
한국 영향
- UPI AI 결제 API
- 사기탐지 모델 성능
- 에이전트 결제 규제
V-Zero, 정답 라벨 없이 시각추론 학습 속도 5~10배 개선
주요 사건
V-Zero 논문이 answer-label-free visual reasoning 접근을 제시했다. 학생 모델의 추론 궤적을 교사가 긍정·부정 시각 증거 뷰로 재검증해 distillation을 gate하며, SFT보다 5배 이상, RL 기준선보다 10배 이상 빠르다고 보고했다.
배경
- 2023-01-01멀티모달 LLM 학습 확대
- 2026-06-24V-Zero arXiv 공개
- 2026-06-28AK, V-Zero 요약 확산
주요 입장
전망
- · V-Zero: Answer-Label-Free Visual Reasoning
- · V-Zero GitHub repository
한국 영향
- 코드·데이터 공개 완성도
- Qwen-VL 계열 재현성
- 한국어 멀티모달 적용