AI 산업 브리핑 (오후)
작성 시각: 2026-08-02 20:21 KST / 조사 기간: 07:10~20:21 KST / 신규 핵심 이슈: 5건
핵심 요약
주요 업데이트
1) GPT-5.6 Sol raw reasoning 노출 — OpenAI / 보안·제품 / ★★★☆
일반 ChatGPT에서 `provider_error` 직전 scratchpad가 보였다는 보고다. MCP 개발자도 유사 현상을 재현했지만 범위·원인은 미확인이다. MCP 오류 처리와 사고과정 보호 점검이 필요하다. 확인: 다수 사용자, 공식 미확인
2) Opus 5, legacy 지시와 충돌 — Anthropic / 제품·운영 / ★★★★
공식 문서상 자체 검증·delegation 성향 때문에 기존 final-check·double-check·subagent 지시가 토큰을 낭비할 수 있다. Claude 5용 시스템 프롬프트도 80% 이상 축소됐다. 모델별 `CLAUDE.md` 분리가 비용 효율의 관건이다. 확인: 공식+다수 사용자
3) 동남아에서 Gemini Spark Beta 회수 — Google / 롤아웃 / ★★☆☆
말레이시아·동남아 Pro 사용자들이 하루 뒤 옵션이 사라졌다고 보고했다. 가족 계정에는 남은 사례가 있어 계정 단위 시험 가능성이 있으나 Google 설명은 없다. 확인: 다수 사용자, 제한적 표본
4) Gemini hidden reasoning 잔존 주장 — Google / 보안·제품 / ★★☆☆
개발자가 웹 응답의 `thoughts`를 표시하는 확장 `gemini-unlocked`를 공개했다. 독립 재현·Google 확인은 없다. 확인: 미확인 주장
5) Gemma 4 26B-A4B 약 2 GB 구동 주장 — Google·Gemma / 인프라 / ★★★☆
Mference는 24 GB M5 Pro에서 31–35 tok/s를 주장했다. SSD로 선택 expert를 읽으며 decode의 약 53%가 I/O, context는 4K다. 독립 재현 전까지 방향성만 참고해야 한다. 확인: 단일 커뮤니티 벤치마크
회사별 한 줄 평가
핵심 수치 변화
80%+ 시스템 프롬프트 축소 / 약 2 GB·31–35 tok/s Gemma 4 측정 / 53% I/O·4K Mference 병목
주목할 미확인 정보
GPT-5.6 Sol scratchpad 노출 범위 / Gemini hidden reasoning 서버 잔존 여부
> ⚠️ 중앙 translation·analysis 역할이 모두 timeout으로 결과를 반환하지 못해, 해석은 원문·공식 문서 범위의 보수적 사실 정리에 한정했다.
출처: r/OpenAI·r/ChatGPT·r/ClaudeAI·r/GeminiAI·r/LocalLLaMA. 투자 권유 아님. 요약 중앙 라우터의 translation 역할 · 핵심 분석 중앙 라우터 analysis 역할.