GPT-5.6 전환, 모델보다 평가 하네스가 먼저다
Ploy는 생산 에이전트를 GPT-5.6 Sol로 옮기며 속도와 비용 개선을 봤지만, 진짜 교훈은 평가·도구·캐시가 모델별로 다르다는 점이다.
Ploy는 생산 에이전트를 GPT-5.6 Sol로 옮기며 속도와 비용 개선을 봤지만, 진짜 교훈은 평가·도구·캐시가 모델별로 다르다는 점이다.
OpenAI가 가족, 보호자, 고령층 경험을 맡을 제품 매니저를 채용한다. ChatGPT가 개인 도구에서 가정의 관계형 인프라로 이동하고 있다.
애플이 OpenAI를 영업비밀 침해로 제소했다. 파트너십에서 하드웨어 경쟁으로 바뀐 AI 시장에서 인재 이동과 공급망 지식의 경계가 핵심 쟁점이다.
OpenAI CDN에 올라온 Cycle Double Cover Conjecture 증명 PDF가 GPT-5.6 Sol Ultra의 결과로 표시됐다. 핵심은 발견보다 검증 체계다.
OpenAI가 ChatGPT Work를 공개하며 Chat, Work, Codex를 한 데스크톱 경험으로 묶었다. AI 경쟁은 챗봇에서 업무 운영체제로 이동한다.
OpenAI가 GPT-5.6 Sol, Terra, Luna를 공개했다. 성능보다 중요한 변화는 병렬 에이전트, 캐시, 토큰 단가가 결합된 운영 경제학이다.
OpenAI GPT-Live는 전이중 음성 구조와 GPT-5.5 위임으로 대화 흐름을 바꾼다. 음성 에이전트 경쟁의 의미를 분석한다.
Codex 이슈에서 GPT-5.5 추론 토큰이 516 근처에 몰린다는 관측이 나왔다. 에이전트 품질 논쟁은 모델 성능보다 계량 투명성으로 이동하고 있다.
OpenAI Codex 이슈 #2847은 .env와 키 파일을 에이전트가 읽지 못하게 하는 결정적 제외 규칙의 필요성을 보여준다.
Proxy-KD 논문은 폐쇄형 LLM 출력만으로 작은 모델을 개선하는 경로를 제시한다. 모델 비용, 약관, 주권 AI 경쟁의 의미를 분석한다.
미국 정부가 GPT-5.6 접근 심사에 관여한다는 보도는 프런티어 AI가 제품이자 규제 대상이 됐음을 보여준다. 기업 조달 리스크를 분석한다.
OpenAI가 GPT-5.6 Sol, Terra, Luna 제한 프리뷰를 공개했다. 가격, 캐시, 울트라 모드가 에이전트 제품 설계에 주는 의미를 분석한다.
OpenAI의 Codex 경제 연구는 에이전트가 짧은 답변 도구에서 장시간 위임 노동으로 이동하고 있음을 보여준다. 한국 기업의 업무 재설계 포인트를 짚는다.
Axios와 The Verge는 미국 정부가 OpenAI에 GPT-5.6 공개 제한을 요청했다고 보도했다. 프런티어 모델 출시가 제품 일정이 아니라 안보 거버넌스 문제가 되는 흐름을 분석한다.
OpenAI, Anthropic, Amazon, Microsoft 등이 참여한 RAISE US는 AI 일자리 충격을 민간과 주정부 협력으로 다루려 한다. 한국 정책과 기업 교육에 주는 신호를 분석한다.
OpenAI와 Broadcom의 Jalapeño 칩은 모델 경쟁이 추론 비용, 전력, 네트워크까지 내려왔다는 신호다. 한국 기업은 GPU 구매를 넘어 API 단가, 데이터센터 전력, 공급사 종속을 함께 보는 인프라 전략을 다시 짜야 한다.
OpenAI가 Appia Foundation 참여를 발표했다. 고급 AI 표준 경쟁은 선언보다 평가 증거, 공급망, 국가 간 상호인정으로 이동하고 있다.
OpenAI가 Daybreak와 Codex Security를 확장했다. 취약점 발견이 빨라진 시대의 병목은 탐지가 아니라 검증, 패치, 배포다.
OpenAI와 Trail of Bits의 Patch the Planet은 AI 보안 연구를 maintainer 부담 완화로 연결하려는 실험이다. 발견보다 조율이 관건이다.
OpenAI가 삼성전자 전사급 ChatGPT·Codex 배포를 발표했다. 한국의 기업 AI는 파일럿을 넘어 보안, 교육, 업무 재설계 단계로 들어섰다.