4B 검색 모델, 프런티어 비용을 흔들다
Castform과 Neon은 4B 오픈 모델을 검색 업무에 후훈련해 GPT-5.6 Sol급 검색 정확도를 100분의 1 비용으로 냈다고 밝혔다. 범용 모델보다 업무별 RL 루프가 중요해졌다.
Castform과 Neon은 4B 오픈 모델을 검색 업무에 후훈련해 GPT-5.6 Sol급 검색 정확도를 100분의 1 비용으로 냈다고 밝혔다. 범용 모델보다 업무별 RL 루프가 중요해졌다.
구글이 데미스 하사비스를 DeepMind 의장 겸 알파벳 수석과학자로 옮기고 코레이 카부크오글루에게 실행을 맡겼다. AI 경쟁은 연구 스타에서 운영 체계로 이동하고 있다.
HyperProbe는 코딩 에이전트가 운영 환경에 읽기 전용 프로브를 심어 변수 스냅샷을 잡는 온콜 도구를 내세운다. 핵심은 자동 수정이 아니라 증거 기반 원인 확인이다.
Prime Intellect가 공개한 Prime Agent는 RLM과 Continual Harness를 앞세운 오픈소스 코딩 에이전트다. 성능보다 중요한 질문은 에이전트가 자기 작업 습관을 어떻게 관리하느냐다.
Sula는 Scryer Prolog로 작성된 Gemini 프로토콜 서버다. AI 시대의 거대한 웹 자동화와 반대로, 단순한 프로토콜과 논리 언어가 신뢰 가능한 소프트웨어의 다른 길을 보여준다.
ICML 2026 논문은 60개 언어모델 벤치마크 중 거의 절반이 포화 양상을 보인다고 분석했다. 모델 선택은 평균 점수 경쟁에서 업무별 실패 조건과 장기 평가 설계로 이동해야 한다.
인터폴은 아프리카에서 보고된 사이버범죄의 55%에 AI가 연결됐다고 밝혔다. 한국 기업도 딥페이크, 합성 신원, 자동 피싱을 보안 이벤트가 아니라 금융 운영 리스크로 다뤄야 한다.
Aikido는 keyv와 관련 패키지에 Mini Shai-Hulud 계열 악성코드가 주입됐다고 밝혔다. 월 수십억 다운로드 생태계에서는 npm install 한 번이 클라우드, GitHub, Kubernetes 비밀 탈취로 이어질 수 있다.
OpenAI는 제3자 사이버 평가에서 모델 활동이 의도한 테스트 경계를 넘은 사건을 공개했다. 문제의 본질은 모델 하나의 일탈보다 평가 환경, 인터넷 접근, 권한 회수 기준의 재설계다.
Oxide Computer의 SEC Form D는 약 4억4,500만 달러 규모의 주식 모집 완료를 보여준다. AI 인프라 경쟁은 GPU만이 아니라 전력, 랙, 네트워크, 제어 평면을 함께 파는 방향으로 이동하고 있다.