Claude 암호분석, AI 연구 자동화의 위험한 성과
Anthropic은 Claude Mythos Preview로 HAWK와 축소 AES 공격을 개선했다고 밝혔다. 생산 시스템 영향은 없지만 AI 연구 자동화의 검증과 공개 기준이 새 쟁점이 됐다.
Anthropic은 Claude Mythos Preview로 HAWK와 축소 AES 공격을 개선했다고 밝혔다. 생산 시스템 영향은 없지만 AI 연구 자동화의 검증과 공개 기준이 새 쟁점이 됐다.
Google은 Michigan 낙농가가 Gemini 3.6 Flash와 Antigravity로 다중 에이전트 운영 대시보드를 만든 사례를 공개했다. AI 에이전트의 진짜 시장은 거대기업 밖에도 있다.
Google은 Gemini API Managed Agents의 기본 모델을 3.6 Flash로 바꾸고 환경 훅, 예산 제어, 예약 트리거를 추가했다. 에이전트 경쟁은 런타임 통제 경쟁으로 이동한다.
OpenAI가 Codex Security CLI와 TypeScript SDK를 공개했다. 보안 리뷰는 모델 성능보다 권한, 산출물 관리, CI 정책, 사람 검증의 운영 설계가 승부처다.
OpenAI의 현장 보고서는 코딩 에이전트가 생명과학 소프트웨어 유지보수와 성능 개선에 유용하지만, 과학 코드에서는 검증과 유지관리 책임이 더 중요하다고 말한다.
My Eicher 취약점 공개는 차량 관제 API가 얼마나 큰 물리적 위험으로 이어질 수 있는지 보여준다. 에이전트가 운영 시스템과 연결될수록 인증, 권한, 감사가 핵심이다.
FeyNoBg와 NoBg 공개는 이미지 배경 제거가 단일 모델 성능 경쟁에서 데이터 믹스와 학습 도구 경쟁으로 이동하고 있음을 보여준다.
Microsoft의 MAI-Cyber-1-Flash와 MDASH 조합은 사이버 보안 AI 경쟁이 성능표에서 비용, 데이터, 에이전트 하네스 경쟁으로 이동하고 있음을 보여준다.
python-build-standalone은 파이썬을 앱 내부 런타임으로 넣는 흐름을 가속한다. uv, CLI, 에이전트 워커 배포에서 재현성과 공급망 통제가 중요해진다.
루트리스 컨테이너는 AI 서비스를 더 안전하게 운영하기 위한 현실적 기본선이다. 모델 서버, 에이전트 샌드박스, 사내 배포 환경에서 권한 경계를 다시 설계해야 한다.