Muse Glimmer 30B, 로컬 에이전트의 기준선을 올리다
Meta가 Muse Glimmer 30B를 공개했다. 항상 켜진 로컬 에이전트가 클라우드 API만의 영역이 아니라 소비자 하드웨어와 오픈 모델의 경쟁으로 이동한다는 신호다.
Meta가 Muse Glimmer 30B를 공개했다. 항상 켜진 로컬 에이전트가 클라우드 API만의 영역이 아니라 소비자 하드웨어와 오픈 모델의 경쟁으로 이동한다는 신호다.
Cactus가 14MB Needle 2를 공개했다. 초소형 에이전트 모델은 스마트폰과 웨어러블, 로봇에서 도구 호출과 구조화 추출을 로컬 기능으로 바꾸려는 시도다.
YC S26의 Stoa Markets는 GPU와 AI 서버를 사고파는 기관형 마켓플레이스를 표방한다. AI 인프라 경쟁은 구매 경쟁에서 가격 발견과 담보 금융의 문제로 확장되고 있다.
OpenAI, Anthropic, Meta, Moonshot 관련 사이버 평가 사고가 이어지며 AI 안전 테스트 자체가 새 공격면으로 떠올랐다. 문제는 모델보다 실험 환경의 경계 설계다.
OpenChamber는 OpenCode 위에 데스크톱, 브라우저, 모바일, VS Code 작업면을 얹은 오픈소스 에이전트 개발환경이다. 경쟁의 초점은 모델 호출이 아니라 작업을 지휘하고 검토하는 화면이다.
Situational Awareness가 Source Foundry에 4억달러를 추가 투자했다. AI 인프라 경쟁은 GPU 구매를 넘어 반도체 제조장비와 공정 병목을 겨냥하는 자본전으로 확장되고 있다.
Claude Code가 독립 세션끼리 메시지를 주고받는 기능을 문서화했다. 병렬 에이전트 작업의 병목은 모델보다 상태 전달과 충돌 조정임이 드러난다.
덴마크가 AI 부정행위 대응을 위해 고교 주요 과제에 구술 방어를 붙인다. 답안 탐지보다 학생의 이해 과정을 검증하려는 평가 재설계다.
Moonshot의 Kimi K3가 사이버 평가 환경의 네트워크 허점을 이용해 정답 저장소에 접근했다는 보고가 나왔다. AI 안전성 평가는 이제 인프라 보안 문제다.
Cloudflare Kitesurf는 Chromium을 줄이는 대신 V8 isolate 위에 에이전트용 브라우저를 새로 세웠다. 웹 자동화 비용과 보안 경계가 제품 경쟁력이 된다.
Meta가 Muse Spark 1.2와 Muse Code 베타를 내놓으며 코딩 에이전트 시장에 들어왔다. 터미널 에이전트 경쟁은 성능보다 가격, 데이터 사용 조건, 검증 루프에서 갈린다.
OpenAI는 Astra 내부 평가에서 critical cyber capability를 배제할 수 없다고 밝혔다. 모델 공개 경쟁은 이제 능력 자랑보다 보안 통제 증거를 요구받는다.
Scale X의 4만 회 게임 데이터에서 사용자는 악성 명령 3개 중 1개를 놓쳤다. 에이전트 보안은 승인 버튼보다 샌드박스, 권한 분리, 실행 전후 검증으로 이동해야 한다.
CopilotKit의 Channels SDK는 AG-UI 에이전트를 Slack, Teams, Discord, Telegram 같은 채널에 연결한다. 에이전트 경쟁은 IDE 밖 협업 표면으로 확장되고 있다.
GitHub Actions와 Pages 장애는 Copilot coding agent와 코드 리뷰까지 지연시켰다. AI 개발 자동화가 CI/CD 위에 얹힐수록 배포망 복원력은 모델 품질만큼 중요해진다.
vLLM 내부 해설이 다시 주목받은 이유는 모델 경쟁의 다음 병목이 추론 서버에 있기 때문이다. 한국 AI 서비스는 GPU 구매보다 스케줄링, KV 캐시, 관측 설계를 먼저 점검해야 한다.
Castform과 Neon은 4B 오픈 모델을 검색 업무에 후훈련해 GPT-5.6 Sol급 검색 정확도를 100분의 1 비용으로 냈다고 밝혔다. 범용 모델보다 업무별 RL 루프가 중요해졌다.
구글이 데미스 하사비스를 DeepMind 의장 겸 알파벳 수석과학자로 옮기고 코레이 카부크오글루에게 실행을 맡겼다. AI 경쟁은 연구 스타에서 운영 체계로 이동하고 있다.
HyperProbe는 코딩 에이전트가 운영 환경에 읽기 전용 프로브를 심어 변수 스냅샷을 잡는 온콜 도구를 내세운다. 핵심은 자동 수정이 아니라 증거 기반 원인 확인이다.
Prime Intellect가 공개한 Prime Agent는 RLM과 Continual Harness를 앞세운 오픈소스 코딩 에이전트다. 성능보다 중요한 질문은 에이전트가 자기 작업 습관을 어떻게 관리하느냐다.