LLM에도 잠이 필요하다는 논문의 의미
Language Models Need Sleep 논문은 긴 작업의 병목이 컨텍스트 길이만이 아니라 오래된 정보를 내부 상태로 압축하는 계산 시간임을 보여준다.
Language Models Need Sleep 논문은 긴 작업의 병목이 컨텍스트 길이만이 아니라 오래된 정보를 내부 상태로 압축하는 계산 시간임을 보여준다.
SignalBloom의 로컬 AI 경제성 주장은 프런티어 모델만으로 에이전트 업무를 운영하는 비용 구조가 곧 재검토될 수 있음을 보여준다.
PromptArmor의 Copilot Cowork 파일 유출 실험은 승인 없는 메시지 전송과 위임 권한이 결합할 때 기업 AI 에이전트가 데이터 반출 경로가 될 수 있음을 보여준다.
네덜란드 당국의 800대 서버 압수와 러시아 연계 인프라 수사는 AI 에이전트 기업에도 호스팅, 프록시, 데이터 파이프라인 실사가 보안 경쟁력이 됐음을 보여준다.
노르웨이 국립도서관의 2PB 플래시 기반 LLM 파이프라인은 주권 AI가 모델 경쟁이 아니라 데이터 보존, 정제, 평가, 거버넌스 경쟁임을 보여준다.
시카고 공공변호 경험담은 법률 AI가 서류 자동화보다 먼저 신뢰, 시간, 불균형한 절차를 이해해야 함을 보여준다.
YC W25 Weave의 ML·AI·제품 채용은 AI가 개발자를 대체하는 논쟁보다 팀 안에서 사람과 에이전트의 기여를 측정하는 시장이 커지고 있음을 시사한다.
arXiv 논문 Constraint Decay는 백엔드 코드 생성에서 기능 테스트를 통과해도 구조 제약을 잃는 코딩 에이전트의 취약성을 정량화했다.
DeepSeek가 V4 Pro 75% 할인을 상시 가격으로 전환한다. 초저가 추론 단가가 코딩 에이전트와 API 시장의 가격 기준을 다시 낮추고 있다.
YC 스타트업 Flick은 AI 영화 제작을 위한 Figma와 Cursor를 표방한다. 채용공고 속 요구사항은 생성형 영상 도구의 다음 인터페이스를 보여준다.
Epoch AI는 HBM이 AI 칩 부품 지출의 63%까지 커졌다고 분석했다. 모델 경쟁의 병목이 GPU 코어에서 메모리 공급망으로 이동하고 있다.
DeepSeek 전용 코딩 에이전트 Reasonix는 프롬프트 캐시 안정성을 제품 구조로 삼아 장시간 실행형 개발 에이전트의 비용 공식을 바꾸고 있다.
오렌지카운티 화학물질 누출은 산업 현장 자동화와 재난 관제 AI의 한계를 드러냈다. 예측보다 중요한 것은 검증 가능한 운영 체계다.
이탈리아의 Airbus A330 급유기 전환은 단순 장비 교체가 아니라 NATO형 데이터·정비·운용 표준으로 이동하는 국방 AI 스택의 사례다.
Polsia를 둘러싼 공개 API 검증 글은 AI 스타트업의 ARR, 활성 사용자, 자율성 주장을 어떻게 확인해야 하는지 보여준다.
새 arXiv 논문은 도메인 어휘를 흉내 낸 인젝션이 탐지율을 크게 떨어뜨린다고 보고했다. 에이전트 보안은 키워드 차단을 넘어 문맥 검증이 필요하다.
KanBots는 칸반 카드마다 Claude Code·Codex를 별도 worktree에서 실행한다. 코딩 에이전트 경쟁이 채팅창에서 작업 운영판으로 이동하는 신호다.
Models.dev는 AI 모델의 가격·기능·스펙을 공개 데이터베이스로 모은다. 에이전트 스택의 모델 라우팅은 감이 아니라 갱신 가능한 데이터가 필요해졌다.
Superset은 여러 CLI 코딩 에이전트를 worktree에서 병렬 실행하는 코드 에디터다. 에이전트 IDE 경쟁은 채팅 보조에서 로컬 오케스트레이션으로 옮겨간다.
Google Antigravity 업데이트 경험담은 IDE가 챗봇형 도구로 바뀌며 워크플로를 깨뜨릴 수 있음을 보여준다. AI 개발도구의 자동 업데이트 신뢰가 쟁점이 됐다.