Fable 안전분류기, 연구 생산성의 역풍
COMBINE-lab의 Fable 비판은 과잉 안전분류기가 생물정보학과 수학 작업까지 막을 수 있음을 보여준다. 모델 거버넌스의 과제를 짚는다.
COMBINE-lab의 Fable 비판은 과잉 안전분류기가 생물정보학과 수학 작업까지 막을 수 있음을 보여준다. 모델 거버넌스의 과제를 짚는다.
Cognition SWE-1.7은 Kimi K2.7 기반 RL과 장기 작업 최적화로 프론티어급 코딩 성능을 낮은 비용에 노린다. 에이전트 경제학을 분석한다.
Microsoft Flint는 AI 에이전트가 짧은 명세로 안정적인 차트를 만들게 하는 시각화 중간언어다. 차트 생성의 병목을 본다.
Onboard-CLI는 Tree-sitter AST와 로컬 시각화로 대형 코드베이스 이해와 아키텍처 드리프트 감지를 돕는다. AI 코딩 시대의 문맥 도구다.
OpenAI GPT-Live는 전이중 음성 구조와 GPT-5.5 위임으로 대화 흐름을 바꾼다. 음성 에이전트 경쟁의 의미를 분석한다.
zkSecurity는 AI 감사 파이프라인으로 Cloudflare CIRCL에서 7개 실제 버그를 확인했다고 밝혔다. AI 보안감사의 가능성과 한계를 본다.
EU Chat Control 1.0 부활과 2.0 협상이 동시에 움직인다. 엔드투엔드 암호화, 클라이언트 스캔, AI 서비스 설계가 받는 압력을 짚는다.
Davit은 Apple Container 위에 얹힌 네이티브 macOS UI다. 로컬 AI 개발 환경에서 Docker Desktop 의존을 줄일 수 있는 의미를 분석한다.
Rowboat은 업무 맥락을 로컬 지식그래프로 쌓는 오픈소스 AI coworker다. Claude Desktop류 도구와 다른 로컬 우선 경쟁축을 본다.
30papers.com은 Ilya Sutskever가 권한 30개 AI 논문을 쉬운 설명으로 묶었다. 모델 시대 개발자의 학습 전략을 다시 묻는다.
LTT Labs의 Ryzen AI Halo 리뷰는 3,999달러 로컬 AI 박스의 진짜 가치가 성능보다 검증된 소프트웨어 묶음에 있음을 보여준다. 온디바이스 AI 조달 기준을 정리한다.
Apollo의 Torsten Slok은 비기술 섹터의 AI ROI가 시장 기대보다 늦을 수 있다고 봤다. 기업 AI 예산, 토큰 비용, 밸류에이션 리스크를 한국 관점에서 분석한다.
Z.ai의 GLM-5.2는 1M 컨텍스트와 MIT 라이선스를 앞세워 오픈 모델의 비용 기준을 낮췄다. 폐쇄형 모델, 에이전트 제품, 한국 기업 조달에 미칠 영향을 짚는다.
OfficeCLI는 Word, Excel, PowerPoint를 에이전트가 읽고 수정할 수 있는 명령형 표면으로 바꾼다. 사무 자동화가 챗봇에서 파일 조작 루프로 이동하는 이유를 분석한다.
Ramp Economics Lab은 고강도 AI 도입 기업의 2년 후 총고용과 신입 채용이 더 빠르게 늘었다고 밝혔다. AI와 고용 논쟁에서 봐야 할 조건을 정리한다.
Cerast Intelligence의 도메인 검색 도구는 노출 경로와 설정 오류를 찾는다. AI 에이전트가 파일을 다루는 시대에는 이런 표면 관리가 보안 운영의 기본이 된다.
Delta 1076편의 불꽃 접촉 보도는 항공 안전에서 저고도 도시 위험을 어떻게 감지하고 공유할지 묻는다. AI 감시는 센서와 운영 절차가 함께 가야 한다.
Mr. Baby Paint는 유아용 그림 앱을 만들다 셀룰러 오토마타를 발견한 사례다. AI 도구 설계에서도 작은 제약과 느린 상호작용이 창발성을 만든다.
OpenPrinter는 프린터를 닫힌 소모품 장치가 아니라 수리 가능한 오픈 하드웨어로 다시 정의한다. AI 사무 자동화가 물리 장치까지 확장될 때 중요한 신호다.
다트머스 통계 수업의 Phosphor 파일럿은 AI 학습 도구의 핵심이 챗봇 대화보다 문항, 피드백, 반복 평가에 있음을 보여준다.