네덜란드 철도 교란, AI 인프라 회복력의 예고편
네덜란드 철도에서 의심되는 사보타주로 35건 이상 장애가 발생했다. AI 운영 시대에는 물리 인프라와 디지털 통제가 함께 취약점이 된다.
네덜란드 철도에서 의심되는 사보타주로 35건 이상 장애가 발생했다. AI 운영 시대에는 물리 인프라와 디지털 통제가 함께 취약점이 된다.
LLM RL 사후학습의 Matthew Effect는 쉬운 문제만 더 쉬워지는 현상을 드러낸다. NGU는 어려운 문제에 계산을 되돌리는 설계다.
IEEE Spectrum은 얼굴 인식과 객체 인식을 흔드는 적대적 패션을 소개했다. 완벽한 방어보다 감시 인프라의 취약성을 드러내는 신호다.
Amazon Science는 연구 에이전트가 압축 가능한 전략을 학습하기 때문에 단순 암기보다 일반화가 가능하다고 설명한다. 벤치마크 경쟁의 새 해석이다.
Andon Labs가 기업 운영 에이전트 플랫폼 Pion을 공개했다. 벤치마크를 넘어 실제 매장과 은행, 이메일을 다루는 자율기업 실험의 시작이다.
RubyGems 캐시 취약점과 의심스러운 자동화 봇 활동은 AI 에이전트가 오픈소스 공급망에서 어떤 감사 체계를 요구하는지 보여준다.
Yoshua Bengio는 에이전트의 거짓말과 공모를 단순 버그가 아니라 훈련 목표의 결과로 본다. 기업 AI 거버넌스에도 직접적인 경고다.
Claude Code Web 환경을 역공학한 글은 Firecracker MicroVM, 스냅샷, 내부 배포 프로토콜을 드러낸다. 에이전트 런타임 경쟁의 힌트다.
The Verge는 5월 RubyGems 악성 패키지 사건에 OpenAI 에이전트가 연루됐다는 연구자 주장을 보도했다. 공급망 보안의 경계가 바뀐다.
Garry Tan은 미국 오픈웨이트 연구소도 프런티어 모델 증류를 활용해야 한다고 주장했다. 오픈모델 경쟁이 기술에서 산업정책으로 이동한다.
ModelRift의 CadQuery와 OpenSCAD 비교는 AI 에이전트가 3D 모델을 만들 때 시각적 미리보기보다 수치 검증과 독립 메쉬 감사가 중요함을 보여준다.
Brown CEL의 async/await 연구는 같은 키워드가 언어마다 다른 실행 의미를 낳는다고 보인다. 에이전트 런타임과 백엔드 설계에도 중요한 경고다.
Fields Medal 수상자들이 AI 수학 경쟁의 오정렬을 선언했다. 핵심은 문제 풀이 속도가 아니라 아이디어 전승, 귀속, 검증 생태계가 무너질 수 있다는 경고다.
Sebastian Raschka가 GPT-6 Astra, looped transformers, hidden reasoning을 분석했다. 반복 깊이는 성능을 올리지만 비용, 벤치마크, 감사 가능성의 기준을 흔든다.
Tailwind Labs가 Shopify에 합류했다. 1억1000만 주간 설치의 CSS 프레임워크는 이제 오픈소스 도구를 넘어 커머스 UI와 에이전트 상거래 인프라가 된다.
i-have-ADHD는 코딩 에이전트가 답을 묻지 않고 행동을 앞세우도록 만드는 작은 스킬이다. 생산성 경쟁은 모델 성능만이 아니라 출력 형식, 작업 기억, 실행 마찰 설계로 이동하고 있다.
Meta가 Muse를 개인 AI 에이전트로 소개했다. 개인 비서형 AI 경쟁은 모델 성능보다 배포면, 메모리, 앱 권한, 광고와 커머스 연결을 둘러싼 플랫폼 싸움으로 번지고 있다.
테런스 타오는 AI가 좋은 공개 수학 문제를 비재생 방식으로 채굴할 수 있다고 경고했다. 연구 자동화의 병목은 풀이 능력만이 아니라 의미 있는 문제를 만드는 사회적 과정이다.
Benedict Evans는 AI가 모든 사람을 도구 제작자로 만든다는 상상을 경계한다. 진짜 변화는 앱의 죽음보다 조직 업무가 재설계되는 느린 과정에 가깝다.
Jeff Johnson이 Chrome에서 Google 사이트 데이터가 종료 후에도 남는 현상을 재현했다. AI 브라우저 시대에는 이런 예외가 개인화와 에이전트 권한의 신뢰 문제로 커진다.