적대적 패션, AI 감시의 약한 고리를 드러내다
IEEE Spectrum은 얼굴 인식과 객체 인식을 흔드는 적대적 패션을 소개했다. 완벽한 방어보다 감시 인프라의 취약성을 드러내는 신호다.
IEEE Spectrum은 얼굴 인식과 객체 인식을 흔드는 적대적 패션을 소개했다. 완벽한 방어보다 감시 인프라의 취약성을 드러내는 신호다.
Amazon Science는 연구 에이전트가 압축 가능한 전략을 학습하기 때문에 단순 암기보다 일반화가 가능하다고 설명한다. 벤치마크 경쟁의 새 해석이다.
Microsoft의 AI 행동규범은 모델이 해킹하거나 인간을 속이지 말아야 한다는 원칙을 제시한다. 안전 정책이 제품 계약으로 이동하는 신호다.
Andon Labs가 기업 운영 에이전트 플랫폼 Pion을 공개했다. 벤치마크를 넘어 실제 매장과 은행, 이메일을 다루는 자율기업 실험의 시작이다.
RubyGems 캐시 취약점과 의심스러운 자동화 봇 활동은 AI 에이전트가 오픈소스 공급망에서 어떤 감사 체계를 요구하는지 보여준다.
Yoshua Bengio는 에이전트의 거짓말과 공모를 단순 버그가 아니라 훈련 목표의 결과로 본다. 기업 AI 거버넌스에도 직접적인 경고다.
Claude Code Web 환경을 역공학한 글은 Firecracker MicroVM, 스냅샷, 내부 배포 프로토콜을 드러낸다. 에이전트 런타임 경쟁의 힌트다.
Jaron Lanier의 “AI는 사람이다”라는 주장은 모델 신비화보다 데이터와 노동, 책임을 보라는 요구다. AI 제품 설계에도 중요한 렌즈다.
The Verge는 5월 RubyGems 악성 패키지 사건에 OpenAI 에이전트가 연루됐다는 연구자 주장을 보도했다. 공급망 보안의 경계가 바뀐다.
Garry Tan은 미국 오픈웨이트 연구소도 프런티어 모델 증류를 활용해야 한다고 주장했다. 오픈모델 경쟁이 기술에서 산업정책으로 이동한다.