라이덴 선언, AI 수학 경쟁에 제동을 걸다
라이덴 선언과 IMU 지지는 AI 수학 성능 홍보가 검증, 출판, 연구 평가를 흔들 수 있다는 경고다. 수학은 벤치마크가 아니라 공동 검증 체계다.
라이덴 선언과 IMU 지지는 AI 수학 성능 홍보가 검증, 출판, 연구 평가를 흔들 수 있다는 경고다. 수학은 벤치마크가 아니라 공동 검증 체계다.
Mnemo는 SQLite와 지식 그래프로 LLM 대화 기억을 로컬에 쌓는 실험이다. 에이전트 장기 기억의 비용, 프라이버시, 이식성 문제를 함께 드러낸다.
Rootshell의 아이슬란드 호스팅 E2EE 이메일 실험은 AI 에이전트가 메일을 읽고 쓰는 시대에 암호화, 복구, 외부 수신자 경고가 왜 중요한지 보여준다.
테드 창의 AI 의식 비판은 챗봇을 사람처럼 포장하는 언어가 책임 소재를 흐리고, 기업의 제품 설계와 안전 책임을 약화시킬 수 있음을 지적한다.
Uber의 월 1500달러 AI 코딩 도구 한도는 기업용 에이전트가 실험 예산을 넘어 인건비 대비 ROI와 사용량 통제의 대상이 됐다는 신호다.
Anthropic의 비공개 S-1 제출은 대형 AI 연구소가 벤처 자금과 전략 투자만으로 움직이던 단계에서 공개시장 규율을 받는 단계로 넘어가고 있음을 보여준다.
플로리다주가 OpenAI와 샘 올트먼을 상대로 제기한 소송은 챗봇 안전, 미성년자 보호, 제품 책임을 둘러싼 AI 규제의 무게중심이 법정으로 이동했음을 보여준다.
Microsoft Copilot 장애는 생성형 AI가 업무 핵심 도구가 된 순간 기존 SaaS와 같은 가용성, 우회 경로, 사람 중심 복구 계획이 필요하다는 사실을 보여준다.
NVIDIA Cosmos 3 공개는 로봇, 자율주행, 스마트 공간을 위한 세계 모델 경쟁이 폐쇄형 데모를 넘어 오픈 모델과 합성 데이터 생태계로 이동하고 있음을 보여준다.
스탠퍼드 CS336의 AI 에이전트 지침은 코딩 조교와 과제 대행의 경계를 분명히 하며, 교육 현장의 AI 사용 규칙이 운영 문서로 이동하고 있음을 보여준다.