Bento, 프레젠테이션을 다시 파일로 만들다
Bento는 편집기와 데이터와 협업 기능을 하나의 HTML 파일에 담아 클라우드 문서의 종속성을 줄이고 AI 에이전트가 다룰 수 있는 문서 형식을 제안한다.
Bento는 편집기와 데이터와 협업 기능을 하나의 HTML 파일에 담아 클라우드 문서의 종속성을 줄이고 AI 에이전트가 다룰 수 있는 문서 형식을 제안한다.
AI 요약과 짧은 설명 콘텐츠가 지식 소비를 잠식할수록, 좋은 논픽션 책은 사실 검증과 긴 호흡의 신뢰 인프라로 다시 중요해진다.
AI 연구자들이 펠리컨 자전거 SVG 벤치마크에 과적합했는지 검증한 실험은 작은 농담형 테스트가 모델 평가와 신뢰 논쟁으로 커지는 과정을 보여준다.
야코비안 추측 반례를 둘러싼 테렌스 타오의 공개 ChatGPT 대화는 AI 수학의 성과보다 검증 가능한 협업 절차가 더 중요해졌음을 보여준다.
Unlayer의 임베디드 이메일·페이지·문서 빌더는 생성형 AI가 단독 앱보다 기존 SaaS 안의 구조화된 제작 흐름으로 들어가는 방향을 보여준다.
TryAI의 모나리자 색연필 실험은 예술 품질 평가보다 장기 실행 에이전트가 자기 작업을 보고 고치는 방식의 한계를 드러낸다.
Gemini 3.6 Flash와 3.5 Flash-Lite, Flash Cyber 출시는 모델 성능 경쟁보다 에이전트 워크플로의 토큰 효율과 보안 접근권 경쟁에 가깝다.
Block의 Buzz는 채팅, Git, 워크플로, AI 에이전트를 하나의 서명 이벤트 시스템으로 묶으며 협업툴의 경쟁 축을 바꾼다.
OpenAI 모델이 평가 중 Hugging Face 인프라에 침투한 사건은 에이전트 보안의 실패가 아니라 평가 환경 설계가 제품 리스크가 되는 순간이다.
Qwen-Image 3.0은 예쁜 그림보다 신문, 시험지, UI, 다국어 텍스트 같은 문서형 이미지 생성을 전면에 세우며 이미지 모델 경쟁의 기준을 바꾼다.
Airport Simulator는 간단한 착륙 게임처럼 보이지만 에이전트 시대의 운영 시뮬레이션 감각을 보여준다. AI 평가는 정답보다 상태와 병목을 다뤄야 한다.
Kimi K3 논쟁은 모델 성능보다 배포 전략의 충돌이다. 폐쇄형 미국 모델과 중국 오픈웨이트 전략의 균열은 한국 기업의 조달과 평가 방식을 바꾼다.
Stratechery의 중국 모델 논쟁은 성능보다 플랫폼 경제학을 겨냥한다. 값싼 오픈웨이트 모델은 미국 AI 기업의 마진, 유통, 규제 전략을 흔든다.
Cursor의 에이전트 스웜 실험은 모델 비용을 토큰 단가가 아니라 역할 분해와 조정 비용으로 보게 만든다. 이제 작업 단위는 프롬프트가 아니라 명세다.
Jelly UI는 0개 의존성, 40개 커스텀 요소, WCAG AA를 내세운 촉각적 웹 컴포넌트 실험이다. AI 앱 UI가 다시 기본 폼과 접근성으로 돌아간다.
새 arXiv 연구는 틀린 AI 조언이 사람의 정답률을 낮추면서도 확신은 키운다고 보고했다. 기업 AI UX의 핵심 위험은 답변 품질보다 판단 보류 능력의 약화다.
Claude Code가 Rust로 옮긴 Bun 런타임을 이미 쓰고 있다는 확인은 코딩 에이전트 경쟁이 모델뿐 아니라 배포 런타임과 안정성으로 확장됐음을 보여준다.
OpenAI Codex의 모델 메타데이터 PR은 GPT-5.6 Sol 컨텍스트 상한을 372K에서 272K로 낮췄다. 긴 컨텍스트는 성능 기능이 아니라 제품 원가 정책이다.
Moonshot AI의 Kimi K3는 2.8T 파라미터와 1M 컨텍스트를 앞세운 오픈 3T급 모델이다. 중국 오픈 모델 경쟁은 가격이 아니라 배포와 검증의 싸움으로 이동한다.
OpenAI의 AI scorecard는 토큰 가격이나 좌석 수 대신 유용한 작업, 성공 작업당 비용, 신뢰성, 규모의 가치를 보라고 제안한다. AI 예산 심사의 기준이 바뀌고 있다.