AI가 과제를 풀자, 평가는 설명 능력으로 옮겨갔다
CMU의 Christian Kästner가 AI로 풀 수 있게 된 과제를 어떻게 바꿨는지 공개했다. 15분 구술 점검과 AI 보조 채점, 대형 코드베이스 과제의 효과와 한계를 짚고 한국 대학·기업 교육이 결과물보다 이해도를 평가할 방법을 분석한다.
CMU의 Christian Kästner가 AI로 풀 수 있게 된 과제를 어떻게 바꿨는지 공개했다. 15분 구술 점검과 AI 보조 채점, 대형 코드베이스 과제의 효과와 한계를 짚고 한국 대학·기업 교육이 결과물보다 이해도를 평가할 방법을 분석한다.
Anthropic의 7년 116억 달러 Akamai 계약 보도는 에이전트 실행 인프라의 중요성을 드러낸다. 조건부 지출과 매출 인식 시점, 워런트 구조를 구분하고 GPU 추론 밖의 CPU·브라우저·코드 실행 비용이 한국 기업의 AI 설계에 주는 의미를 분석한다.
Drawgent가 Excalidraw 캔버스에 Claude Code·Codex·opencode를 연결했다. 그림 옆 지시와 화면 검증을 결합하는 구조, 세션 연결 방식의 차이, 아직 검증되지 않은 기능을 살펴보고 국내 개발팀의 설계 리뷰 활용 조건을 분석한다.
미국 보험사 협회가 AI 청구 코딩 확산과 의료비 증가를 연결하는 분석을 내놨다. 9억 4,200만 달러 추정치의 범위와 이해관계, 진단 기록과 실제 치료의 차이를 살펴보고 한국 의료 AI가 효율성과 비용 전가를 구분해 평가할 방법을 짚는다.
UpGuard가 약 1만 6천 개 Supabase 데이터베이스의 개인정보 노출을 발견했다고 밝혔다. 플랫폼 침해와 앱 권한 설정을 구분하고 RLS·공개 키·서버 비밀 키의 역할을 짚으며 한국 개발팀이 AI 생성 앱의 배포 전 접근 제어를 검증할 기준을 정리한다.
Ando가 사람과 AI 에이전트가 함께 참여하는 팀 메신저를 공개하고 2천만 달러 투자를 발표했다. 독립된 에이전트 계정과 받은편지함이 협업을 바꿀 수 있을지 살펴본다. Slack과의 경쟁, 작은 팀 중심의 현재 범위, 국내 기업의 권한·알림·문맥 이전 과제를 분석한다.
Databricks가 Row Zero를 인수해 Genie에 통제 가능한 스프레드시트를 결합한다. 익숙한 셀과 수식이 AI 답변을 검토하는 도구가 될 수 있다는 구상이다. 인수 사실과 향후 통합 계획을 구분하고, 데이터 권한·계보·쿼리 비용을 중심으로 국내 도입 조건을 분석한다.
구글이 미국 Pixel 11 유료 구독자를 대상으로 Gemini 전화 대행 기능을 실험한다. 실시간 통화 기록과 사용자 인계, 승인한 개인정보 공유가 핵심이다. 기존 자동 통화와의 차이, 예약 변경의 책임 경계, 한국 서비스가 준비할 권한 설계와 완료 검증 기준을 분석한다.
Oracle이 뉴멕시코 Stargate 사업의 개발사에 불가항력 통지를 보냈다. 이는 사업 철수나 지연 확정과 다르며 회사는 일정을 유지한다고 밝혔다. 2028년 가동 목표와 가스 공급·허가 문제를 짚고, 국내 AI 기업이 용량 계약과 서비스 연속성에서 확인할 조건을 분석한다.
PrismML의 20억 파라미터 Bonsai 모델이 퀄컴 스마트 안경 플랫폼에서 시연됐다. 아직 상용 안경 출시는 아니다. 모델 압축과 배터리·발열·시각 인식 품질의 차이를 짚고, 국내 웨어러블 개발팀이 확인해야 할 실기기 평가 기준과 개인정보 처리 경계를 분석한다.