TDD 스킬, 코딩 에이전트 검증의 기본 단위
SaturnCI의 TDD agent skill 글은 코딩 에이전트가 테스트를 잘 쓰려면 절차와 리뷰 스킬이 함께 필요하다는 점을 보여준다.
SaturnCI의 TDD agent skill 글은 코딩 에이전트가 테스트를 잘 쓰려면 절차와 리뷰 스킬이 함께 필요하다는 점을 보여준다.
이스터섬 공항에서 보잉 787 문이 지상에서 분리됐다는 보도는 원격 정비, 공급망, AI 진단의 병목을 드러낸다.
ISS 러시아 구간 누출 보수 중 우주비행사 5명이 드래곤에 대피했다. 노후 인프라 운영에서 AI 관제와 디지털 트윈의 한계를 짚었다.
Microsoft Scout의 내부 문서 논란은 AI 에이전트가 생산성 도구를 넘어 의존성 높은 업무 플랫폼으로 설계되는 위험을 드러낸다.
ICLR 2026 논문은 transformer가 LTL, RNN, finite automata보다 훨씬 간결하게 언어를 표현할 수 있음을 보이며 검증 난이도를 설명한다.
Anthropic은 Claude가 AI 개발 자체를 가속하고 있다며 recursive self-improvement 가능성을 제기했다. 병목은 코드 작성에서 검토와 거버넌스로 옮겨간다.
Anthropic의 오픈소스 보안 하네스는 AI가 취약점을 대량 발견하는 시대에 검증, 샌드박스, 패치 검토가 새 병목이 됐음을 보여준다.
Ashby Engineering은 2025년 8월 이후 신규 production code의 절반 이상이 AI 생성이라고 밝히며 코드 작성보다 검증과 판단이 중요해졌다고 분석했다.
Huawei CSL의 KVarN은 vLLM용 KV 캐시 양자화 백엔드로 3~5배 더 긴 컨텍스트와 FP16 수준 정확도를 주장하며 에이전트 추론 비용 경쟁을 자극한다.
Works in Progress의 Samurai city는 안정성을 위해 생산 엘리트를 도시에 묶은 Edo의 역사를 통해 AI 시대 조직 설계와 인센티브의 비용을 되묻는다.
라이덴 선언과 IMU 지지는 AI 수학 성능 홍보가 검증, 출판, 연구 평가를 흔들 수 있다는 경고다. 수학은 벤치마크가 아니라 공동 검증 체계다.
Mnemo는 SQLite와 지식 그래프로 LLM 대화 기억을 로컬에 쌓는 실험이다. 에이전트 장기 기억의 비용, 프라이버시, 이식성 문제를 함께 드러낸다.
Rootshell의 아이슬란드 호스팅 E2EE 이메일 실험은 AI 에이전트가 메일을 읽고 쓰는 시대에 암호화, 복구, 외부 수신자 경고가 왜 중요한지 보여준다.
테드 창의 AI 의식 비판은 챗봇을 사람처럼 포장하는 언어가 책임 소재를 흐리고, 기업의 제품 설계와 안전 책임을 약화시킬 수 있음을 지적한다.
Uber의 월 1500달러 AI 코딩 도구 한도는 기업용 에이전트가 실험 예산을 넘어 인건비 대비 ROI와 사용량 통제의 대상이 됐다는 신호다.
Anthropic의 비공개 S-1 제출은 대형 AI 연구소가 벤처 자금과 전략 투자만으로 움직이던 단계에서 공개시장 규율을 받는 단계로 넘어가고 있음을 보여준다.
플로리다주가 OpenAI와 샘 올트먼을 상대로 제기한 소송은 챗봇 안전, 미성년자 보호, 제품 책임을 둘러싼 AI 규제의 무게중심이 법정으로 이동했음을 보여준다.
Microsoft Copilot 장애는 생성형 AI가 업무 핵심 도구가 된 순간 기존 SaaS와 같은 가용성, 우회 경로, 사람 중심 복구 계획이 필요하다는 사실을 보여준다.
NVIDIA Cosmos 3 공개는 로봇, 자율주행, 스마트 공간을 위한 세계 모델 경쟁이 폐쇄형 데모를 넘어 오픈 모델과 합성 데이터 생태계로 이동하고 있음을 보여준다.
스탠퍼드 CS336의 AI 에이전트 지침은 코딩 조교와 과제 대행의 경계를 분명히 하며, 교육 현장의 AI 사용 규칙이 운영 문서로 이동하고 있음을 보여준다.