브라운 AI 부정 논란, 평가 방식의 붕괴
브라운대 경제학 수업의 대규모 AI 부정 의혹은 AI 탐지기보다 평가 설계와 증거 절차가 더 중요한 시대가 왔음을 보여준다.
브라운대 경제학 수업의 대규모 AI 부정 의혹은 AI 탐지기보다 평가 설계와 증거 절차가 더 중요한 시대가 왔음을 보여준다.
개인 MRI를 Claude Code와 Opus 4.8로 분석한 사례는 의료 AI가 진단 대체가 아니라 검증 워크플로로 쓰일 때의 가치와 위험을 보여준다.
OpenAI Codex 이슈 #2847은 .env와 키 파일을 에이전트가 읽지 못하게 하는 결정적 제외 규칙의 필요성을 보여준다.
LibrePods는 AirPods의 애플 전용 기능을 리눅스와 안드로이드로 옮기려는 오픈소스 프로젝트다. 상호운용성, 보안, AI 개발의 의미를 본다.
Proxy-KD 논문은 폐쇄형 LLM 출력만으로 작은 모델을 개선하는 경로를 제시한다. 모델 비용, 약관, 주권 AI 경쟁의 의미를 분석한다.
Adrafinil은 AI 코딩 에이전트가 일할 때만 맥 절전을 막는다. 개발 장비 운영, 권한 분리, 에이전트 훅 설계의 의미를 분석한다.
Princeton 연구진의 RFIC 자동 설계 흐름은 강화학습, 역설계, 확산모델을 결합한다. 반도체 EDA와 한국 팹리스에 주는 의미를 분석한다.
Sakana Fugu와 중국 360 Tulongfeng은 Anthropic Mythos 공백을 겨냥한다. AI 수출통제, 주권 AI, 보안 모델 경쟁을 분석한다.
DeepSeek DeepSpec의 DSpark는 speculative decoding 학습과 평가를 공개했다. LLM 추론 비용, 지연시간, 한국 서비스 운영 전략을 분석한다.
Sarah Wynn-Williams의 Meta 소송은 비밀유지, 내부고발, 감시 논란을 다시 불렀다. AI 플랫폼 시대 신뢰와 인재 리스크를 분석한다.