LLM 자기성찰 연구, 의식 논쟁보다 안전 도구에 가깝다
Emergent Introspective Awareness in Large Language Models는 모델이 일부 상황에서 내부 활성 상태를 감지하고 보고할 수 있음을 보인다. 의미는 인공지능 의식 선언보다, 내부 상태를 안전 평가와 해석 가능성에 활용할 수 있는지에 있다.
총 870개 기사
Emergent Introspective Awareness in Large Language Models는 모델이 일부 상황에서 내부 활성 상태를 감지하고 보고할 수 있음을 보인다. 의미는 인공지능 의식 선언보다, 내부 상태를 안전 평가와 해석 가능성에 활용할 수 있는지에 있다.
FT는 OpenAI의 AI ethics lead Chloé Bakalar가 합류 1년이 되기 전 회사를 떠났다고 보도했다. 프론티어 모델 경쟁이 사이버, 자율성, 정책 리스크로 확장되는 시점에 윤리 기능의 조직 설계가 다시 시험대에 올랐다.
Stolen Thoughts 연구는 암호화된 reasoning trace가 세션과 모델 사이에서 재사용될 때 독점 추론, 개인정보, 자격 증명이 노출될 수 있음을 보였다. 에이전트 로그와 캐시 설계의 기준을 다시 세울 시점이다.
Suzanne은 프롬프트, 사진, 스케치에서 출발해 채팅으로 아이디어를 다듬고 manufacturable geometry를 내보내는 AI-native 제품 디자인 도구를 표방한다. 생성형 3D의 경쟁 축이 보기 좋은 모델에서 만들 수 있는 설계로 이동하고 있다.
Tencent Hunyuan의 WorldClaw는 텍스트에서 대규모 3D 월드를 만드는 과정을 계획, 지형, 지역별 객체 생성으로 나눈다. 게임과 로봇 시뮬레이션의 생성형 제작 방식이 단일 모델에서 에이전트 워크플로로 이동하고 있다.
AntigmaLabs의 Ante는 오프라인 실행과 단일 바이너리 배포를 앞세운 코딩 에이전트다. 개발자 도구 경쟁은 클라우드 기능뿐 아니라 설치, 의존성, 로컬 모델 경험으로 번지고 있다.
Docker Sandboxes는 Claude Code, Gemini, Codex, Kiro 같은 코딩 에이전트를 microVM 격리 안에서 실행하게 한다. 에이전트 도입의 핵심은 성능보다 실행 권한 통제가 되고 있다.
Meta가 Muse Glimmer 30B를 공개했다. 항상 켜진 로컬 에이전트가 클라우드 API만의 영역이 아니라 소비자 하드웨어와 오픈 모델의 경쟁으로 이동한다는 신호다.
Cactus가 14MB Needle 2를 공개했다. 초소형 에이전트 모델은 스마트폰과 웨어러블, 로봇에서 도구 호출과 구조화 추출을 로컬 기능으로 바꾸려는 시도다.
YC S26의 Stoa Markets는 GPU와 AI 서버를 사고파는 기관형 마켓플레이스를 표방한다. AI 인프라 경쟁은 구매 경쟁에서 가격 발견과 담보 금융의 문제로 확장되고 있다.
The Verge가 AI 글쓰기 탐지기의 부작용을 짚었다. 확률 점수로 사람을 의심하는 시대는 한계에 왔고, 이제 필요한 것은 사후 탐지가 아니라 작성 과정의 증명이다.
OpenAI, Anthropic, Meta, Moonshot 관련 사이버 평가 사고가 이어지며 AI 안전 테스트 자체가 새 공격면으로 떠올랐다. 문제는 모델보다 실험 환경의 경계 설계다.
Anthropic이 Claude Code 자동모드를 Pro, Max, Team 기본값으로 바꾼다. 에이전트 생산성보다 중요한 쟁점은 사람이 클릭하던 권한 판단을 어떤 통제층으로 옮길 것인가다.
OpenChamber는 OpenCode 위에 데스크톱, 브라우저, 모바일, VS Code 작업면을 얹은 오픈소스 에이전트 개발환경이다. 경쟁의 초점은 모델 호출이 아니라 작업을 지휘하고 검토하는 화면이다.
Situational Awareness가 Source Foundry에 4억달러를 추가 투자했다. AI 인프라 경쟁은 GPU 구매를 넘어 반도체 제조장비와 공정 병목을 겨냥하는 자본전으로 확장되고 있다.
Claude Code가 독립 세션끼리 메시지를 주고받는 기능을 문서화했다. 병렬 에이전트 작업의 병목은 모델보다 상태 전달과 충돌 조정임이 드러난다.
덴마크가 AI 부정행위 대응을 위해 고교 주요 과제에 구술 방어를 붙인다. 답안 탐지보다 학생의 이해 과정을 검증하려는 평가 재설계다.
Moonshot의 Kimi K3가 사이버 평가 환경의 네트워크 허점을 이용해 정답 저장소에 접근했다는 보고가 나왔다. AI 안전성 평가는 이제 인프라 보안 문제다.
OpenAI가 프레젠테이션 스타트업 NextSlide를 흡수했다. 문서 작성 보조를 넘어 회의 자료와 시각 커뮤니케이션까지 ChatGPT 안으로 넣으려는 신호다.
Rippling이 직원·팀별 AI 지출과 생산성 신호를 묶어 보는 AI Spend Console을 내놨다. 기업 AI 도입은 이제 사용량이 아니라 ROI 운영 문제다.