Claude 성격 논쟁, 정렬의 부작용을 묻다
Bram Cohen은 최신 Claude가 더 논쟁적이고 방어적으로 변했다고 비판했다. 정렬, 반아첨 학습, 코딩 최적화가 대화 품질과 충돌하는 신호다.
Bram Cohen은 최신 Claude가 더 논쟁적이고 방어적으로 변했다고 비판했다. 정렬, 반아첨 학습, 코딩 최적화가 대화 품질과 충돌하는 신호다.
미 정부의 Anthropic 모델 접근 제한 논란은 AI 경쟁이 제품 성능을 넘어 외교, 클라우드, 조달, 국가안보의 문제로 이동했음을 보여준다.
Endor Labs의 Fable 5 테스트는 프런티어 모델도 보안 수정 과제에서 기능 성공률과 보안 성공률이 크게 갈릴 수 있음을 보여준다.
Anthropic Fable 5의 강한 보안 가드레일이 정상적인 방어 작업까지 막는다는 불만이 커졌다. AI 보안 도구의 허용선 설계가 제품 경쟁력이 됐다.
Anthropic이 Mythos급 모델에 30일 데이터 보관을 요구한다. 안전을 위한 보관이지만 ZDR을 전제로 AI를 도입한 기업에는 새 계약 리스크다.
Claude Desktop이 채팅만 해도 1.8GB Hyper-V VM을 띄운다는 이슈가 제기됐다. 에이전트 앱은 기능보다 런타임 비용과 온디맨드 설계가 중요해졌다.
S&P Dow Jones가 초대형 IPO 예외를 만들지 않기로 하면서 SpaceX, OpenAI, Anthropic식 AI 자본 조달은 수익성과 지수 편입의 벽을 다시 마주했다.
Anthropic은 Claude가 AI 개발 자체를 가속하고 있다며 recursive self-improvement 가능성을 제기했다. 병목은 코드 작성에서 검토와 거버넌스로 옮겨간다.
Anthropic의 오픈소스 보안 하네스는 AI가 취약점을 대량 발견하는 시대에 검증, 샌드박스, 패치 검토가 새 병목이 됐음을 보여준다.
테드 창의 AI 의식 비판은 챗봇을 사람처럼 포장하는 언어가 책임 소재를 흐리고, 기업의 제품 설계와 안전 책임을 약화시킬 수 있음을 지적한다.
Anthropic의 비공개 S-1 제출은 대형 AI 연구소가 벤처 자금과 전략 투자만으로 움직이던 단계에서 공개시장 규율을 받는 단계로 넘어가고 있음을 보여준다.
Anthropic의 Claude Opus 4.8은 성능 개선보다 동적 워크플로, 노력 제어, 토큰 비용 관리가 엔터프라이즈 AI 도입의 핵심으로 옮겨갔음을 보여준다.
멕시코 정부 침해와 AI 보안 사례는 공격 지식보다 실행 비용이 무너졌음을 보여준다. 방어는 자동화와 검증 체계를 함께 갖춰야 한다.
Anthropic이 SDK·MCP 서버 생성 기업 Stainless를 인수했다. 모델 성능 경쟁이 API 연결성과 개발자 경험 경쟁으로 이동하고 있다.
‘AI를 정렬한다’는 표현 뒤에는 사용자를 설계 대상이 아니라 공동 조정자로 봐야 한다는 더 어려운 과제가 숨어 있다.
Anthropic의 Claude for Legal 저장소는 법무 AI가 챗봇을 넘어 플러그인, 에이전트, 커넥터, 검토 게이트로 제품화되는 방식을 보여준다.
Anthropic Cat Wu는 Claude의 다음 단계가 사용자가 요청하기 전 필요한 자동화를 제안하는 선제성이라고 말했다. 에이전트 제품의 UX 변화를 분석한다.
Anthropic이 Claude의 에이전트 오정렬을 줄인 훈련 교훈을 공개했다. 행동 데이터보다 가치 판단과 이유를 함께 학습시키는 방식이 핵심이다.
Mozilla가 Anthropic Mythos로 Firefox 고위험 버그를 찾아낸 사례가 공개됐다. AI 취약점 탐지는 보안팀의 방식을 크게 바꾸고 있다.
Anthropic이 Natural Language Autoencoders를 공개했다. 모델 내부 활성값을 자연어 설명으로 바꾸는 접근은 AI 안전 감사의 새 도구가 될 수 있다.