본문으로 건너뛰기

#llm

- 3페이지

AI 워터마크, 사용자는 거의 구분하지 못했다

SynthID 워터마크 응답을 맞히는 간단한 퀴즈 결과는 사용자가 AI 워터마크를 체감 품질로 식별하기 어렵고, 출처 증명은 사람 눈보다 플랫폼 검증과 감사 가능한 메타데이터 설계에 달려 있음을 보여준다. 교육과 기업 문서 모두에 해당한다.

2026-08-23원본

로컬 LLM 품질, 모델보다 실행 스택이 흔든다

로컬 LLM이 기대보다 둔하게 느껴지는 이유는 모델 가중치만의 문제가 아니다. 추론 엔진, 양자화, KV 캐시, 긴 문맥 평가와 업무형 벤치마크가 실제 품질을 좌우한다는 신호이며, 온프레미스 AI 도입팀에는 재현성 체계가 필요하다.

2026-08-23원본

Munder Difflin, 개인 클론 사무실을 제품화하다

Munder Difflin은 Claude Code, Codex, Gemini CLI 등 기존 터미널 에이전트를 묶어 개인과 팀의 클론 사무실처럼 운영하려는 오픈소스 하네스로, 경쟁축이 단일 채팅창에서 운영 계층으로 넓어지고 있음을 보여준다.

2026-08-23원본

암호화된 추론 흔적, API 보안 경계가 흔들렸다

Stolen Thoughts 연구는 암호화된 reasoning trace가 세션과 모델 사이에서 재사용될 때 독점 추론, 개인정보, 자격 증명이 노출될 수 있음을 보였다. 에이전트 로그와 캐시 설계의 기준을 다시 세울 시점이다.

2026-08-12원본

Claude 5, 컨텍스트를 줄이는 법

Anthropic은 Claude 5 세대에서 Claude Code 시스템 프롬프트를 80% 이상 줄였다. 에이전트 설계의 경쟁력이 지시문 양에서 도구 인터페이스, 점진적 맥락 로딩, 검증 루프로 이동하며 개발팀의 운영 기준도 바뀐다.

2026-07-26원본

Debian LLM 표결, 오픈소스의 갈림길

Debian이 LLM 사용을 두고 금지, 조건부 허용, 불필요 입장을 함께 논의한다. 생성 코드의 책임, 공개, 검토 기준이 AI 시대 오픈소스 거버넌스와 기업 개발 정책의 핵심 쟁점이 되며 한국 팀에도 기준을 던진다.

2026-07-26원본

오픈웨이트 AI의 쿠버네티스 순간

오픈웨이트 모델이 클라우드 네이티브처럼 공통 기반이 될 수 있다는 주장이 나왔다. 규제보다 표준, 서빙 도구, 평가 하네스, 운영 스택 경쟁이 AI 주도권과 스타트업 기회를 좌우하며 자체 호스팅 전략을 빠르게 흔든다.

2026-07-26원본

OpenAI Presence, 에이전트 운영을 판다

OpenAI Presence는 음성과 채팅 에이전트를 기업 업무에 배포하는 제한적 GA 제품이다. 모델보다 정책, 평가, 승인, escalation, Codex 개선 루프가 상품이 되며 상담 자동화와 내부 업무 기준을 바꾼다.

2026-07-26원본

Yorishiro, 터미널에 에이전트의 몸을 넣다

Yorishiro는 Claude Code와 Codex가 inhabits하는 macOS 터미널을 제안한다. 에이전트 UX 경쟁이 채팅창을 넘어 존재감, 승인 알림, 작업 환경 설계로 확장되며 개발 도구의 감각을 바꾼다.

2026-07-26원본