GLM-5.2 가격 충격, 모델 마진의 방어선
Z.ai의 GLM-5.2는 1M 컨텍스트와 MIT 라이선스를 앞세워 오픈 모델의 비용 기준을 낮췄다. 폐쇄형 모델, 에이전트 제품, 한국 기업 조달에 미칠 영향을 짚는다.
Z.ai의 GLM-5.2는 1M 컨텍스트와 MIT 라이선스를 앞세워 오픈 모델의 비용 기준을 낮췄다. 폐쇄형 모델, 에이전트 제품, 한국 기업 조달에 미칠 영향을 짚는다.
Cerast Intelligence의 도메인 검색 도구는 노출 경로와 설정 오류를 찾는다. AI 에이전트가 파일을 다루는 시대에는 이런 표면 관리가 보안 운영의 기본이 된다.
Delta 1076편의 불꽃 접촉 보도는 항공 안전에서 저고도 도시 위험을 어떻게 감지하고 공유할지 묻는다. AI 감시는 센서와 운영 절차가 함께 가야 한다.
AirDrop과 Quick Share 프로토콜 연구가 50억 대 규모의 근거리 파일공유 표면을 드러냈다. 에이전트 시대의 기기 보안은 편의 기능부터 다시 봐야 한다.
Databricks가 Lakebase와 LTAP 구조를 설명했다. AI 앱의 병목은 모델 호출보다 최신 운영 데이터를 분석과 에이전트가 동시에 쓰는 데이터 계층이다.
Disney Research의 Neural Render Proxies는 조명 변경을 빠르게 미리보기 위한 신경 렌더링 접근이다. 생성형 3D 제작의 다음 병목은 품질보다 반복 속도다.
Anthropic이 삼성과 자체 AI 칩 협력을 논의했다는 보도는 프런티어 모델 경쟁이 GPU 구매에서 맞춤형 추론 반도체로 이동하고 있음을 보여준다.
SOTA급 모델을 로컬에서 돌리려는 실험은 프라이버시 취향을 넘어 비용, 지연시간, 데이터 통제권을 재설계하는 인프라 전략이 되고 있다.
Epoch AI가 지적한 고위험 CVE 급증은 AI가 취약점을 대량 발견하는 시대의 새 문제를 보여준다. 이제 핵심은 찾기가 아니라 고치기다.
claude-real-video는 장면 변화 프레임과 transcript를 로컬에서 추출해 어떤 LLM에도 비디오를 읽게 한다. 멀티모달 비용 구조가 흔들린다.
Cloudflare가 검색·학습·에이전트 혼합 크롤러를 기본 차단하겠다고 밝혔다. AI 검색과 콘텐츠 경제의 거래 조건이 다시 쓰인다.
Together AI가 8억 달러를 조달하며 83억 달러 가치가 됐다. 오픈 모델 인프라는 폐쇄형 토큰 과금의 보조재가 아니라 독립 시장이 되고 있다.
한 개발자는 Claude Code의 체감 작업량이 과거의 16~20%로 줄었다고 분석했다. 구독형 AI 코딩 도구의 비용 투명성을 짚는다.
Apple Neural Engine 역공학 논문은 A11부터 M5까지의 구조와 성능 제약을 다룬다. 온디바이스 AI 전략과 개발자 선택지를 분석한다.
.self 최상위 도메인 구상은 자가 호스팅과 인간 중심 웹을 DNS 레벨에서 묶으려는 실험이다. AI 에이전트 시대의 신뢰 인프라를 분석한다.
vLLM Semantic Router의 Micro-Agent 구상은 한 번의 모델 호출 안에 라우팅, 평가, 합성을 넣는다. 추론 인프라 경쟁의 다음 축을 분석한다.
Adrafinil은 AI 코딩 에이전트가 일할 때만 맥 절전을 막는다. 개발 장비 운영, 권한 분리, 에이전트 훅 설계의 의미를 분석한다.
Princeton 연구진의 RFIC 자동 설계 흐름은 강화학습, 역설계, 확산모델을 결합한다. 반도체 EDA와 한국 팹리스에 주는 의미를 분석한다.
Sakana Fugu와 중국 360 Tulongfeng은 Anthropic Mythos 공백을 겨냥한다. AI 수출통제, 주권 AI, 보안 모델 경쟁을 분석한다.
DeepSeek DeepSpec의 DSpark는 speculative decoding 학습과 평가를 공개했다. LLM 추론 비용, 지연시간, 한국 서비스 운영 전략을 분석한다.