집 안의 AI 서버, 로컬 추론 경제학의 민낯
AI At Home 프로젝트는 중고 AMD V620 네 장과 llama.cpp로 가정용 AI 서버를 조립한다. 클라우드 의존을 줄이려는 욕망은 현실의 전력, 냉각, 드라이버 문제와 만난다.
AI At Home 프로젝트는 중고 AMD V620 네 장과 llama.cpp로 가정용 AI 서버를 조립한다. 클라우드 의존을 줄이려는 욕망은 현실의 전력, 냉각, 드라이버 문제와 만난다.
OpenAI의 ChatGPT Enterprise 사용 연구는 기업 AI가 빠르게 확산되지만 역할, 직급, 업무별로 매우 불균등하게 쓰인다는 점을 보여준다. 생산성은 구독 수가 아니라 조직 배치에서 나온다.
Google의 Gemini 3.7 Flash는 코딩, 웹 생성, 문서형 지식 작업을 겨냥한 빠른 개량판이다. 핵심은 벤치마크 상승보다 에이전트 운영 단가를 낮추려는 플랫폼 경쟁이다.
Cerebras와 OpenAI의 Ultrafast 모드는 GPT-5.6 Sol을 초당 최대 750 출력 토큰으로 제공한다. 프런티어 모델 경쟁의 다음 축이 지능에서 지연시간으로 이동하고 있다.
Nine PBS가 50TB 넘는 방송 아카이브 접근 차단을 이유로 Iron Mountain을 제소했다. AI 학습과 검색이 데이터에 기대는 시대, 보관권과 회수권은 기술 문제가 아니라 생존 계약이다.
Florian Herrengt의 글은 AI가 약한 엔지니어링 문화를 더 빨리 망가뜨린다고 주장한다. 핵심은 개발자 대체보다 리뷰와 책임의 병목이다.
Known Agents의 Agentic Web Index는 AI 봇 트래픽과 사칭 문제를 추적한다. ClaudeBot 사칭 스캔은 robots.txt 이후의 신원 검증 과제를 드러낸다.
HTML over WebSockets 접근은 SPA의 복잡한 JSON/API/상태 동기화를 서버 렌더링과 실시간 전송으로 되돌린다. 에이전트 UI에도 중요한 신호다.
Discovered Materials의 벤치마크는 AI가 500개 이상 신소재 후보를 찾았지만 합성 경로는 1개만 그럴듯했다고 보고한다. 검증이 승부처다.
Tailscale이 16년 된 SQLite WAL-Reset 버그를 추적했다. 교훈은 데이터베이스 선택보다 운영 경로와 관측 가능성의 설계다.
Emergent Introspective Awareness in Large Language Models는 모델이 일부 상황에서 내부 활성 상태를 감지하고 보고할 수 있음을 보인다. 의미는 인공지능 의식 선언보다, 내부 상태를 안전 평가와 해석 가능성에 활용할 수 있는지에 있다.
FT는 OpenAI의 AI ethics lead Chloé Bakalar가 합류 1년이 되기 전 회사를 떠났다고 보도했다. 프론티어 모델 경쟁이 사이버, 자율성, 정책 리스크로 확장되는 시점에 윤리 기능의 조직 설계가 다시 시험대에 올랐다.
Stolen Thoughts 연구는 암호화된 reasoning trace가 세션과 모델 사이에서 재사용될 때 독점 추론, 개인정보, 자격 증명이 노출될 수 있음을 보였다. 에이전트 로그와 캐시 설계의 기준을 다시 세울 시점이다.
Suzanne은 프롬프트, 사진, 스케치에서 출발해 채팅으로 아이디어를 다듬고 manufacturable geometry를 내보내는 AI-native 제품 디자인 도구를 표방한다. 생성형 3D의 경쟁 축이 보기 좋은 모델에서 만들 수 있는 설계로 이동하고 있다.
Tencent Hunyuan의 WorldClaw는 텍스트에서 대규모 3D 월드를 만드는 과정을 계획, 지형, 지역별 객체 생성으로 나눈다. 게임과 로봇 시뮬레이션의 생성형 제작 방식이 단일 모델에서 에이전트 워크플로로 이동하고 있다.
AntigmaLabs의 Ante는 오프라인 실행과 단일 바이너리 배포를 앞세운 코딩 에이전트다. 개발자 도구 경쟁은 클라우드 기능뿐 아니라 설치, 의존성, 로컬 모델 경험으로 번지고 있다.
Docker Sandboxes는 Claude Code, Gemini, Codex, Kiro 같은 코딩 에이전트를 microVM 격리 안에서 실행하게 한다. 에이전트 도입의 핵심은 성능보다 실행 권한 통제가 되고 있다.
Meta가 Muse Glimmer 30B를 공개했다. 항상 켜진 로컬 에이전트가 클라우드 API만의 영역이 아니라 소비자 하드웨어와 오픈 모델의 경쟁으로 이동한다는 신호다.
Cactus가 14MB Needle 2를 공개했다. 초소형 에이전트 모델은 스마트폰과 웨어러블, 로봇에서 도구 호출과 구조화 추출을 로컬 기능으로 바꾸려는 시도다.
YC S26의 Stoa Markets는 GPU와 AI 서버를 사고파는 기관형 마켓플레이스를 표방한다. AI 인프라 경쟁은 구매 경쟁에서 가격 발견과 담보 금융의 문제로 확장되고 있다.