AI 스타트업 ARR 부풀리기, 성장 서사의 비용
TechCrunch는 일부 AI 스타트업이 ARR 정의를 느슨하게 써 성장 서사를 만든다고 보도했다. AI 투자 시장은 매출보다 반복성·마진·사용량 검증이 중요해졌다.
TechCrunch는 일부 AI 스타트업이 ARR 정의를 느슨하게 써 성장 서사를 만든다고 보도했다. AI 투자 시장은 매출보다 반복성·마진·사용량 검증이 중요해졌다.
새 arXiv 논문은 도메인 어휘를 흉내 낸 인젝션이 탐지율을 크게 떨어뜨린다고 보고했다. 에이전트 보안은 키워드 차단을 넘어 문맥 검증이 필요하다.
KanBots는 칸반 카드마다 Claude Code·Codex를 별도 worktree에서 실행한다. 코딩 에이전트 경쟁이 채팅창에서 작업 운영판으로 이동하는 신호다.
Models.dev는 AI 모델의 가격·기능·스펙을 공개 데이터베이스로 모은다. 에이전트 스택의 모델 라우팅은 감이 아니라 갱신 가능한 데이터가 필요해졌다.
Superset은 여러 CLI 코딩 에이전트를 worktree에서 병렬 실행하는 코드 에디터다. 에이전트 IDE 경쟁은 채팅 보조에서 로컬 오케스트레이션으로 옮겨간다.
Project Hail Mary 팬 별지도는 ESA Gaia DR3 데이터를 체험형 UI로 바꿨다. AI 제품도 정확한 데이터와 설명 가능한 인터페이스가 경쟁력이 된다.
Google Antigravity 업데이트 경험담은 IDE가 챗봇형 도구로 바뀌며 워크플로를 깨뜨릴 수 있음을 보여준다. AI 개발도구의 자동 업데이트 신뢰가 쟁점이 됐다.
저시력 사용자의 Kagi 경험은 광고와 AI 요약으로 복잡해진 검색 UI가 접근성 비용을 만든다는 점을 보여준다. 검색 경쟁의 기준이 달라지고 있다.
Multi-Stream LLM 논문은 생각·입력·출력을 병렬 스트림으로 나눠 단일 채팅 흐름의 병목을 줄이려 한다. 에이전트 아키텍처 경쟁이 모델 구조로 내려갔다.
YC P26 Runtime은 Claude Code, Codex, Gemini CLI 등을 팀 샌드박스와 거버넌스로 묶는다. 코딩 에이전트 경쟁은 개인 도구에서 운영 플랫폼으로 이동 중이다.
distributed-system-testing은 AI 코딩 에이전트가 분산·상태 시스템을 주장 기반으로 테스트하게 하는 두 개의 SKILL.md 워크플로를 제안한다.
BBC는 AI 검색과 챗봇이 웹 콘텐츠 조작으로 허위 정보를 답하도록 유도될 수 있다고 보도했다. 검색 최적화는 이제 보안 리스크다.
OpenAI 모델이 1946년 이후 남아 있던 평면 단위거리 추측 반례를 찾았다고 밝혔다. AI 연구 보조가 검증 가능한 발견 단계로 이동했다.
PopuLoRA는 여러 LoRA 어댑터가 교사와 학생으로 공진화하는 자기대전 학습을 제안한다. 단일 모델 자기개선의 쉬운 문제 편향을 겨냥했다.
Alibaba가 Qwen3.7-Max를 공개하며 35시간 연속 실행과 1,000회 이상 도구 호출을 강조했다. 에이전트 경쟁은 모델보다 스택 싸움이 됐다.
AI 워터마크 제거 도구가 GitHub에서 주목받았다. C2PA와 SynthID 같은 출처 증명 체계가 단일 방어선이 될 수 없다는 경고다.
Forge는 8B 로컬 모델의 도구호출 안정성을 guardrails와 context management로 끌어올린다. 에이전트 품질은 모델 크기만의 문제가 아니다.
Google이 Gemini 3.5 Flash를 공개했다. 플래그십급 지능과 낮은 지연시간을 결합해 에이전트·코딩 워크플로의 기본값 경쟁을 키운다.
Mistral AI가 Physics AI 스타트업 Emmi AI를 인수한다. 유럽 AI 경쟁은 챗봇을 넘어 제조·항공·반도체 엔지니어링으로 이동한다.
OpenAI가 C2PA conformant generator가 되고 Google SynthID를 이미지에 도입한다. AI 콘텐츠 검증은 경쟁보다 상호운용성이 중요해졌다.