Weave 채용공고가 보여준 AI 개발 측정 시장
YC W25 Weave의 ML·AI·제품 채용은 AI가 개발자를 대체하는 논쟁보다 팀 안에서 사람과 에이전트의 기여를 측정하는 시장이 커지고 있음을 시사한다.
YC W25 Weave의 ML·AI·제품 채용은 AI가 개발자를 대체하는 논쟁보다 팀 안에서 사람과 에이전트의 기여를 측정하는 시장이 커지고 있음을 시사한다.
arXiv 논문 Constraint Decay는 백엔드 코드 생성에서 기능 테스트를 통과해도 구조 제약을 잃는 코딩 에이전트의 취약성을 정량화했다.
DeepSeek 전용 코딩 에이전트 Reasonix는 프롬프트 캐시 안정성을 제품 구조로 삼아 장시간 실행형 개발 에이전트의 비용 공식을 바꾸고 있다.
CISA contractor의 공개 GitHub 비밀정보 유출 의혹은 AI 코딩 에이전트 시대에 secret scanning, 권한 분리, 감사 로그가 왜 필수인지 보여준다.
Horace He의 딥러닝 성능 글은 GPU 부족 시대에도 여전히 유효하다. 최적화는 트릭이 아니라 compute, memory, overhead를 구분하는 일이다.
KanBots는 칸반 카드마다 Claude Code·Codex를 별도 worktree에서 실행한다. 코딩 에이전트 경쟁이 채팅창에서 작업 운영판으로 이동하는 신호다.
Superset은 여러 CLI 코딩 에이전트를 worktree에서 병렬 실행하는 코드 에디터다. 에이전트 IDE 경쟁은 채팅 보조에서 로컬 오케스트레이션으로 옮겨간다.
Google Antigravity 업데이트 경험담은 IDE가 챗봇형 도구로 바뀌며 워크플로를 깨뜨릴 수 있음을 보여준다. AI 개발도구의 자동 업데이트 신뢰가 쟁점이 됐다.
distributed-system-testing은 AI 코딩 에이전트가 분산·상태 시스템을 주장 기반으로 테스트하게 하는 두 개의 SKILL.md 워크플로를 제안한다.
Forge는 8B 로컬 모델의 도구호출 안정성을 guardrails와 context management로 끌어올린다. 에이전트 품질은 모델 크기만의 문제가 아니다.
Google이 Gemini 3.5 Flash를 공개했다. 플래그십급 지능과 낮은 지연시간을 결합해 에이전트·코딩 워크플로의 기본값 경쟁을 키운다.
Archestra는 AI 봇 스팸을 막기 위해 Git author 플래그와 prior contributor 설정을 조합했다. 오픈소스의 품질 관리 비용이 커지고 있다.
Semble은 grep과 파일 읽기에 의존하던 코딩 에이전트의 탐색 비용을 줄이려는 도구다. 병목은 모델보다 컨텍스트 전달 방식에 있다.
Algora 바운티를 Claude로 자동 공략한 실험은 에이전트가 돈을 벌 수 있다는 서사보다 시장 혼잡, 리뷰 병목, 기대값 문제를 더 선명하게 보여준다.
Julia Evans의 Tailwind 이탈기는 AI가 UI 코드를 대량 생성하는 시대에 CSS 구조, 의미 있는 클래스, 작은 규칙의 가치가 커진다는 신호다.
Rust로 만든 Zerostack은 거대한 IDE형 코딩 에이전트와 달리 작은 CLI, MCP, worktree 중심의 조합 가능한 개발 자동화를 제안한다.
Mitchell Hashimoto의 AI psychosis 경고는 빠른 복구만 믿는 개발 조직이 왜 더 큰 시스템 리스크를 만들 수 있는지 보여준다.
Amazon 직원들이 AI 토큰 사용량 압박 때문에 불필요한 작업을 만든다는 보도는 AI 도입 지표가 어떻게 역효과를 낼 수 있는지 보여준다.
AI로 글과 코드를 대체하다 보면 생산성은 오르지만 자기 언어와 손코딩 감각이 약해질 수 있다는 개발자들의 불안을 분석한다.
RTX 5090 eGPU를 M4 맥북 에어에 연결한 실험은 게임보다 로컬 AI 추론과 플랫폼 경계의 비용을 더 선명하게 보여준다.