AI 코딩 시대, Linear는 CI를 다시 설계했다
Linear는 테스트가 연초보다 약 4배 늘었는데도 PR 대기를 6분대에서 5분대로 줄이고 테스트당 러너 시간을 절반가량 낮췄다. AI가 코드를 빠르게 만들수록 검증 경제성이 중요해지는 이유를 짚는다.
Linear는 테스트가 연초보다 약 4배 늘었는데도 PR 대기를 6분대에서 5분대로 줄이고 테스트당 러너 시간을 절반가량 낮췄다. AI가 코드를 빠르게 만들수록 검증 경제성이 중요해지는 이유를 짚는다.
Tim Dettmers의 dlab은 소수 GPU와 로컬 장비로 125B·550B급 모델, 장기 에이전트, 자율 연구를 시연하겠다고 예고했다. 과감한 성능 주장과 작은 연구실의 전략을 검증 관점에서 분석한다.
세계적 수학자 9명이 독립 자문그룹을 만들고 AI 기업의 수학 연구 발표와 대량 결과 공개에 공개 권고를 내놓기로 했다. 검증·귀속·우선권을 함께 다룰 새 연구 거버넌스를 분석한다.
mathjs 모방 npm 패키지 3종은 특정 파스칼 행렬을 풀 때만 AES-GCM 페이로드를 복호화해 원격 명령 에이전트를 실행했다. 저장소와 배포물이 다른 공급망 공격의 방어법을 분석한다.
Georgia Tech 연구진의 Transformer Explainer는 GPT-2의 토큰화부터 어텐션·MLP·다음 토큰 확률까지 브라우저에서 풀어낸다. 생성형 AI 교육과 모델 감사에 필요한 시각적 문해력을 분석한다.
한 보안 연구자가 OpenAI 광고 픽셀의 __obi 쿠키가 외부 사이트 활동을 ChatGPT 계정과 연결할 수 있다고 주장했다. 확인된 관찰과 미확인 추론, 기업 대응을 나눈다.
Google의 오픈소스 AX는 작업·워크스페이스·네트워크·모델을 선언형 자원으로 묶는다. 에이전트 운영이 챗봇 배포와 다른 이유와 한국 기업의 도입 조건을 짚는다.
Laya-CoreML은 Apple Silicon에서 텍스트 생성 대신 분류형 결정을 확률로 반환한다. 짧은 입력의 속도·전력 이점과 96토큰 한계, 재현 조건을 함께 본다.
Pirate Face는 Hugging Face 공개 모델을 체크섬 검증 토렌트와 web-seed로 보존한다. 가용성은 높이지만 라이선스·삭제권·시드 지속성이라는 새 숙제를 만든다.
TinyBrains는 8KiB부터 크기 등급을 나눠 ONNX 신경망이 전략 게임을 플레이하게 한다. 모델 규모가 아닌 byte당 실력과 재현성을 경쟁 지표로 삼는다.