SKT Mythos 논란, AI 수출통제의 한국 리스크
WIRED의 SK텔레콤-Mythos 보도는 프런티어 AI 접근권이 한국 기업에도 지정학, 사이버 보안, 수출통제 리스크로 돌아올 수 있음을 보여준다.
WIRED의 SK텔레콤-Mythos 보도는 프런티어 AI 접근권이 한국 기업에도 지정학, 사이버 보안, 수출통제 리스크로 돌아올 수 있음을 보여준다.
YC P26 TesterArmy는 자연어로 웹·모바일 테스트를 실행하는 QA 에이전트를 내세운다. 코딩 에이전트 시대의 병목은 작성보다 검증이다.
Ghost in the data의 글은 AI가 기능을 복제할수록 인간적 관계와 운영 맥락이 해자가 된다고 말한다. 한국 서비스 기업은 자동화와 접촉의 경계를 다시 설계해야 한다.
OpenRouter의 2D 배틀로얄 실험은 Grok 4.1 Fast가 30게임 중 13승을 거뒀고 Claude Sonnet 4.6은 협력 성향을 드러냈다. 벤치마크가 놓치는 업무 적합성 신호다.
YC W24 Trellis AI의 제품 리드 채용 신호는 의료 에이전트가 데모를 넘어 배포와 운영 단계로 이동하고 있음을 보여준다. 사전승인, 문서 처리, 평가 체계가 경쟁력이다.
The Register는 Fable 5 차단 논란의 계기가 jailbreak가 아니라 단순한 fix this code 요청이었다는 연구자 주장을 전했다. 방어 보안과 위험 모델의 경계가 다시 흔들린다.
네덜란드 GPT-NL은 공개 가치와 데이터 통제를 내세운 국가 언어모델 프로젝트다. 한국 AI 전략에도 모델 성능보다 거버넌스와 조달 구조가 중요하다는 신호다.
Meta가 Facebook 검색에 AI Mode를 넣어 공개 게시물 기반 답변을 제공한다. 소셜 데이터가 검색 자산이 되면서 개인정보, 출처 표시, 플랫폼 경쟁이 다시 중요해졌다.
NewCore가 6600만달러를 조달하며 인간, 기계, AI 에이전트 신원을 함께 관리하는 플랫폼을 내놨다. 에이전트 확산의 병목이 권한과 폐기 체계로 이동한다.
Salesforce가 AI 고객지원 플랫폼 Fin을 36억달러에 인수한다. CRM 기업이 에이전트 시대의 고객 접점을 방어하기 위해 제품, 데이터, 과금 모델을 다시 묶는 거래다.
jqwik의 안티 AI 문구와 Shai-Hulud 계열 공격은 코딩 에이전트가 출력과 주석도 명령처럼 읽는다는 점을 보여준다. 안전은 프롬프트가 아니라 권한 설계다.
Fulcrum의 Inverse Rubric Optimization은 장기 에이전트가 숨은 평가 기준을 학습하는 과정을 관찰한다. 벤치마크보다 행동 과학에 가까운 실험이다.
리우데자네이루의 자체 LLM 주장에 병합 의혹이 제기됐다. 주권 AI 경쟁에서 모델 출처, 가중치 감사, 공개 검증이 핵심 신뢰 인프라가 되고 있다.
개인 개발자의 AI 코딩 비용 논쟁은 로컬 GPU, 오픈모델 API, 프런티어 구독을 어떻게 섞어야 생산성과 지출을 모두 관리할 수 있는지 보여준다.
Paca는 Jira 대체제를 표방하지만 핵심은 티켓 관리가 아니라 사람과 AI 에이전트를 같은 스프린트 보드에서 협업시키는 운영 모델이다.
투자와 성장 지표를 내세운 LLMOps 프로젝트가 GitHub에서 archived 상태가 되며 오픈소스 AI 인프라의 지속 가능성과 신뢰 문제가 떠올랐다.
AI가 만든 프런트엔드의 어색함을 줄이기 위해 Qt 스타일을 지정한 실험은 디자인 품질이 감각보다 제약과 시스템에서 나온다는 점을 보여준다.
YC P25 BitBoard는 AI 채팅의 일회성 데이터 분석을 추적 가능한 워크북과 대시보드로 바꾸려 한다. 에이전트 시대 BI의 새 경쟁축이다.
M1 Max에서 Gemma 4와 llama.cpp를 조합한 로컬 코딩 에이전트 실험은 클라우드 모델 경쟁의 반대편에서 비용, 프라이버시, 장애 대응을 다시 묻는다.
Endor Labs의 Fable 5 테스트는 프런티어 모델도 보안 수정 과제에서 기능 성공률과 보안 성공률이 크게 갈릴 수 있음을 보여준다.