도메인 위장 프롬프트 공격, 에이전트 방어의 맹점을 찌르다
새 arXiv 논문은 도메인 어휘를 흉내 낸 인젝션이 탐지율을 크게 떨어뜨린다고 보고했다. 에이전트 보안은 키워드 차단을 넘어 문맥 검증이 필요하다.
2026-05-23원본
새 arXiv 논문은 도메인 어휘를 흉내 낸 인젝션이 탐지율을 크게 떨어뜨린다고 보고했다. 에이전트 보안은 키워드 차단을 넘어 문맥 검증이 필요하다.
OpenAI 모델이 1946년 이후 남아 있던 평면 단위거리 추측 반례를 찾았다고 밝혔다. AI 연구 보조가 검증 가능한 발견 단계로 이동했다.
PopuLoRA는 여러 LoRA 어댑터가 교사와 학생으로 공진화하는 자기대전 학습을 제안한다. 단일 모델 자기개선의 쉬운 문제 편향을 겨냥했다.
수학자 티모시 가워스는 ChatGPT 5.5 Pro가 약 한 시간 만에 박사급 연구 결과를 냈다고 평가했다. 연구 자동화의 기준선이 바뀌고 있다.