GPT-6 Astra 논쟁, 숨은 추론은 성능인가 리스크인가
Sebastian Raschka가 GPT-6 Astra, looped transformers, hidden reasoning을 분석했다. 반복 깊이는 성능을 올리지만 비용, 벤치마크, 감사 가능성의 기준을 흔든다.
반복 깊이와 숨은 추론은 모델이 더 적은 외부 토큰으로 더 많은 계산을 하는 방향이다. 이는 사용자 경험을 좋게 만들 수 있지만, 운영자는 내부 계산량과 실패 경로를 더 보기 어렵게 된다.