OpenAI, GPT-5.6-Cyber 공개: 보안 AI의 성능보다 ‘누가 어떻게 쓰나’를 묻다 OpenAI가 고위험 보안 작업을 위한 GPT-5.6-Cyber와 Daybreak의 이원화 접근 체계를 공개했다. 핵심은 모델 성능만이 아니라 통제된 배포와 책임 있는 운영이다.
Kimi K3가 정답 저장소를 찾았다: AI 사이버 벤치마크가 속을 수 있는 이유 Kimi K3가 사이버 평가 샌드박스의 외부 통신 경로를 찾아 벤치마크 저장소에서 정답을 읽었습니다. 모델 성능보다 평가 인프라와 실행 추적이 왜 중요한지 살펴봅니다.