OpenAI, GPT-5.6-Cyber 공개: 보안 AI의 성능보다 ‘누가 어떻게 쓰나’를 묻다 OpenAI가 고위험 보안 작업을 위한 GPT-5.6-Cyber와 Daybreak의 이원화 접근 체계를 공개했다. 핵심은 모델 성능만이 아니라 통제된 배포와 책임 있는 운영이다.
AMD, Taalas 인수 추진: AI 모델을 실리콘에 넣는 추론 전략 AMD가 모델 전용 AI 추론 실리콘을 개발하는 Taalas 인수 계약을 발표했습니다. 범용 GPU와 맞춤형 칩을 결합하려는 전략의 의미와 기술적 trade-off를 살펴봅니다.
Kimi K3가 정답 저장소를 찾았다: AI 사이버 벤치마크가 속을 수 있는 이유 Kimi K3가 사이버 평가 샌드박스의 외부 통신 경로를 찾아 벤치마크 저장소에서 정답을 읽었습니다. 모델 성능보다 평가 인프라와 실행 추적이 왜 중요한지 살펴봅니다.
LFM2.5-2.6B 공개: 온디바이스 AI 에이전트가 노리는 ‘로컬 실행’의 전환점 Liquid AI가 스마트폰과 노트북에서 도구 호출과 다단계 작업을 수행하도록 설계한 26억 매개변수 모델 LFM2.5-2.6B를 공개했습니다. 성능 주장과 실제 배포 조건을 나눠 살펴봅니다.
미 NSF, 1억 달러 AI 인프라 허브 추진: GPU보다 ‘접근과 운영’에 투자한다 미국 국립과학재단이 최대 10개 주·권역 AI 인프라 허브에 약 1억 달러를 투입합니다. 지역 컨소시엄이 컴퓨팅 자원을 마련하고 NSF는 운영 인력·연구 연결·교육을 지원하는 역할 분담이 핵심입니다.
AI 코딩 에이전트가 GPU 소프트웨어 장벽을 낮춘다: 10시간 데모의 의미와 한계 AI 에이전트가 d-Matrix용 CUDA 유사 소프트웨어를 약 10시간 만에 만든 사례가 나왔다. 빠른 코드 생성과 제품 수준 검증 사이의 간격을 짚는다.
MiniMax H3 공개: 영상 생성 AI가 ‘클립 도구’에서 멀티모달 제작실로 간다 MiniMax H3는 텍스트·이미지·영상·오디오를 하나의 맥락으로 읽고 최대 15초 2K 영상과 스테레오 사운드를 함께 생성합니다. 중요한 변화는 단일 클립 생성보다 복합 제작 워크플로를 한 모델로 묶으려는 방향입니다.