AI 요약
xAI가 Grok 4.5의 후속 모델인 Grok 4.6을 출시했다. 이 모델은 장기 실행 에이전트(long-running agents)와 복잡한 대화형·시각적 작업에 특화되어 있으며, 여러 에이전트 코딩 및 지식 작업 벤치마크에서 최고 수준의 성능을 달성했다. 특히 Artificial Analysis Intelligence Index에서 GPT-5.6 Sol과 동률을 기록했고, Cursor와 Grok Build에서 즉시 사용 가능하다. 훈련 과정에서는 Grok 4.5로 SFT 궤적을 재생성하고 개선된 옵티마이저와 훈련 레시피를 적용했다.
핵심 포인트
- Grok 4.6은 Grok 4.5 대비 확장된 보충 훈련(supplemental training)을 거쳤으며, 추론·고급 기술 개념·고품질 엔지니어링 데이터를 활용함
- Artificial Analysis Intelligence Index(9개 벤치마크 종합 점수)에서 GPT-5.6 Sol과 동률 기록
- Cursor와 Grok Build에서 출시일 기준 첫 주 동안 2배 포함 사용량(2x included usage) 제공
- 커널 최적화, 웹 개발, 컴퓨터 지원 설계(CAD) 등 도메인별 에이전트 RL 작업으로 훈련되었으며, 긴 작업 궤적에서 자체 테스트·검증 능력이 향상됨
향후 전망
- 제품 아이디어를 작업 가능한 첫 버전으로 전환하는 능력이 강화되어, 반복적 피드백 기반 개발 워크플로우에서 활용도가 높아질 것
- 안전장치가 모델 역량에 맞춰 재보정되어 취약점 패치, 엔지니어링 설계 주기 가속화 등 실사용 영역에서 유용성과 보안을 동시에 확보할 전망
출처:hackernews
