그록 4.6 출시, 가격 안 올리고 프런티어 잡았다
그록 4.6이 공개됐습니다. 가격은 전작 그대로인데 지능 지수는 GPT-5.6 Sol과 동점, 실무 벤치마크에서는 1위입니다. 500K 컨텍스트와 에이전트 특화 전략, 그리고 스페이스X 직원 데이터 학습 논란까지, 그록 4.6 출시의 의미를 짚어봅니다.
그록 4.6이 공개됐습니다. 가격은 전작 그대로인데 지능 지수는 GPT-5.6 Sol과 동점, 실무 벤치마크에서는 1위입니다. 500K 컨텍스트와 에이전트 특화 전략, 그리고 스페이스X 직원 데이터 학습 논란까지, 그록 4.6 출시의 의미를 짚어봅니다.
클로드 오퍼스 5가 7월 24일 전 플랫폼에 출시됐습니다. 절반 가격으로 프런티어급 성능을 낸다는 앤트로픽의 주장, 벤치마크 수치와 GPT-5.6 Sol 비교, 그리고 토큰 사용량이라는 숨은 함정까지 하나씩 뜯어봤습니다.
제미나이 3.5 프로가 7월 17일 출시를 목표로 하고 있습니다. 기반 모델까지 갈아엎으며 두 번 연기한 구글이 2M 토큰 컨텍스트와 딥 씽크 추론으로 GPT-5.6을 따라잡을 수 있을지, 지금까지 확인된 정보와 남은 변수를 정리했습니다.
그록 4.5가 공개됐습니다. 입력 2달러·출력 6달러로 오퍼스 4.8의 4분의 1 가격에, 토큰 효율은 4배, 에이전트 도구 사용 벤치마크 1위까지 가져갔는데요. 벤치마크 성적표와 실제 가성비를 뜯어보고 지금 갈아탈 만한지 따져봤습니다.
GPT-5.6 솔·테라·루나가 한꺼번에 공개됐습니다. 세 모델의 가격, 속도, 벤치마크 성능을 나란히 비교하고 내 작업에 맞는 GPT-5.6 모델을 고르는 기준을 정리했습니다.
GPT-5.6 발표 창이 6월 22일 열렸습니다. 1.5M 토큰 컨텍스트와 에이전트 성능 강화 루머, 코드명 단서, 폴리마켓 89% 확률까지 지금까지 확인된 사실과 아직 확인되지 않은 부분을 차분히 정리했습니다.
Anthropic이 미토스급 모델 Claude Fable 5를 출시했습니다. 거의 모든 벤치마크 최고 성능, 절반 이하로 내린 가격, 출시 직전의 위험 경고까지 — 무엇이 달라졌고 어떤 의문이 남는지 짚어봅니다. 6월 22일까지는 Pro 플랜에서 바로 써볼 수 있습니다.
구글 I/O에서 공개됐지만 아직 안 풀린 제미나이 3.5 프로. 6월 출시가 정말 임박했는지, 2M 토큰과 Deep Think 성능은 어디까지인지, 플래시 벤치마크와 예상 가격을 근거로 짚고 솔직한 전망까지 정리했습니다.
OpenAI가 2026년 4월 공식 공개한 GPT-5.5의 핵심 업그레이드를 총정리했습니다. 1M 토큰 컨텍스트, 코딩 벤치마크 향상, 40% 줄어든 출력 토큰, 새로운 API 가격 구조까지 한눈에 살펴보세요.
Anthropic이 2026년 4월 16일 공개한 Claude Opus 4.7의 핵심 업그레이드를 총정리했습니다. SWE-bench Verified 87.6%, 비전 해상도 3배 향상, 새 xhigh 추론 모드, Claude Code 자동 모드, 가격 정책 변화까지 한 번에 살펴보세요.