Fable 5.1은 널리 주목받는 독립 AI 지수에서 1위를 차지했습니다. 그러나 실제 결정은 "1위"보다 더 복잡합니다. 이 비교에서는 공급업체 주장, 독립적 결과 및 테스트 작업 완료에 측정된 비용이라는 세 가지 다른 렌즈를 통해 Claude Fable 5.1, GPT-5.6 Sol 및 Grok 4.6을 살펴봅니다. 9월 1일 기준 주요 결과: • Fable 5.1 Max + 폴백: 66 • GPT-5.6 Sol Max: 61 • Grok 4.6 High: 61 그러나 Fable의 점수는 노력 설정에 따라 크게 달라지며 가장 높은 테스트를 거친 구성에서는 측정된 인덱스 작업 비용이 훨씬 더 높았습니다. 이러한 수치는 구독 가격이나 보편적 청구서가 아니라 한 평가자의 작업 비용 척도입니다. 다음에는 어떤 모델을 테스트해야 하며, 이 모델에 어떤 실제 역할을 부여해야 할까요? 과대 광고 없이 빠르게 움직이는 AI 뉴스를 원한다면 영상에 좋아요를 누르고 지금 AI For Everything을 구독하세요. 귀하의 지원은 성장하는 채널이 소스를 계속 확인하는 데 도움이 됩니다. Chapters 00:00 Fable 5.1의 첫 번째 질문 00:47 Anthropic의 사례 01:31 Grok과 Sol의 답변 02:10 독립 점수판 02:57 측정된 비용 파악 03:45 액세스 문제 04:20 세 가지 실용적인 레인 04:58 실제 테스트 소스 Anthropic Fable 5.1 출시: https://www.anthropic.com/claude-fable-and-mythos-5-1 Fable 5.1 모델 개요: https://platform.claude.com/docs/en/models/fable-5-1/overview Claude 계획 액세스: https://support.claude.com/en/articles/15424964-claude-fable-models-on-your-plan 인공 분석 Fable 5.1: https://artificialanalytic.ai/articles/claude-fable-5-1/ Grok 4.6 출시: https://x.ai/news/grok-4-6 GPT-5.6: https://openai.com/index/gpt-5-6/ 프로덕션 참고: 이 에피소드에서는 DJ가 승인한 양식화된 AI 아바타와 AI 지원 프로덕션을 사용합니다. DJ는 스토리를 선택 및 승인하고, 비교를 구성하고, 소스를 검토하고, 최종 편집을 승인하고, 출판을 관리합니다. 인간이 주도하고 AI가 지원합니다.