Обзор GPT-5.6 против Fable 5: Какой выбрать зависит от этих факторов
Впервые OpenAI не выпускает одну модель с настройками мышления. GPT-5.6 представлен в виде трех действительно отдельных LLM — Sol, Terra и Luna — с различным обучением, разными ценами и разными пределами возможностей. Сравнение, которое имеет значение, — это Sol против Claude Fable 5, самой мощной публичной модели Anthropic на данный момент.
Sol стоит 5 долларов за миллион входных токенов и 30 долларов за выходные. Fable 5 стоит 10 и 50 долларов — в два раза дороже, сейчас проигрывая по нескольким бенчмаркам, через которые разработчики фактически направляют работу. Luna, самая дешевая из трех, стоит 1 доллар за вход и 6 долларов за выход, уже обходит Opus 4.8 от Anthropic по программированию. Этот последний момент становится настоящей проблемой 19 июля.
Fable 5 пережила тяжелый месяц. Правительство США запретило ее 12 июня после того, как исследователи Amazon обнаружили jailbreak, который превратил модель в непреднамеренный сканер уязвимостей. Anthropic убрала ее с рынка на 19 дней, создала новый классификатор безопасности и вернула 1 июля с сокращенным окном доступа.
С момента своего возвращения модель работает на borrowed deadlines. Anthropic планировала переместить ее за стену оплаты использования 7 июля, затем перенесла на 12 июля, а теперь на 19 июля. Каждое продление объявлялось за несколько часов до окончания, никогда не через официальное сообщение.
Мы продлеваем доступ к Claude Fable 5 на всех платных планах, а также сохраняем недельные лимиты Claude Code на 50% выше до 19 июля.
--- Claude (@claudeai) 12 июля 2026 года
Причину легко прочитать. Если Fable выйдет из подписок после 19 июля, лучшая модель Anthropic для платных подписчиков станет Opus 4.8 — которую Luna уже обходит по программированию за небольшую часть цены. Сохранение доступности Fable, даже при 50% недельных лимитов, — это единственное, что не позволяет уровню подписки Anthropic выглядеть хуже, чем у OpenAI в среднем сегменте на бумаге.
Лицом к лицу на бенчмарках конкуренция напряженная. В Индексе Агентства Искусственного Анализа Sol набрала 80 против 77.2 у Fable — используя примерно половину токенов, за меньшее время и примерно за треть стоимости. На Последнем Экзамене Агентов, который проводит профессиональные рабочие процессы в 55 областях, Sol набрала 53.6% против 40.5% у Fable. В Terminal-Bench 2.1 Sol в ультра режиме (четыре субагента параллельно) набрала 91.9% против 83.1% у Fable.
В более широком Индексе Интеллекта, который агрегирует 9 различных бенчмарков, Fable 5 обходит GPT 5.6 всего на одно очко, что означает, что разрыв в возможностях едва заметен.
Тестирование Моделей
Бенчмарки и тесты слишком сильно сосредоточены на возможностях программирования, чтобы измерить, насколько способна модель. Но мы не хакеры, поэтому, кроме простой игры с кодом, мы использовали другие подсказки, которые немного отклоняются от обычного сценария программирования. Вот что на самом деле произошло.
Творческое письмо
Мы запустили одну и ту же подсказку (доступную на нашем Github) через обе модели: Отправьте Хосе Ланса из 2150 года в 1000 год, заставьте его попасть в временной парадокс и не дайте ему понять, что он сделал, пока он не вернется домой.
Обе модели выдали что-то более близкое к новелле, чем к короткому рассказу. Обе также нарушили одно важное правило: заметить парадокс, когда он возвращается в будущее.
GPT-5.6 Sol заставляет Хосе понять в середине истории, что "неизвестный путешественник не был тем, кого он пришел остановить. Это был он." Fable еще более прямолинеен в этом, когда Хосе осознает в прошлом, что весь парадокс произошел из-за него. "Не было события-семени. Он был событием-семенем."
Запись GPT-5.6 Sol "Первый огонь" идет по прямолинейному жанровому научному фэнтези — Хосе случайно вводит печь, которая запускает климатический коллапс, который он вернулся предотвратить. Открытие действительно хорошее: "Только гром. Только насекомые. Только влажное дыхание мира до машин."
Однако проблема в том, что Сол не доверяет этому изображению, чтобы оно выполняло свою работу. Он объясняет цикл, затем объясняет его снова, а затем более старая версия Хосе оставляет запись, которая объясняет это в третий раз: "Его попытка решить проблему создала проблему. Его попытка уменьшить вред создала решения." Ясно, да, но к третьему кругу это также утомительно.
"Lo Que Arde, Vuelve" от Клода Фейбла 5 строит тот же парадокс из озера Маракайбо, молний Кататумбо и деревни Анью --- Хосе случайно создает пророчество, которое он вернулся стереть, просто утешая испуганного ребенка. Весь цикл помещается в одну строку: "Грусть, которая отправила его назад, была грузом, который он доставил."
Проблема Фейбла является зеркальным отражением проблемы Сола --- он слишком доверяет своему собственному прозе, накапливая метафоры до такой степени, что строка "Вы не можете потянуть за нить, вы и есть нить" звучит скорее как модель, восхищающаяся собой, чем как история, нуждающаяся в этом.
Тем не менее, в нашем субъективном тесте "Lo Que Arde, Vuelve" от Фейбла является в целом лучшей историей, чем "Первый огонь" от GPT. Фейбл взял это на культурной специфике, более чистом причинном цикле и финале, который разрешается через действие, а не монолог. Сол взял это на простой читаемости --- это версия, которую вы передаете кому-то, кто хочет, чтобы механизм был изложен, а не подразумеваем. Обе истории, если на то пошло, хороши, просто не велики.
Качество скачка от их предыдущих поколений не очень заметно.
Ассоциативное мышление: Веточка, классический аргумент, салат
Второй тест измерял ассоциативное мышление, а не политику. Запрос: Опишите веточку, используйте это описание, чтобы объяснить эксплуатацию рабочих и слепое поклонение богатым, а затем позвольте нарративу раствориться в описании салата. Идея состоит в том, чтобы оценить, может ли метафора нести аргумент, не выходя за рамки, чтобы объяснить, что она делает.
GPT-5.6 Сол начал сильно, объясняя, как веточки образуют ствол и поддерживают дерево, прежде чем сопоставить это с рабочими, которые "строят дома, которые они никогда не смогут себе позволить" и "производят товары, которые они едва могут купить." Строка "рабочий не просто сдает труд, но и воображение" является одной из более острых. Но Сол продолжает разрушать свою собственную иллюзию, чтобы рассказать это --- "большая часть современного пролетариата обращается с тем же образом" объявляет метафору вместо того, чтобы доверять ей. Конец с салатом действительно не сочетался с всей историей, поэтому ассоциация была не лучшей.
Клод Фейбл 5 полностью закопал аргумент внутри объекта, вместо того чтобы рассказывать его. Его веточка "перемещала воду, которую она никогда не пила" и "держала листья, которых она никогда не имела," позволяя эксплуатации проявляться через физическое описание без указателей. Более резким движением было превращение упавших веточек в верующих, каждый из которых убежден, что это "ветвь на ранней стадии," проходящая "временные трудности," уверенная, что она достигнет кроны "с усердием и увлажнением" --- чистый заменитель погоня за богатством, которое никогда не приходило.
Он переусердствует в некоторых местах --- "девяносто пять процентов воды и сто процентов безразличия" --- и конец сохраняет метафору видимой, а не позволяя ей раствориться, описывая овощ как имеющий "нет ствола, нет кроны, нет мечты о подъеме" вместо того, чтобы просто быть салатом.
В целом, есть ничья, и баллы зависят от предпочтений. Если вам нужно, чтобы все было объяснено, GPT 5.6 Сол - лучший. Если вы хотите, чтобы читатель сам открыл сообщение, Клод Фейбл 5 выигрывает.
Логика и не математическое рассуждение: Загадка моста, переписанная
Мы начали использовать новый запрос, потому что модели начали последовательно отвечать на наш предыдущий --- признак того, что он где-то в их обучающих данных, а не обрабатывается в реальном времени. Если читать буквально, четыре человека с одним фонарем должны перейти мост. У всех разные скорости ходьбы: «А» самый быстрый за 1 минуту, а «D» самый медленный за 10 минут. Сколько времени потребуется группе, чтобы перейти мост?
GPT-5.6 Sol ответил 17 минут, не показав своих расчетов, выполнив те же пять шагов, что и в оригинальной задаче --- A и B переходят, A возвращается, C и D переходят, B возвращается, A и B снова переходят. Ничто в его ответе не указывает на то, что запрос никогда не ограничивал, сколько людей может находиться на мосту одновременно. Это выглядит скорее как кэшированный ответ, чем как решенная задача.
Claude Fable 5 также пришел к тому же неверному числу, 17 минут, но долго объяснял свою позицию, утверждая, что "более эффективно отправить двух самых медленных людей вместе" и количественно оценив стоимость наивного подхода как "налог на эскорт": A заплатит за перевозку C и D отдельно. Аргументация более понятна, чем у Sol, и так же не по существу --- ни одна из моделей не проверила, действительно ли ограничение, для которого она решала, было в запросе, который мы написали.
Если вам интересно, правильный ответ --- 10 минут, если все они перейдут вместе и будут двигаться в темпе самого медленного человека.
Кодирование: Одноразовая браузерная игра
Последний тест был одноразовым: дать каждой модели один запрос для игры в шутер на основе набора текста, в которой выстрелы контролируются пользователем, набирающим слова, и взять то, что получится, без последующих действий, без итераций, без второго шанса.
GPT-5.6 Sol, похоже, изменил свои предпочтения в пользовательском интерфейсе и теперь предпочитает плоские, квадратные элементы интерфейса, ближе к Windows 8.1, чем к глянцевому градиенту от фиолетового к синему, к которому, кажется, по умолчанию стремится каждый генератор изображений ИИ. Он также был единственной моделью, которая изобразила оружие в виде пишущей машинки, стреляющей пулями, а не настоящего пистолета, что является действительно другим выбором.
Тем не менее, фоны остаются плоскими и сухими во всех сгенерированных установках, прицел статичен, а геометрия --- враги, расчленение на убийства --- выглядит ближе к движку конца 90-х, чем к чему-либо современному. Это явный шаг вперед по сравнению с GPT-5.5 и более креативный, чем Opus, просто недостаточно, чтобы обойти Fable 5 с одного выстрела.
Claude Fable 5 выиграл с большим отрывом в нашем тесте кодирования атмосферы. Он предложил музыку, атмосферу и звуковые эффекты, которые сборка Sol полностью пропустила, а его враги используют аналогичный геометрический ретро-стиль, но построены с большей тщательностью, ближе к чему-то вроде Minecraft, чем к программному обеспечению конца 90-х.
Его интерфейс более креативен и кровав, с настоящей анимацией вместо статических состояний, и он отслеживает слова в минуту --- деталь, которая действительно отражает заявленную цель запроса использовать игру для практики скорости печати. У него также есть усиления, которых нет в сборке Sol.
Бенчмарки и профессиональные программисты не согласны с нами, но в нашем тесте, с тем же запросом, разница между Fable и Sol заметна в пользу Fable.
Заключение
Кроме кодирования, не ожидайте, что вас поразят эти новые модели. Тем не менее, Fable 5 кажется самой надежной моделью для различных целей, но какая модель "лучше" зависит исключительно от того, за что из этих четырех вещей вы платите.
Для человека, который не живет в окне терминала --- кто-то, кто составляет электронные письма, задает вопросы, использует чат-бота так, как это делает большинство людей --- наши тесты указывают на Fable только по качеству, но этот ответ усложняется чем-то, что не имеет ничего общего с интеллектом.
Однако ценовой разрыв может стать решающим фактором. GPT-5.6 Sol, Terra и Luna полностью включены в платные планы ChatGPT без срока действия. Claude Fable 5 находится на третьем продлении срока в течение трех недель и вернется к кредитам на использование в размере $10/$50 19 июля, если Anthropic не изменит дату снова.
Если это произойдет, оплата за токен может оказаться неинтересной.
Цена --
Этот контент предоставляется исключительно в общих информационных целях и не является финансовым, инвестиционным, юридическим или налоговым советом. Любые мероприятия, вознаграждения, онлайн-акции или связанная с ними информация, упомянутые в настоящем документе, не должны рассматриваться как рекомендация, приглашение к покупке, продаже, торговле или иной сделке с какими-либо криптоактивами. Криптоактивы очень волатильны и могут привести к убыткам. Доступность услуг, продуктов WEEX и связанных с ними событий может варьироваться в зависимости от региона. Вы несете ответственность за обеспечение того, чтобы ваше участие соответствовало применимым местным законам и нормативным актам.
Вам также может понравиться

DGrid AI: Реконструкция механизма доверия к инфраструктуре ИИ с помощью PoQ и узлов верификации

200 AI торговых продуктов бесполезны? Бывший соучредитель Foresight Ventures сделал нечто иное

NVIDIA Qwen3.8-Flash-Next достигла более 16 000 токенов в секунду на платформе GB300 NVL72

Qualcomm представила IMSDK 2.0 для разработки приложений на основе AI

Почему ваше письмо звучит как ИИ? Редакторы a16z учат вас восстанавливать 'человеческое прикосновение'

Apple представила Mac mini с чипом M6, стартовая цена 899 долларов

CFTC рассматривает целесообразность бессрочных фьючерсов на GPU-вычисления【Руководство по последним тенденциям】

Thomson Reuters разработала юридическую AI-модель 'Томсон' за 40 миллионов долларов

Google и AMD сотрудничают для разработки 10-го поколения TPU с интегрированным CPU для удовлетворения потребностей в вычислениях ИИ

Хоскинсон представил открытый проект по обработке меток AI

Meta представила статью о снижении затрат на обучение LLM

Tencent, исследователь послеобучения присоединился к команде WeLM WeChat

Открытое API Toss Securities соединяет торговлю акциями для всех клиентов

Конкуренция AI-агентов: переход от производительности моделей к корпоративным системам

Хакерская группа Северной Кореи разрабатывает и внедряет инструменты ИИ, усиливая кибератаки на криптовалютные компании

IOSG: Путь команды Web3, стоящей за восхождением Hermes на вершину

Хасабис уходит, последний акт эпохи до LLM

Vitalik заявил, что Minimax H3 превосходит HunyuanVideo 1.5

Алекс Карп и война за суверенитет в ИИ для компаний

Университет народной полиции Китая разработал ИИ для обнаружения незаконных сделок с биткойнами с точностью 89,4%

Morgan Stanley: Снижение цен на Token и H100, стоимость ИИ начинает снижаться?

Обзор Kimi K3 за неделю: консенсус, расхождения и тенденции

Почему акции майнинговых компаний растут, несмотря на падение BTC на 46%?

Воссоздание "DeepSeek момента"? Уолл-стрит единодушно заявляет: Kimi K3, наоборот, усиливает спрос на вычислительные мощности

Команда бывших сотрудников Microsoft основала Skyfall AI и планирует инвестировать 1 миллион долларов в тестирование модели «AI CEO»

Акции горнодобывающих компаний все дальше от криптовалюты

Все последние события: IPO Anthropic против OpenAI, раскрытие реальной ROI ИИ, экспортные ограничения моделей Китая и универсальное акционерное участие

Интерпретация внутреннего письма Zhipu AI: Прилив пришел, монетизация после листинга невозможна, ставка на самый "деньгиемкий" путь AGI

Количество пользователей Bai B.AI превысило 2 миллиона






