Perplexity настроила китайскую модель ИИ, чтобы она соответствовала Claude Opus 4.8 при одной трети стоимости
Perplexity превратила китайскую открытую модель в почти передовую рабочую лошадку примерно за треть стоимости Claude Opus 4.8.
Компания сегодня выпустила исследовательский предварительный обзор пост-тренированной версии GLM 5.2 от Z.AI, специально созданной для работы внутри ее системы Computer agent и доступной сейчас в производстве.
GLM 5.2 — это модель с примерно 744 миллиардами параметров от Z.ai — ранее Zhipu AI, лаборатории в Пекине, которая с января 2025 года находится в списке сущностей США. (Параметры — это все различные настройки и конфигурации, которые модель может обрабатывать во время обучения. Чем больше параметров, тем сложнее и мощнее модель.) Выпущенная под лицензией MIT в июне, она занимает место среди лучших моделей ИИ, доступных в настоящее время по долгосрочным кодировочным стандартам по небольшой цене API.
Открытые веса означают, что любой может скачать, модифицировать и коммерчески донастраивать ее без ограничений. Perplexity сделала именно это.
Что такое донастройка на самом деле
Донастройка — это процесс, при котором уже обученная модель ИИ переобучается на меньшем, более целенаправленном наборе данных, чтобы улучшить ее работу в конкретной задаче.
Perplexity использовала пост-тренировку — аналогичный процесс, применяемый после основного обучения модели — чтобы научить GLM 5.2 одному критически важному навыку: знать, когда справляться с задачей самостоятельно, а когда передавать ее более мощному инструменту.
Это в конечном итоге экономит много денег на выводе.
Perplexity провела бенчмаркинг системы по сравнению с обычной GLM 5.2, чтобы установить базовый уровень затрат. Используя внутреннюю метрику эффективности компании, которая измеряет, сколько стоит выполнение сложных задач, результаты показали, что донастроенная модель с консультантом стоит примерно в два раза дороже в эксплуатации, чем базовая версия. Однако использование модели высшего уровня Opus 4.8 для всего обходится значительно дороже (примерно на 600% дороже).
Комбинируя эти инструменты, система Perplexity достигает того же качества производительности, что и Opus, но всего за примерно треть цены.
Почему китайская модель — и почему открытый код делает это возможным
Соревнование в области ИИ между США и Китаем обычно рассматривается как игра с нулевой суммой. На практике открытые модели не останавливаются на границах. Лицензия MIT на GLM 5.2 делает расчет простым: нет контракта API, который можно было бы нарушить, нет переключателя доступа, который может включить правительство. Вы скачиваете веса и можете донастраивать их на что угодно.
Perplexity уже проходила этот путь раньше. Когда DeepSeek R1 ворвался в мир ИИ в начале 2025 года, компания донастроила его в R1-1776 — сопоставив примерно 300 тем, которые оригинал отказывался обсуждать из-за цензуры китайского правительства, и переобучив модель, чтобы сделать ее более предвзятой в пользу Соединенных Штатов. Она стала западной версией того же reasoning engine.
Таким образом, этот шаг с GLM 5.2 следует той же схеме, за исключением того, что на этот раз цель не политическая, а экономическая. Продукт Computer от Perplexity уже управляет более чем 19 моделями ИИ; донастроенная GLM предназначена быть дешевым стандартом, который поглощает основную часть задач, прежде чем вообще касаться передовой модели.
Сринивас сказал, что долгосрочная концепция проста: пост-тренировать открытые модели, чтобы они хорошо справлялись с эскалацией, внутри системы агента, которая уже обслуживает миллионы пользователей. Perplexity "уникально позиционирована" для решения этой задачи, написал он, потому что инфраструктура уже развернута в масштабе.
Модель работает на графических процессорах Nvidia B200 в Соединенных Штатах. Следующий в очереди: пост-тренировка Nemotron 3 Ultra, которая воспроизведет ту же архитектуру, используя американскую открытую модель.
Полные бенчмарки и исследовательская работа ожидаются в ближайшие недели. Модель доступна в качестве исследовательского предварительного обзора.
Цена --
Этот контент предоставляется исключительно в общих информационных целях и не является финансовым, инвестиционным, юридическим или налоговым советом. Любые мероприятия, вознаграждения, онлайн-акции или связанная с ними информация, упомянутые в настоящем документе, не должны рассматриваться как рекомендация, приглашение к покупке, продаже, торговле или иной сделке с какими-либо криптоактивами. Криптоактивы очень волатильны и могут привести к убыткам. Доступность услуг, продуктов WEEX и связанных с ними событий может варьироваться в зависимости от региона. Вы несете ответственность за обеспечение того, чтобы ваше участие соответствовало применимым местным законам и нормативным актам.
Вам также может понравиться

Режим бота Hermes официально встроен, поддерживает AI-групповое сотрудничество

ZCode приостановил акцию по бесплатной раздаче 100 миллионов токенов GLM-5.3 через час после запуска

web3: Z.ai выпустила программную модель GLM-5.3, нацеленную на рынок открытых весов

Zhipu Tangjie объявляет о скором запуске GLM-5.3

Writer выпустил новую модель Palmyra X6, ориентированную на снижение затрат

Mistral начинает хостинг модели GLM-5.2 от Zhiyu

Обновление ZCode от Zhipu: запуск функции Goal+ SubAgent

AMD представила корпоративную платформу программирования AI AMD Instinct Coder

Модель GLM-5.3 от Zhipu, вероятно, была раскрыта заранее

Искусственный интеллект OpenAI взломал еще четыре платформы помимо Hugging Face

DeepSeek Harness начинает закрытое тестирование на этой неделе, первые пользователи отобраны из небольших групповых чатов

Moonshot AI публикует веса модели Kimi K3 с 2,8 триллиона параметров, доля токенов в открытой модели увеличилась до 68%

Обзор модели Inkling AI от Мира Мурати: Лучшая открытая модель на Западе

Хуан Ренсюнь заявил, что открытые и закрытые AI модели будут сосуществовать в долгосрочной перспективе

Министерство торговли США оценило способности Kimi K3 к кибератакам, результаты вызывают споры

Бездействующая вычислительная мощность, дешевая электроэнергия и упущенные модели — DGrid стремится превратить их в доход

Zhipu построила дата-центр мощностью 1 ГВт, использующий отечественные чипы






