Ant Ling-3.0-flash официально открыт, версия FP8 всего 128 ГБ
Ant Bai Ling официально открывает веса Ling-3.0-flash, предлагая оригинальную версию BF16 и квантованную версию FP8, обе под лицензией MIT, уже доступны на Hugging Face и ModelScope, могут быть развернуты самостоятельно с помощью SGLang или vLLM. Версия BF16 занимает около 255 ГБ, версия FP8 — около 128 ГБ, объем почти вдвое меньше, FP8 сохраняет параметры с более низкой точностью, снижая порог хранения и видеопамяти. Официальные тесты показывают, что максимальная разница между FP8 и BF16 составляет 1.57 балла. Ling-3.0-flash имеет общее количество параметров 1240 миллиардов, активируя только 5.1 миллиарда за раз, поддерживает контекст в 256 тысяч токенов, в основном ориентирован на задачи Agent, такие как программирование, поиск, глубокие исследования и вызов инструментов. Официальные оценки показывают, что эта модель достигает или превышает показатели предыдущей модели Ring-2.6-1T с триллионом параметров на большинстве бенчмарков.
Цена --
Этот контент предоставляется исключительно в общих информационных целях и не является финансовым, инвестиционным, юридическим или налоговым советом. Любые мероприятия, вознаграждения, онлайн-акции или связанная с ними информация, упомянутые в настоящем документе, не должны рассматриваться как рекомендация, приглашение к покупке, продаже, торговле или иной сделке с какими-либо криптоактивами. Криптоактивы очень волатильны и могут привести к убыткам. Доступность услуг, продуктов WEEX и связанных с ними событий может варьироваться в зависимости от региона. Вы несете ответственность за обеспечение того, чтобы ваше участие соответствовало применимым местным законам и нормативным актам.
Вам также может понравиться

Аренда энергии Tron для снижения комиссий по USDT: TronBid расширяет рынок торговли

HRF финансирует 16 проектов по Bitcoin в Латинской Америке и Карибском бассейне

NVIDIA Qwen3.8-Flash-Next достигла более 16 000 токенов в секунду на платформе GB300 NVL72

GLM-5.3-Flash официально открыт, 320B параметров активируют 18B, цена в десять раз ниже GLM-5.2

Longxin и Yangtze Memory Technologies подтверждают качество с помощью Apple, расширяя рынок Северной Америки

Фонд прав человека выделил 60 миллионов сатоши на 16 проектов

Али выпустила анонс Qwen3.8-Flash-Next на основе архитектуры Qwen4

Muse Spark 1.2 Contributor версия доступна бесплатно на ограниченный срок

Microsoft устраняет уязвимость CVE-2026-69836 в Entra ID

DeepSeek применяет низкие тарифы на выходные для API вызовов

Gemini 3.7 Flash установил рекорд роста за первую неделю

Gemini 3.7 Flash цена 0,75 доллара за 1 миллион токенов, различия с официальными документами Google

DeepSeek запускает V4 Pro, Claude Fable 5 показывает на 5,3% лучше при стоимости на 4600% выше

DeepSeek V4 Pro доступен с 24 апреля

GLM-5.2 обрушивается на 95% и угрожает DeepSeek в ценовой войне ИИ

Ant Group запускает модель ИИ с 124 миллиардами параметров, превосходящую своего гиганта в 1 триллион

Flash Trade может прекратить свою деятельность, ищет варианты для продажи

Gemini 3.5 Pro задерживает выпуск, начинается подготовка к 3.7 Flash

Когда узкие места начинают мигрировать - Переписывание цен на межсоединения, HBM и всю империю хранения

Запуск Meta Muse Spark 1.2 и Muse Code по низким ценам, на 29% дешевле DeepSeek

DeepSik V4-Flash: анализ цен, в 7 раз ниже, чем у GPT-5.6 Luna

Ант Групп представила Ling 3.0 Flash с активацией 5,1 миллиарда токенов на токен

Задержка запуска Google Gemini 3.5 Pro

OpenRouter: Китайские модели занимают восемь мест в недельном рейтинге

DeepSeek обошел Google и стал лидером по количеству вызовов OpenRouter на этой неделе

Восстановление API DeepSeek, V4 Flash занимает 70%

Запуск API DeepSeek-V4-Flash на национальном суперкомпьютерном интернет-ресурсе

MiniMax H3 занимает первое место в видео редактировании, Elo и графические видео занимают второе место

Tether открывает визуальную языковую модель VisionPsy-Nano



