Cursor увеличивает производительность обучения модели смешанных экспертов на 41%
AI инструмент для кодирования Cursor улучшил технологии обучения модели смешанных экспертов (Mixture-of-Experts, MoE), увеличив общую производительность на 41% в среде с 512 графическими процессорами NVIDIA GB300. Эта технология уменьшает узкие места в обучении, выполняя передачу данных и вычисления одновременно между графическими процессорами. 5 числа Cursor опубликовал открытый исходный код ядра для обучения модели смешанных экспертов под названием 'Mixture-of-Kittens (MoK)', утверждая, что в тестах с одним слоем смешанных экспертов он показал производительность до 2,37 раза быстрее, чем альтернативы на рынке. Модель смешанных экспертов включает несколько сетей экспертов и вызывает только некоторые из них в зависимости от входных данных, что позволяет увеличить масштаб модели, уменьшая при этом объем вычислений. Однако, когда эксперты распределены по нескольким графическим процессорам, увеличивается время ожидания передачи данных и вычислений. Эта технология сосредоточена на одновременной обработке передачи данных и вычислений, чтобы сократить время ожидания. На официальном блоге Cursor и на GitHub не было подтверждено никаких объявлений с таким же названием, а цифры 41% и 2,37 раза основаны на сообщениях от Dongchul Biting. Ранее Cursor сообщал, что производительность слоя смешанных экспертов для графических процессоров Blackwell увеличилась в 3,5 раза, а общая скорость обучения - в 1,5 раза. Эта технология может повлиять на блокчейн-компании, использующие AI-агентов и инструменты автоматизации кода.
Цена --
Этот контент предоставляется исключительно в общих информационных целях и не является финансовым, инвестиционным, юридическим или налоговым советом. Любые мероприятия, вознаграждения, онлайн-акции или связанная с ними информация, упомянутые в настоящем документе, не должны рассматриваться как рекомендация, приглашение к покупке, продаже, торговле или иной сделке с какими-либо криптоактивами. Криптоактивы очень волатильны и могут привести к убыткам. Доступность услуг, продуктов WEEX и связанных с ними событий может варьироваться в зависимости от региона. Вы несете ответственность за обеспечение того, чтобы ваше участие соответствовало применимым местным законам и нормативным актам.
Вам также может понравиться

Али выпустила анонс Qwen3.8-Flash-Next на основе архитектуры Qwen4

B.AI запустила бесплатный доступ к полумодели MiMo-V2.5 от Xiaomi

Alibaba Qwen 3.8-2.4T-A95B, выпущен в Китайскую Чосан Интернет

DeepSeek V4 Pro доступен с 24 апреля

WeChat представил серию моделей WeLM, способствующих внедрению AI-приложений

NVIDIA открывает исходный код модели Nemotron 3.5 Lightning, специально разработанной для вызова инструментов Agent

Ant Group запускает модель ИИ с 124 миллиардами параметров, превосходящую своего гиганта в 1 триллион

Ант Групп представила Ling 3.0 Flash с активацией 5,1 миллиарда токенов на токен

Хуан Жэньсюн, Kimi K3 и надвигающаяся война с открытым исходным кодом

Mira Murati представила открытый большой модель Inkling на OpenRouter

AMD выпустила полностью открытый MoE большой модели Instella-MoE с количеством параметров 16 миллиардов

Poolside выпустила открытый 1180 миллиардов параметров модель Laguna S 2.1, которая в самотестировании превзошла DeepSeek

8 лет «друзей»: блогер Император признался, что его обманул Сунь Цзэюй на десятки миллионов

Hash Global: Кто подхватит эстафету следующего бычьего рынка после BTC?

Пересмотр дела разработчика Tornado Cash Романа Шторма отложен до апреля 2027 года

Что означает «нишевый рынок» золота?

Исторически уникальный: актив с 100% коэффициентом выигрыша за 4 года

Потенциальные налогооблагаемые операции с криптоактивами в 2025 году составят около 73 трлн иен — Chainalysis

Расходы по картам в долларах: как лучше всего оплатить счет и избежать дополнительных сборов

Аппаратный контроль Anthropic AI достигает 99,3% успеха в тестах

Перевод BTC с Kraken: 843 биткойна покидают биржу, неизвестный кошелек

Стейблкоин евро на Ethereum: 579 миллионов, более чем в два раза больше, чем у Solana и Base

Alliance: AI Agent — это недостающий элемент Web3

28 августа: Возможность того, что биткойн превысит рыночную капитализацию золота, прогноз основателя Binance

DeFi Development расширяет свои запасы до 2,33 миллиона SOL, возобновив покупку Solana

«Как я чуть не потерял половину своих биткойнов (и Kimi K3 спас меня)»: пользователь Ledger

Mirae Asset нацеливается на бизнес с цифровыми активами в 109 миллиардов долларов

SBI инвестирует 43 миллиарда иен в индонезийскую компанию Ajave и начинает сотрудничество в области криптовалюты

Регуляторы банков США исключили репутационные риски, возобновив обсуждение дебанкинга







