GPT-5.6 обнаружил 23 из 26 уязвимостей
Модель Qwen 3.8-Max от Alibaba продемонстрировала конкурентоспособность по стоимости в тестах на обнаружение уязвимостей, однако результаты этой модели не были включены в отчет Aikido. Qwen 3.8-Max показала аналогичные результаты с конкурентными моделями при стоимости 821 доллар за три проведенных теста. Aikido протестировала 13 моделей ИИ на 26 уязвимостей в бенчмарке, опубликованном 16 июля. GPT-5.6 обнаружила 23 из 26 уязвимостей, что составило 88,5% полноты, и показала наилучший результат. Модели Claude Opus обнаружили от 15 до 18 уязвимостей, а Grok-4.5 — 20 уязвимостей. Также добавленная модель Kimi K3 обнаружила 23 уязвимости, что соответствует результату GPT-5.6. Тестирование проводилось в рамках анализа кода, разработанного для исследования реальных репозиториев кода, и оценивалось по методу 'pass@3'. Aikido представила общее количество параметров Qwen 3.8-Max в 2,4 триллиона, однако количество активных параметров не было раскрыто. Бенчмарк Aikido был нацелен на CVE общего программного обеспечения и его интерпретация как производительности аудита безопасности блокчейна затруднительна.
Цена --
Этот контент предоставляется исключительно в общих информационных целях и не является финансовым, инвестиционным, юридическим или налоговым советом. Любые мероприятия, вознаграждения, онлайн-акции или связанная с ними информация, упомянутые в настоящем документе, не должны рассматриваться как рекомендация, приглашение к покупке, продаже, торговле или иной сделке с какими-либо криптоактивами. Криптоактивы очень волатильны и могут привести к убыткам. Доступность услуг, продуктов WEEX и связанных с ними событий может варьироваться в зависимости от региона. Вы несете ответственность за обеспечение того, чтобы ваше участие соответствовало применимым местным законам и нормативным актам.
Вам также может понравиться

Рыночная капитализация CLAN на Robinhood превысила 3,52 миллиона долларов

Генеральный директор Shopify Тоби Лютке рассматривает возможность отключения Claude Code

J.P. Morgan подтвердил рейтинг "покупать" для SpaceX и целевую цену в 240 долларов

Ox Alpha зафиксировал 28,0% в оценке из 175 вопросов

NVIDIA развертывает процессор Vera CPU для ускорения агентного ИИ SpaceXAI

Еженедельный отчет ARK: AI-агенты продолжат способствовать развитию Anthropic и OpenAI, Grok 4.6 может снизить стоимость передовых AI

DHH выпустила систему Linux Omarchy 4.0

Иностранные СМИ: Оценка Anthropic при выходе на биржу может достичь 2 триллионов долларов

Публичное тестирование режима бота Hermes Agent, поддерживающего многопользовательское сотрудничество

Чистый отток средств из биткойн-ETF составил 61,16 миллиона долларов, чистый приток в эфирный ETF составил 7,37 миллиона долларов

Grok 4.6 API открыт, 1 миллион токенов от 2 долларов

Grok 4.6 выходит на финишную прямую, функциональный переключатель на сайте уже установлен

SEC США планирует ввести меры по токенизации ценных бумаг, 4 кошелька шортят BTC на 340 миллионов долларов

SpaceXAI представила Grok Bot, имитирующий командную работу AI-агентов

Утечка Cursor Grok 4.6, Маск заявил, что он будет запущен на этой неделе

Grok 4.6 получает дату запуска 7 августа, Grok 4.7 следует за ним

Запуск Grok 4.5: API B.AI с выбором поставщиков услуг и скидкой 40%

Маск заявил, что новая модель с 2T параметрами будет завершена на следующей неделе, цель — превзойти Kimi K3

Платформа X обновила план распределения доходов для создателей, удалив почти 4000 аккаунтов

Anthropic раскрывает четыре опасных поведения AI-агентов

Anthropic планирует IPO в октябре, приложение Base возвращается Coinbase

Robinhood запускает функцию торговли с помощью крипто AI Agent

Grok 4.5 превосходит Fable в бенчмаркинге

Виталик Бутерин призывает Илона Маска переделать X для управления ИИ

Маск объявил о выпуске Grok 4.5 от SpaceXAI завтра

X запускает функцию "Пользовательские временные шкалы" для пользовательских временных линий






