Crypto Currency Tracker logo Crypto Currency Tracker logo
Forklog 2026-07-28 13:14:27

Специализированная ИИ-модель Microsoft превзошла Mythos 5 и GPT-5.5-Cyber

Microsoft выпустила первую специализированную модель в сфере кибербезопасности MAI-Cyber-1-Flash и интегрировала ее в MDASH — систему поиска уязвимостей. По заявлению руководства компании, комплекс превосходит Mythos 5 и GPT-5.5-Cyber, обходясь при этом на 50% дешевле существующей конфигурации MDASH: GPT-5.4 + 5.4-Mini + 5.3-Codex. Связка набрала 95,95% в бенчмарке CyberGym. Тест предлагает ИИ-агентам воспроизвести 1507 известных уязвимостей в 188 проектах с открытым исходным кодом, после чего оценивает их по проценту успешно воспроизведенных ошибок в контролируемой среде. Результат вывел MDASH вперед по сравнению с GPT-5.5 Cyber (85,6%), Mythos 5 (83,8%) и GPT-5.6 Sol (83,6%). Однако, на момент написания данные не были представлены в публичном рейтинге. Источник: Microsoft. В Microsoft отметили, что MAI-Cyber-1-Flash использует гибридный подход: модель обрабатывает до 90% задач, остальные 10% наиболее сложных перенаправляет на GPT-5.4, что важно для экономии токенов. Всего в MDASH задействовано более 100 специализированных ИИ-агентов, перед которыми стоят задачи проведения аудита кода, оспаривания достоверности находок и создания Proof-of-Concept — работающего примера, подтверждающего наличие уязвимости. По словам генерального директора Microsoft Сатьи Наделлы, это первый случай, когда оптимизированная LLM Microsoft демонстрирует такой показатель эффективности: «В сочетании с MDASH модель MAI-Cyber-1-Flash обеспечивает производительность мирового уровня за 50% стоимости лидирующих моделей». На начальном этапе MDASH доступна ограниченному числу пользователей через службу Microsoft Security Exposure Management на портале Defender. Клиенты могут сканировать репозитории на GitHub, анализировать найденные уязвимости, ранжированные от «маловероятных» до «подтвержденных» и использовать Defender CLI для автоматической генерации вариантов исправления кода, которые затем передаются на проверку разработчикам. Напомним, в июле стало известно об инфраструктурных рисках в OpenAI и Anthropic. https://forklog.com/exclusive/ai/bag-baunti-konets

Leggi la dichiarazione di non responsabilità : Tutti i contenuti forniti nel nostro sito Web, i siti con collegamento ipertestuale, le applicazioni associate, i forum, i blog, gli account dei social media e altre piattaforme ("Sito") sono solo per le vostre informazioni generali, procurati da fonti di terze parti. Non rilasciamo alcuna garanzia di alcun tipo in relazione al nostro contenuto, incluso ma non limitato a accuratezza e aggiornamento. Nessuna parte del contenuto che forniamo costituisce consulenza finanziaria, consulenza legale o qualsiasi altra forma di consulenza intesa per la vostra specifica dipendenza per qualsiasi scopo. Qualsiasi uso o affidamento sui nostri contenuti è esclusivamente a proprio rischio e discrezione. Devi condurre la tua ricerca, rivedere, analizzare e verificare i nostri contenuti prima di fare affidamento su di essi. Il trading è un'attività altamente rischiosa che può portare a perdite importanti, pertanto si prega di consultare il proprio consulente finanziario prima di prendere qualsiasi decisione. Nessun contenuto sul nostro sito è pensato per essere una sollecitazione o un'offerta