Crypto Currency Tracker logo Crypto Currency Tracker logo
Forklog 2026-07-28 13:14:27

Специализированная ИИ-модель Microsoft превзошла Mythos 5 и GPT-5.5-Cyber

Microsoft выпустила первую специализированную модель в сфере кибербезопасности MAI-Cyber-1-Flash и интегрировала ее в MDASH — систему поиска уязвимостей. По заявлению руководства компании, комплекс превосходит Mythos 5 и GPT-5.5-Cyber, обходясь при этом на 50% дешевле существующей конфигурации MDASH: GPT-5.4 + 5.4-Mini + 5.3-Codex. Связка набрала 95,95% в бенчмарке CyberGym. Тест предлагает ИИ-агентам воспроизвести 1507 известных уязвимостей в 188 проектах с открытым исходным кодом, после чего оценивает их по проценту успешно воспроизведенных ошибок в контролируемой среде. Результат вывел MDASH вперед по сравнению с GPT-5.5 Cyber (85,6%), Mythos 5 (83,8%) и GPT-5.6 Sol (83,6%). Однако, на момент написания данные не были представлены в публичном рейтинге. Источник: Microsoft. В Microsoft отметили, что MAI-Cyber-1-Flash использует гибридный подход: модель обрабатывает до 90% задач, остальные 10% наиболее сложных перенаправляет на GPT-5.4, что важно для экономии токенов. Всего в MDASH задействовано более 100 специализированных ИИ-агентов, перед которыми стоят задачи проведения аудита кода, оспаривания достоверности находок и создания Proof-of-Concept — работающего примера, подтверждающего наличие уязвимости. По словам генерального директора Microsoft Сатьи Наделлы, это первый случай, когда оптимизированная LLM Microsoft демонстрирует такой показатель эффективности: «В сочетании с MDASH модель MAI-Cyber-1-Flash обеспечивает производительность мирового уровня за 50% стоимости лидирующих моделей». На начальном этапе MDASH доступна ограниченному числу пользователей через службу Microsoft Security Exposure Management на портале Defender. Клиенты могут сканировать репозитории на GitHub, анализировать найденные уязвимости, ранжированные от «маловероятных» до «подтвержденных» и использовать Defender CLI для автоматической генерации вариантов исправления кода, которые затем передаются на проверку разработчикам. Напомним, в июле стало известно об инфраструктурных рисках в OpenAI и Anthropic. https://forklog.com/exclusive/ai/bag-baunti-konets

Прочтите Отказ от ответственности : Весь контент, представленный на нашем сайте, гиперссылки, связанные приложения, форумы, блоги, учетные записи социальных сетей и другие платформы («Сайт») предназначен только для вашей общей информации, приобретенной у сторонних источников. Мы не предоставляем никаких гарантий в отношении нашего контента, включая, но не ограничиваясь, точность и обновление. Никакая часть содержания, которое мы предоставляем, представляет собой финансовый совет, юридическую консультацию или любую другую форму совета, предназначенную для вашей конкретной опоры для любых целей. Любое использование или доверие к нашему контенту осуществляется исключительно на свой страх и риск. Вы должны провести собственное исследование, просмотреть, проанализировать и проверить наш контент, прежде чем полагаться на них. Торговля - очень рискованная деятельность, которая может привести к серьезным потерям, поэтому проконсультируйтесь с вашим финансовым консультантом, прежде чем принимать какие-либо решения. Никакое содержание на нашем Сайте не предназначено для запроса или предложения