Crypto Currency Tracker logo Crypto Currency Tracker logo
Forklog 2026-07-28 13:14:27

Специализированная ИИ-модель Microsoft превзошла Mythos 5 и GPT-5.5-Cyber

Microsoft выпустила первую специализированную модель в сфере кибербезопасности MAI-Cyber-1-Flash и интегрировала ее в MDASH — систему поиска уязвимостей. По заявлению руководства компании, комплекс превосходит Mythos 5 и GPT-5.5-Cyber, обходясь при этом на 50% дешевле существующей конфигурации MDASH: GPT-5.4 + 5.4-Mini + 5.3-Codex. Связка набрала 95,95% в бенчмарке CyberGym. Тест предлагает ИИ-агентам воспроизвести 1507 известных уязвимостей в 188 проектах с открытым исходным кодом, после чего оценивает их по проценту успешно воспроизведенных ошибок в контролируемой среде. Результат вывел MDASH вперед по сравнению с GPT-5.5 Cyber (85,6%), Mythos 5 (83,8%) и GPT-5.6 Sol (83,6%). Однако, на момент написания данные не были представлены в публичном рейтинге. Источник: Microsoft. В Microsoft отметили, что MAI-Cyber-1-Flash использует гибридный подход: модель обрабатывает до 90% задач, остальные 10% наиболее сложных перенаправляет на GPT-5.4, что важно для экономии токенов. Всего в MDASH задействовано более 100 специализированных ИИ-агентов, перед которыми стоят задачи проведения аудита кода, оспаривания достоверности находок и создания Proof-of-Concept — работающего примера, подтверждающего наличие уязвимости. По словам генерального директора Microsoft Сатьи Наделлы, это первый случай, когда оптимизированная LLM Microsoft демонстрирует такой показатель эффективности: «В сочетании с MDASH модель MAI-Cyber-1-Flash обеспечивает производительность мирового уровня за 50% стоимости лидирующих моделей». На начальном этапе MDASH доступна ограниченному числу пользователей через службу Microsoft Security Exposure Management на портале Defender. Клиенты могут сканировать репозитории на GitHub, анализировать найденные уязвимости, ранжированные от «маловероятных» до «подтвержденных» и использовать Defender CLI для автоматической генерации вариантов исправления кода, которые затем передаются на проверку разработчикам. Напомним, в июле стало известно об инфраструктурных рисках в OpenAI и Anthropic. https://forklog.com/exclusive/ai/bag-baunti-konets

면책 조항 읽기 : 본 웹 사이트, 하이퍼 링크 사이트, 관련 응용 프로그램, 포럼, 블로그, 소셜 미디어 계정 및 기타 플랫폼 (이하 "사이트")에 제공된 모든 콘텐츠는 제 3 자 출처에서 구입 한 일반적인 정보 용입니다. 우리는 정확성과 업데이트 성을 포함하여 우리의 콘텐츠와 관련하여 어떠한 종류의 보증도하지 않습니다. 우리가 제공하는 컨텐츠의 어떤 부분도 금융 조언, 법률 자문 또는 기타 용도에 대한 귀하의 특정 신뢰를위한 다른 형태의 조언을 구성하지 않습니다. 당사 콘텐츠의 사용 또는 의존은 전적으로 귀하의 책임과 재량에 달려 있습니다. 당신은 그들에게 의존하기 전에 우리 자신의 연구를 수행하고, 검토하고, 분석하고, 검증해야합니다. 거래는 큰 손실로 이어질 수있는 매우 위험한 활동이므로 결정을 내리기 전에 재무 고문에게 문의하십시오. 본 사이트의 어떠한 콘텐츠도 모집 또는 제공을 목적으로하지 않습니다.