Crypto Currency Tracker logo Crypto Currency Tracker logo
Forklog 2026-07-28 13:14:27

Специализированная ИИ-модель Microsoft превзошла Mythos 5 и GPT-5.5-Cyber

Microsoft выпустила первую специализированную модель в сфере кибербезопасности MAI-Cyber-1-Flash и интегрировала ее в MDASH — систему поиска уязвимостей. По заявлению руководства компании, комплекс превосходит Mythos 5 и GPT-5.5-Cyber, обходясь при этом на 50% дешевле существующей конфигурации MDASH: GPT-5.4 + 5.4-Mini + 5.3-Codex. Связка набрала 95,95% в бенчмарке CyberGym. Тест предлагает ИИ-агентам воспроизвести 1507 известных уязвимостей в 188 проектах с открытым исходным кодом, после чего оценивает их по проценту успешно воспроизведенных ошибок в контролируемой среде. Результат вывел MDASH вперед по сравнению с GPT-5.5 Cyber (85,6%), Mythos 5 (83,8%) и GPT-5.6 Sol (83,6%). Однако, на момент написания данные не были представлены в публичном рейтинге. Источник: Microsoft. В Microsoft отметили, что MAI-Cyber-1-Flash использует гибридный подход: модель обрабатывает до 90% задач, остальные 10% наиболее сложных перенаправляет на GPT-5.4, что важно для экономии токенов. Всего в MDASH задействовано более 100 специализированных ИИ-агентов, перед которыми стоят задачи проведения аудита кода, оспаривания достоверности находок и создания Proof-of-Concept — работающего примера, подтверждающего наличие уязвимости. По словам генерального директора Microsoft Сатьи Наделлы, это первый случай, когда оптимизированная LLM Microsoft демонстрирует такой показатель эффективности: «В сочетании с MDASH модель MAI-Cyber-1-Flash обеспечивает производительность мирового уровня за 50% стоимости лидирующих моделей». На начальном этапе MDASH доступна ограниченному числу пользователей через службу Microsoft Security Exposure Management на портале Defender. Клиенты могут сканировать репозитории на GitHub, анализировать найденные уязвимости, ранжированные от «маловероятных» до «подтвержденных» и использовать Defender CLI для автоматической генерации вариантов исправления кода, которые затем передаются на проверку разработчикам. Напомним, в июле стало известно об инфраструктурных рисках в OpenAI и Anthropic. https://forklog.com/exclusive/ai/bag-baunti-konets

Feragatnameyi okuyun : Burada sunulan tüm içerikler web sitemiz, köprülü siteler, ilgili uygulamalar, forumlar, bloglar, sosyal medya hesapları ve diğer platformlar (“Site”), sadece üçüncü taraf kaynaklardan temin edilen genel bilgileriniz içindir. İçeriğimizle ilgili olarak, doğruluk ve güncellenmişlik dahil ancak bunlarla sınırlı olmamak üzere, hiçbir şekilde hiçbir garanti vermemekteyiz. Sağladığımız içeriğin hiçbir kısmı, herhangi bir amaç için özel bir güvene yönelik mali tavsiye, hukuki danışmanlık veya başka herhangi bir tavsiye formunu oluşturmaz. İçeriğimize herhangi bir kullanım veya güven, yalnızca kendi risk ve takdir yetkinizdedir. İçeriğinizi incelemeden önce kendi araştırmanızı yürütmeli, incelemeli, analiz etmeli ve doğrulamalısınız. Ticaret büyük kayıplara yol açabilecek yüksek riskli bir faaliyettir, bu nedenle herhangi bir karar vermeden önce mali danışmanınıza danışın. Sitemizde hiçbir içerik bir teklif veya teklif anlamına gelmez