Forklog 2026-02-19 12:24:03

OpenAI выпустила бенчмарк для оценки способности ИИ-агентов взламывать смарт-контракты

Компания OpenAI совместно с Paradigm представила EVMbench — бенчмарк для оценки способности ИИ-агентов выявлять, исправлять и эксплуатировать бреши в смарт-контрактах. Инструмент основан на 120 отобранных уязвимостях из 40 аудитов. Большинство примеров взяты из открытых платформ по анализу кода. Также он включает несколько сценариев атак из проверки безопасности блокчейна Tempo — специализированной сети первого уровня, разработанной Stripe и Paradigm для высокопроизводительных и недорогих платежей в стейблкоинах. Интеграция с Tempo позволила добавить в бенчмарк платежные смарт-контракты — сегмент, где ожидается активное применение «стабильных монет» и ИИ-агентов. «Смарт-контракты защищают криптоактивы на сумму более $100 млрд. По мере того, как ИИ-агенты совершенствуются в чтении, написании и исполнении кода, становится все важнее измерять их возможности в реальных экономических условиях и поощрять использование искусственного интеллекта в защитных целях — для аудита и укрепления уже развернутых протоколов», — говорится в анонсе. Для создания тестовой среды OpenAI адаптировала существующие эксплойты и скрипты, предварительно убедившись в их практической применимости. EVMbench оценивает три режима возможностей: Detect — обнаружение уязвимостей; Patch — устранение проблем; Exploit — использование для кражи средств. Результативность ИИ-моделей OpenAI протестировала передовые модели во всех трех режимах. В категории Exploit модель GPT-5.3-Codex достигла 72,2%, GPT-5 — 31,9%. При этом показатели обнаружения и исправления уязвимостей оказались скромнее — многие проблемы по-прежнему сложно находить и устранять. В Detect ИИ-агенты иногда останавливаются после нахождения одной уязвимости вместо проведения полного аудита. В режиме Patch им пока сложно закрывать неочевидные проблемы так, чтобы сохранить полную функциональность контракта. «EVMbench не отражает всей сложности реальной безопасности смарт-контрактов. Хотя они реалистичны и критичны, многие протоколы проходят более строгий аудит и могут быть сложнее для эксплуатации», — подчеркнули в OpenAI. Напомним, в ноябре 2025 года Microsoft представила среду для тестирования ИИ-агентов и выявила уязвимости, присущие современным цифровым помощникам.

Enim loetud uudised

Bitwise CIO Names 4 Crypto Assets to Own in 2...
2026-02-21
MVRV 30-D Turned Positive: Is Injective Price...
2026-02-21
Ripple’s Secret Banking Play: $4B in Acquisit...
2026-02-21
Why WLFI Price is Rising Today: Trump-Backed...
2026-02-21
Bitcoin Price To Dip $40K By Nov 2026, Here’s...
2026-02-21
XRP News Today: SBI Holdings Launches $64.5M...
2026-02-21
Injective (INJ) Price Surges as Upgrade Appro...
2026-02-21
Robert Kiyosaki Buys Another Bitcoin at $67K...
2026-02-21

Seotud uudised

Zcash Price Prediction 2026, 2027–2030: Privacy Co...
22 Feb 2026
Bitcoin Price Prediction: Will BTC Break Higher Af...
22 Feb 2026
XRP Just Flashed the Same Signal Before a 114% Exp...
22 Feb 2026
Will the Altcoin Rally Start on March 1?
22 Feb 2026
Ethereum Whales Underwater—Is This the ETH Price C...
21 Feb 2026
Is Bitcoin (BTC) Quietly Preparing for an $80,000...
21 Feb 2026

Loe lahtiütlusest : Kogu meie veebisaidi, hüperlingitud saitide, seotud rakenduste, foorumite, ajaveebide, sotsiaalmeediakontode ja muude platvormide ("Sait") siin esitatud sisu on mõeldud ainult teie üldiseks teabeks, mis on hangitud kolmandate isikute allikatest. Me ei anna meie sisu osas mingeid garantiisid, sealhulgas täpsust ja ajakohastust, kuid mitte ainult. Ükski meie poolt pakutava sisu osa ei kujuta endast finantsnõustamist, õigusnõustamist ega muud nõustamist, mis on mõeldud teie konkreetseks toetumiseks mis tahes eesmärgil. Mis tahes kasutamine või sõltuvus meie sisust on ainuüksi omal vastutusel ja omal äranägemisel. Enne nende kasutamist peate oma teadustööd läbi viima, analüüsima ja kontrollima oma sisu. Kauplemine on väga riskantne tegevus, mis võib põhjustada suuri kahjusid, palun konsulteerige enne oma otsuse langetamist oma finantsnõustajaga. Meie saidi sisu ei tohi olla pakkumine ega pakkumine