🔍 Компания OpenAI совместно с Paradigm представила EVMbench — @monocholy

1.7Kпросмотров

29.0%от подписчиков

19 февраля 2026 г.

📷 ФотоScore: 1.8K

🔍 Компания OpenAI совместно с Paradigm представила EVMbench — бенчмарк для оценки способности ИИ-агентов выявлять, исправлять и эксплуатировать бреши в смарт-контрактах. OpenAI протестировала передовые модели во всех трех режимах. В категории Exploit модель GPT-5.3-Codex достигла 72,2%, GPT-5 — 31,9%. При этом показатели обнаружения и исправления уязвимостей оказались скромнее — многие проблемы по-прежнему сложно находить и устранять. В Detect ИИ-агенты иногда останавливаются после нахождения одной уязвимости вместо проведения полного аудита. В режиме Patch им пока сложно закрывать неочевидные проблемы так, чтобы сохранить полную функциональность контракта. ➡️ Подробнее. Новости | AI | YouTube

Другие посты @monocholy