Crypto Currency Tracker logo Crypto Currency Tracker logo
Forklog 2026-07-16 11:25:41

Nvidia автоматизировала дообучение Cosmos 3 с помощью ИИ-агента

В техническом эксперименте Nvidia точность модели Cosmos 3 Nano на тесте с четырьмя вариантами ответа выросла с 54,41% до 93,35% менее чем за сутки. Основные этапы дообучения выполнил ИИ-агент Codex по заранее подготовленным инструкциям TAO. Результат получен на одном специализированном датасете — Woven Traffic Safety от Woven by Toyota. Он содержит видео дорожных ситуаций и вопросы с четырьмя вариантами ответа. Для обучения и проверки использовали более 8000 примеров. Без дополнительной адаптации Cosmos 3 Nano правильно ответила на 54,41% вопросов. Затем разработчики попросили Codex оценить базовую модель и провести дообучение методом LoRA. Агент выбрал специализированную инструкцию Cosmos-reason, проверил аннотации датасета и обнаружил отсутствующий параметр частоты кадров. После исправления конфигурации он загрузил веса модели, подготовил настройки и запустил обучающий контейнер. https://youtu.be/9AQkVbx3fKA?si=6y1p3qZHRgeqzuEq LoRA не изменяет все параметры модели, а обучает небольшие дополнительные адаптеры. По расчетам Nvidia, в этом эксперименте метод потребовал примерно в семь раз меньше GPU-часов, чем полное дообучение Cosmos 3 Nano. Один прогон LoRA занял около 30 минут на восьми ускорителях NVIDIA A100 с 80 ГБ памяти. Точность выросла до 87,14%. Вторым промптом разработчики запустили TAO AutoML для подбора скорости обучения, размера пакета, параметров LoRA и других настроек. Система провела 43 параллельных испытания. Лучший результат с байесовской оптимизацией составил 93,35%. Этот этап занял 19,5 часа на нескольких узлах A100 в Oracle Cloud Infrastructure. Codex в эксперименте не ограничивался анализом результатов. Он выбирал рабочий процесс, проверял данные, исправлял конфигурацию, запускал контейнеры и сравнивал метрики. Автономность агента оставалась ограниченной, он действовал по заранее подготовленным инструкциям. Показатель 93,35% отражает точность ответов в проверочной части одного исследовательского датасета. Он не измеряет безопасность автономного вождения и не подтверждает способность модели принимать решения в реальном времени. https://forklog.com/exclusive/ai/depai-novyj-trend-v-ekonomike-mashin Напомним, в июне исследователи Nvidia, Carnegie Mellon University и Калифорнийского университета в Беркли представили ENPIRE — фреймворк, который позволяет ИИ-агентам для программирования улучшать политики управления роботами на реальном оборудовании.

면책 조항 읽기 : 본 웹 사이트, 하이퍼 링크 사이트, 관련 응용 프로그램, 포럼, 블로그, 소셜 미디어 계정 및 기타 플랫폼 (이하 "사이트")에 제공된 모든 콘텐츠는 제 3 자 출처에서 구입 한 일반적인 정보 용입니다. 우리는 정확성과 업데이트 성을 포함하여 우리의 콘텐츠와 관련하여 어떠한 종류의 보증도하지 않습니다. 우리가 제공하는 컨텐츠의 어떤 부분도 금융 조언, 법률 자문 또는 기타 용도에 대한 귀하의 특정 신뢰를위한 다른 형태의 조언을 구성하지 않습니다. 당사 콘텐츠의 사용 또는 의존은 전적으로 귀하의 책임과 재량에 달려 있습니다. 당신은 그들에게 의존하기 전에 우리 자신의 연구를 수행하고, 검토하고, 분석하고, 검증해야합니다. 거래는 큰 손실로 이어질 수있는 매우 위험한 활동이므로 결정을 내리기 전에 재무 고문에게 문의하십시오. 본 사이트의 어떠한 콘텐츠도 모집 또는 제공을 목적으로하지 않습니다.