НовостьНейросетиNVIDIAAI-модели

NVIDIA выпустила Cosmos 3 Edge: AI-модель для роботов работает прямо на устройстве

NVIDIA открыла Cosmos 3 Edge — компактную 4B-модель, которая помогает роботам и vision-агентам понимать окружение, рассуждать и действовать в реальном времени без облака.

Кирилл Киреев

20.07.2026 · 4 минут чтения · Нейросети

NVIDIA Cosmos 3 Edge — открытая модель для physical AI

Содержание

Что умеет NVIDIA Cosmos 3 Edge и почему релиз важен для physical AI

NVIDIA выпустила на Hugging Face Cosmos 3 Edge — открытую модель на 4 млрд параметров для роботов и систем компьютерного зрения. Она анализирует изображение с камер и других сенсоров, понимает, как меняется сцена, прогнозирует последствия действий и может генерировать команды управления прямо на локальном устройстве.

Рассуждения и управление без постоянного облака

Cosmos 3 Edge рассчитана на работу в условиях ограниченной памяти: от профессиональных RTX и DGX до GeForce RTX и модулей Jetson. На Jetson Thor модель выдаёт 32 действия за один проход и поддерживает управление с частотой 15 Гц — этого достаточно для реакции робота в реальном времени.

Архитектура объединяет авторегрессионную и диффузионную части. Первая отвечает за понимание изображения и текста, вторая — за прогнозирование видео, аудио и действий. Благодаря общей системе представлений модель связывает то, что видит робот, с движением и ожидаемым результатом: например, может выбрать действие и одновременно показать, как после него должна измениться сцена.

Открытая модель для кастомных роботов

Вместе с базовой моделью NVIDIA опубликовала Cosmos 3 Edge Policy для задач захвата и перекладывания предметов, а также скрипты для дообучения. Разработчики смогут адаптировать систему под склады, производство, медицину, умную инфраструктуру и собственные роботизированные устройства, а затем запускать её рядом с камерами и приводами без задержек облачного API.

Что релиз даёт AI-креаторам и бизнесу

Cosmos 3 — это не только робототехника. В набор вошёл дистиллированный чекпойнт Cosmos 3 Super 4-Step для генерации изображений и видео: он сокращает диффузионный процесс с 35–50 шагов до четырёх и, по данным NVIDIA, ускоряет инференс до 25 раз при сохранении качества. Для креативных и продуктовых команд это означает более быстрые эксперименты с симуляциями, синтетическими данными и специализированной AI-генерацией.

Релиз показывает общий тренд: мультимодальные модели переходят от простого распознавания контента к связке «увидеть — спрогнозировать — выполнить действие». Для бизнеса особенно важны открытые веса и локальный запуск — они упрощают кастомизацию, снижают зависимость от облака и помогают держать чувствительные данные внутри инфраструктуры.

Хочешь узнавать первым о таких новостях?

Переходи в наш телеграм канал где мы ежедневно публикуем самые свежие и интересные новости

Чиби Новости