Разработана неожиданно эффективная стратегия для роботов с ИИ

Инженеры Северо-Западного университета создали алгоритм MaxDiff RL, улучшающий искусственный интеллект в робототехнике, позволяя роботам исследовать случайным образом и эффективно учиться.

Инженеры Северо-Западного университета разработали новый алгоритм искусственного интеллекта (ИИ), предназначенный специально для умных роботов. Этот новый метод помогает роботам быстро и эффективно осваивать сложные навыки, что может значительно улучшить их практичность и безопасность в различных областях, таких как беспилотные автомобили, дроны-доставщики, домашние помощники и автоматизация.

Основной преимуществом алгоритма, получившего название "Обучение с подкреплением с максимальной диффузией" (MaxDiff RL), является его способность стимулировать роботов исследовать окружающую среду наиболее случайным образом, чтобы получить разнообразный набор опыта. Эта "запланированная случайность" улучшает качество данных, собираемых роботами о их собственной среде. Благодаря использованию данных более высокого качества, моделирование роботов демонстрирует более быстрое и эффективное обучение, повышая их общую надежность и производительность.

Разработана неожиданно эффективная стратегия для роботов с ИИ

Источник: Northwestern University.

Хотя в текущем исследовании алгоритм ИИ тестировался только на смоделированных роботах, исследователи разработали NoodleBot для будущего тестирования алгоритма в реальном мире.

При тестировании на других платформах искусственного интеллекта смоделированные роботы, использующие новый алгоритм от Северо-Западного университета, всегда превосходили самые современные модели. Новый алгоритм работает настолько хорошо, что роботы могут изучать новые задачи и успешно выполнять их уже с первой попытки, что резко контрастирует с текущими моделями искусственного интеллекта, требующими более медленного обучения методом проб и ошибок.

Для обучения алгоритмов машинного обучения исследователи и разработчики используют большие объемы данных, которые тщательно фильтруются и обрабатываются. Хотя этот процесс хорошо работает для бестелесных систем, таких как ChatGPT и Google Gemini (ранее Bard), он неэффективен для встроенных систем искусственного интеллекта, таких как роботы. Роботы собирают данные самостоятельно — без роскоши кураторов-людей.

Для решения этой проблемы ученые стремились разработать новый алгоритм, который гарантирует, что роботы будут собирать высококачественные данные на ходу. MaxDiff RL приказывает роботам двигаться более хаотично, чтобы получить детальные и разнообразные данные об окружающей среде. Обучаясь на основе самостоятельного случайного опыта, роботы приобретают необходимые навыки для выполнения полезных задач.

В результате тестирования нового алгоритма, исследователи обнаружили, что роботы, использующие MaxDiff RL, учатся быстрее и более последовательно, чем другие модели. Даже более впечатляюще, они часто успешно выполняют задачи с первой попытки, даже начиная без предварительных знаний.

MaxDiff RL является универсальным алгоритмом, который может применяться в различных областях. Исследователи надеются, что это поможет преодолеть фундаментальные проблемы, замедляющие прогресс в области умной робототехники, и в итоге откроет путь к надежному принятию решений в этой области.

Читайте также

Российские ученые создали метод дешевой печати золотых наноструктур для фотоники

Российские ученые создали метод дешевой печати золотых наноструктур для фотоники

Ученые МГУ внедрили в ИИ механизм отбора важной информации

Ученые МГУ внедрили в ИИ механизм отбора важной информации

Leap Space представила напечатанный на 3D-принтере ракетный двигатель Serrano для новой ракеты Bighorn

Leap Space представила напечатанный на 3D-принтере ракетный двигатель Serrano для новой ракеты Bighorn

OpenAI впервые признала новую модель ИИ потенциально опасной из-за кибервозможностей

OpenAI впервые признала новую модель ИИ потенциально опасной из-за кибервозможностей

Робошмель сохранит стабильность полета при сильном ветре

Робошмель сохранит стабильность полета при сильном ветре

В Чите протестировали робота–ликвидатора последствий ЧС

В Чите протестировали робота–ликвидатора последствий ЧС

Ученые создали устойчивый к воздуху сверхтонкий сверхпроводник для квантовых устройств

Ученые создали устойчивый к воздуху сверхтонкий сверхпроводник для квантовых устройств

Семь секретных проектов холодной войны, изменивших современные военные технологии

Семь секретных проектов холодной войны, изменивших современные военные технологии

Робот МФТИ установил рекорд сборки головоломки «мегаминкс» за 9,6 секунды

Робот МФТИ установил рекорд сборки головоломки «мегаминкс» за 9,6 секунды

Аллергия: каковы причины возникновения, и какие капли от аллергии действительно помогут?

Аллергия: каковы причины возникновения, и какие капли от аллергии действительно помогут?

Медицинские технологии, в которые почти невозможно поверить

Медицинские технологии, в которые почти невозможно поверить

Квантовый двигатель нарушает законы термодинамики, генерируя работу и холод одновременно

Квантовый двигатель нарушает законы термодинамики, генерируя работу и холод одновременно

Отказ от сахара – не панацея: показатели сердца и веса за полгода не улучшились

Отказ от сахара – не панацея: показатели сердца и веса за полгода не улучшились

Названа реальная продолжительность тренировок, чтобы снизить риск инфаркта на треть

Названа реальная продолжительность тренировок, чтобы снизить риск инфаркта на треть

Искусство возрастом 40 000 лет: фигурки птиц ледникового периода найдены в Германии

Искусство возрастом 40 000 лет: фигурки птиц ледникового периода найдены в Германии

Дронт «разрушил» миф о собственной глупости: нейробиологи раскрыли тайны мозга истребленной птицы

Дронт «разрушил» миф о собственной глупости: нейробиологи раскрыли тайны мозга истребленной птицы