Направление работы
В центре сотрудничества — агенты на основе обучения с подкреплением (reinforcement learning, RL): ИИ-системы, которые учатся методом проб и ошибок. По формулировке самих участников, такие агенты способны конвертировать вычисления в новые знания.
Именно это направление обозначается как «следующий рубеж» (the next frontier) развития искусственного интеллекта.
Участники
Ineffable Intelligence — лондонская AI-лаборатория, основанная Дэвидом Сильвером, архитектором AlphaGo. На прошлой неделе компания вышла из режима закрытой разработки (stealth).
Сотрудничество с NVIDIA носит инженерный характер: совместная работа сосредоточена на инфраструктуре, необходимой для обучения RL-агентов.