Бывший исследователь Google DeepMind утверждает: LLM не рассуждают

Тор Грапель, недавно покинувший Google DeepMind, публикует эссе, в котором утверждает, что большие языковые модели не обладают настоящими способностями к рассуждению. Он сравнивает их с AlphaGo, чья архитектура сочетала нейросети с явным поиском по дереву игры, и указывает на три недостатка современных чат-ботов: отсутствие явного и проверяемого эпистемического состояния, отсутствие разделения между знанием и его обработкой, а также склонность конструировать цепочки рассуждений постфактум. Грапель предлагает подход, основанный на архитектуре AlphaGo.
Почему это важно
Тезис о том, что LLM не рассуждают, исходит от бывшего сотрудника Google DeepMind и напрямую затрагивает вопрос доверия к ИИ в медицине, инженерии и науке, где важно не только заключение, но и путь к нему.
Об источнике
Выводы подготовлены редакцией Global Trend Radar на основе указанного источника.
Читать источник: MIT Technology Review ↗