anthropic

Анализ обучения Claude Fable 5: почему модель выбирает готовые шаблоны

Claude News

anthropic

Технический разбор работы Claude Fable 5 показал, что модель опирается на заранее выученные цепочки действий, а не на дедуктивный поиск. В ходе эксперимента с математической игрой Summle модель потратила 60 тысяч токенов на перебор вариантов, прежде чем переключилась на систематический метод решения. Это указывает на то, что Fable 5 обучена через дистилляцию успешных путей, а не через развитие универсального алгоритма поиска.

Такой подход делает модель эффективной в задачах с предсказуемой структурой, например, в написании кода, где существуют канонические последовательности. Однако в задачах, требующих поиска решения с нуля, модель демонстрирует хрупкость, пытаясь применить заученные шаблоны там, где они не работают.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.