LingVo.club
📖+20 XP
🎧+15 XP
+25 XP
Почему языковые модели ошибаются при умножении четырёхзначных чисел (Уровень A2) — brown wooden blocks on white surface

Почему языковые модели ошибаются при умножении четырёхзначных чиселCEFR A2

29 дек. 2025 г.

Уровень A2 – базовый / элементарный
2 мин
69 слов

Учёные изучили, почему большие языковые модели плохо умножают четырёхзначные числа. Они сравнили стандартное дообучение и метод под названием ICoT. При обычной донастройке модели с несколькими слоями давали почти нулевую точность.

Модель, обученная по ICoT, научилась хранить промежуточные суммы и дала правильные ответы — исследователи смогли декодировать текущие суммы из скрытых состояний модели. Учёные также добавили цель обучения, которая учит отслеживать суммы на каждом шаге, и это заметно помогло обычным моделям.

Сложные слова

  • дообучениедополнительное обучение модели после первоначального
  • донастройканебольшая настройка модели под конкретную задачу
    донастройке
  • умножатьвыполнять операцию умножения чисел обычно по шагам
    умножают
  • промежуточныйнаходящийся между шагами или этапами процесса
    промежуточные
  • скрытыйне видимый напрямую внутри модели
    скрытых
  • декодироватьпереводить внутренние сигналы в понятный вывод
  • точностьнасколько ответы модели правильные и близки к эталону

Подсказка: наведите, сфокусируйтесь или нажмите на выделенные слова, чтобы увидеть краткие определения прямо во время чтения или прослушивания.

Вопросы для обсуждения

  • Почему, по-вашему, отслеживание промежуточных сумм помогает моделям давать правильные ответы?
  • Как вы понимаете фразу «декодировать текущие суммы из скрытых состояний» своими словами?
  • Пробовали ли вы решать умножение большой цифры по шагам? Какие шаги вы делаете?

Похожие статьи

Новый стиль «vibe coding» и уязвимый код (Уровень A2)
24 апр. 2026 г.

Новый стиль «vibe coding» и уязвимый код

Исследователи обнаружили стиль программирования «vibe coding», который ведёт к массовой публикации уязвимого кода. Радар от лаборатории Georgia Tech просканировал более 43,000 уведомлений и нашёл множество случаев с участием ИИ.

Уровень
Как взгляд на сбережения влияет на счастье в браке (Уровень A2)
12 февр. 2026 г.

Как взгляд на сбережения влияет на счастье в браке

Исследование Университета Джорджии показало, что пары, которые видят друг друга как сберегателей, чаще сообщают о большем супружеском счастье и лучшем финансовом благополучии. Авторы отмечают: важны восприятие и разговоры о деньгах.

Уровень
Браузеры с агентами ИИ: риски для безопасности (Уровень A2)
20 июл. 2026 г.

Браузеры с агентами ИИ: риски для безопасности

Исследование Университета Вашингтона показало, что некоторые браузеры с встроенными агентами ИИ могут нарушать правило защиты сайтов и допускать кражу данных. Учёные описали два основных типа угроз и провели доказательный эксперимент.

Уровень
Африка просит больше контроля над исследованиями в здравоохранении (Уровень A2)
9 окт. 2025 г.

Африка просит больше контроля над исследованиями в здравоохранении

Снижение внешней помощи и проблемы в здравоохранении побудили африканских лидеров требовать регионального контроля над исследованиями и производством лекарств и вакцин. Делегаты в Лусаке и учёные называют RD&I ключом к безопасности и росту.

Уровень
Новый фотокаталитический материал для очистки воды (Уровень A2)
24 дек. 2025 г.

Новый фотокаталитический материал для очистки воды

Учёные создали материал, который с помощью света разрушает разные загрязнители в воде, в том числе PFAS («вечные химикаты»). Материал объединяет пористый COF и плёнку hBN и показал стабильную работу в проточных реакторах.

Уровень