LingVo.club
📖+40 XP
🎧+25 XP
+45 XP
Языковые модели учатся различать правдоподобие (Уровень B2) — Ai letters on a glowing orange and blue background

Языковые модели учатся различать правдоподобиеCEFR B2

26 апр. 2026 г.

Адаптировано по материалам Brown University, Futurity CC BY 4.0

Фото: Zach M, Unsplash

Уровень B2 – выше среднего
4 мин
225 слов

Исследователи проверили, понимают ли современные языковые модели реальные свойства мира, учитывая, что большинство чат‑ботов обучаются на больших объёмах интернет‑текстов с фактами, ошибками и бессмыслицей. Работу подготовили сотрудники Браунского университета и представили на конференции International Conference on Learning Representations в Рио‑де‑Жанейро. Руководитель проекта, докторант Майкл Лепори, описал подход как попытку найти в моделях ограничения, похожие на причинные законы, и отметил, что внутренние состояния моделей предсказывают человеческие суждения.

В эксперименте команде показали предложения с событиями разной правдоподобности: привычные, маловероятные, невозможные и бессмысленные — например, «Кто‑то охладил напиток льдом», «...снегом», «...огнём», «...вчерашним днём». Для каждого предложения анализировали математические внутренние состояния модели; этот метод называют механистической интерпретируемостью и Лепори сравнил его с «нейронаукой для систем ИИ».

Эксперименты провели на нескольких открытых моделях, включая GPT‑2 (OpenAI), Llama 3.2 (Meta) и Gemma 2 (Google), чтобы не зависеть от одной архитектуры. Авторы нашли, что достаточно крупные модели формируют отдельные внутренние векторы, соответствующие категориям правдоподобия. Эти векторы умеют различать близкие категории, например маловероятное и невозможное, с примерно 85% точности и показывают разделённые суждения при двусмысленности, похожие на результаты опросов. Учёные отмечают, что такие векторы начинают появляться в моделях с более чем 2 миллиарда параметров, и полагают, что результаты могут помочь в создании более умных и надёжных моделей.

  • Механистическая интерпретируемость позволяет понять, что кодирует модель.
  • Внутренние векторы соответствуют человеческим суждениям о правдоподобии.
  • Результаты могут помочь создать более надёжные модели.

Сложные слова

  • механистическая интерпретируемостьметод анализа внутренних частей модели
  • векторчисловой набор значений, описывающий состояние модели
    векторы
  • правдоподобиенасколько событие похоже на реальную ситуацию
    правдоподобности, правдоподобии
  • нейронауканаука о работе и структуре мозга
    нейронаукой
  • параметрчисло или настройка внутри модели
    параметров
  • двусмысленностьналичие двух или более возможных смыслов
    двусмысленности

Подсказка: наведите, сфокусируйтесь или нажмите на выделенные слова, чтобы увидеть краткие определения прямо во время чтения или прослушивания.

Вопросы для обсуждения

  • Почему важно, что внутренние векторы модели соответствуют человеческим суждениям о правдоподобии?
  • Какие практические применения могут появиться, если модели начнут лучше различать правдоподобные и неправдоподобные события?
  • Какие ограничения или риски вы видите в использовании механистической интерпретируемости для оценки надежности моделей?

Похожие статьи

Мембрана в челюсти у предков млекопитающих (Уровень B2)
30 дек. 2025 г.

Мембрана в челюсти у предков млекопитающих

Исследование с КТ-сканами и компьютерным моделированием показало, что мембрана в изгибе челюсти древнего Thrinaxodon могла работать как барабанная перепонка. Это означает, что воздушный слух возник почти на 50 миллионов лет раньше, чем считали ранее.

Уровень
Чип, который помогает находить дипфейки при съёмке (Уровень B2)
31 мар. 2026 г.

Чип, который помогает находить дипфейки при съёмке

Исследователи создали микрочип‑сенсор, который сразу после съёмки криптографически подписывает фото, видео или аудио. Подпись показывает источник и время съёмки и помогает выявлять изменения в файлах.

Уровень
Прямые снимки двух нов показали множественные выбросы (Уровень B2)
6 дек. 2025 г.

Прямые снимки двух нов показали множественные выбросы

Астрономы получили прямые изображения двух нов через несколько дней после вспышек. Снимки, сделанные с помощью интерферометрии на CHARA Array, показали несколько потоков газа и задержанное изгнание, связанное с гамма‑излучением.

Уровень
Рамка для автоматизации терапевтической работы с помощью разговорного ИИ (Уровень B2)
21 апр. 2026 г.

Рамка для автоматизации терапевтической работы с помощью разговорного ИИ

Исследователи предложили рамку, которая разделяет автоматизацию терапевтической работы на четыре уровня и оценивает полезность и риски использования разговорного искусственного интеллекта в консультировании.

Уровень