LingVo.club
📖+30 XP
🎧+20 XP
+35 XP
Языковые модели меняют оценки текстов по автору (Уровень B1) — three white disc on brown surface

Языковые модели меняют оценки текстов по авторуCEFR B1

25 нояб. 2025 г.

Уровень B1 – средний
3 мин
147 слов

Исследование из University of Zurich показывает: большие языковые модели меняют свои суждения о тексте, если им говорят, кто его написал. Исследователи Федерико Джерманни и Джованни Спитале протестировали четыре модели — OpenAI o3-mini, Deepseek Reasoner, xAI Grok 2 и Mistral. Каждая модель сгенерировала по пятьдесят повествовательных утверждений по 24 спорным темам, а затем оценивала эти утверждения в разных условиях.

Когда информация о источнике отсутствовала, модели в целом были согласны друг с другом — согласие превышало 90%. Но при назначении вымышленного автора согласие резко падало и иногда исчезало, хотя текст не менялся. Особенно заметна была антикитайская предвзятость во всех моделях, включая Deepseek. Deepseek снижал согласие в вопросах Тайваня до 75%, ожидая другую точку зрения у китайского автора.

Авторы предупреждают, что такие предубеждения могут повлиять на модерацию контента, найм, академическое рецензирование и журналистику. Они призывают к прозрачности и управлению и рекомендуют использовать модели как помощников в рассуждении, а не как судей.

Сложные слова

  • предвзятостьСудебное мнение, основанное на предвзятых факторах.
    предвзятые
  • учёныйЧеловек, который изучает науку.
    Учёные
  • согласиеСовпадение мнений или выборов между людьми.
  • прозрачностьЧеткость и открытость информации.

Подсказка: наведите, сфокусируйтесь или нажмите на выделенные слова, чтобы увидеть краткие определения прямо во время чтения или прослушивания.

Вопросы для обсуждения

  • Как можно предотвратить предвзятости в оценке текстов?
  • Почему важна прозрачность в системах оценки?
  • Какие проблемы могут возникнуть из-за предвзятостей?

Похожие статьи

ИИ-модерация и невидимые языки Африки (Уровень B1)
20 апр. 2026 г.

ИИ-модерация и невидимые языки Африки

Модерация контента на основе искусственного интеллекта плохо понимает большинство африканских языков. Это приводит к ложным удалениям и к тому, что вредный контент остаётся в сети, а исследователи и платформы ищут решения.

Уровень
Разговоры исчезают: исследование о снижении устной речи (Уровень B1)
31 мар. 2026 г.

Разговоры исчезают: исследование о снижении устной речи

Исследование в Perspectives on Psychological Science показывает, что люди ежегодно теряют 338 произнесённых слов и что спад идёт как минимум полтора десятилетия. Учёные обсуждают, какие последствия это может иметь для общения и связей.

Уровень
Топ‑10 научных новостей года от Futurity (Уровень B1)
31 дек. 2025 г.

Топ‑10 научных новостей года от Futurity

В конце 2025 года Futurity опубликовал подборку десяти заметных новостей о научных исследованиях. Материалы охватывают ветеринарную медицину, энергию, археологию, нейронауки и экологическое здоровье; читателям предложили вернуться в 2026 году.

Уровень
ИИ‑прогнозы помогают фермерам при муссоне (Уровень B1)
30 окт. 2025 г.

ИИ‑прогнозы помогают фермерам при муссоне

ИИ‑модели, в частности NeuralGCM, заранее предсказали паузу в муссоне и этим летом дали прогнозы 38 миллионам фермеров в Индии. Результаты стимулируют расширение проекта и поддержку метеорологов в других странах.

Уровень
У многих собак в США встречаются признаки страха (Уровень B1)
15 мая 2026 г.

У многих собак в США встречаются признаки страха

Анализ данных владельцев показывает, что признаки страха или тревоги часто наблюдаются у домашних собак в США. Исследование указывает на обычные триггеры, возможный вред длительного стресса и необходимость ранней проверки поведения.

Уровень