
Открываем твой цифровой клуб…
Технологии и ИИ
Исследование маркетинговой фирмы Graphite анализировало стиль frontier-моделей ИИ и выявило множество «телей» в их текстах. По данным Graphite, в AI-генерируемом контенте встречается около 13 тысяч фраз, которые встречаются как минимум вдвое чаще, чем в текстах, созданных людьми. Такую же узкую грань называют «tell» — и набор таких признаков оказался значительно шире, чем ожидалось — они охватывают конструирование предложений и выбор слов. По итогам исследования, старые заметки вроде эм-дешей уже не работают так же явно, но модели по-прежнему прибегают к характерным способам выражения.
Само исследование опиралось на выборку около 10 тысяч статей, опубликованных до выхода ChatGPT, которая служила контрольной группой — людей. Затем исследователи заставляли разные модели ИИ переработать эти тексты из их резюме, чтобы минимизировать исходное bias. С сопоставлением образцов людей и каждой модели можно было сравнить, как часто встречаются одни и те же слова и фразы и какие общие паттерны предложений характерны для писем ИИ.
По результатам Graphite, у Claude Opus 5.5 самый сильный «tell» — слово «dependable», которое встречается в тексте в 23 раза чаще, чем у человеческих образцов. При этом Opus 5.5, хотя и избегает конструкции «это не X, а Y», продолжает говорить, что «что‑то является более чем X, это Y».
Также Opus 5.5 особенно любит объяснять, почему вещи важны, используя обороты «this matters» в 116 раз чаще, чем у человека, и «why X matters» — в 92 раза чаще. Эти примеры демонстрируют пристальное внимание модели к значимости, даже когда формулировка изменяется.
Другие фронтир‑модели показывают иные сигналы: Astra любит описывать «еще одно измерение» обсуждаемого и склонна добавлять оговорки вроде «may provide» или «can provide» определённой пользы. Самый заметный «tell» Astra — так называемая корректирующая рамка, где тему определяют как «не просто X» или как альтернативу «rather than relying on X». По данным Graphite, такие конструкции встречались более чем в 100 раз чаще в тексте Astra, чем в тексте человека.
Все фронтир‑лаборатории, похоже, учатся не полностью избавляться от эм‑дешей. В примерах Graphite Opus 5.5 использовал знак меньше эм‑даш 99% по сравнению с Opus 5. Astra — на 88% меньше по отношению к человеческому тексту, а Gemini 3.1 Pro практически исключил эм‑деши вовсе.
Несмотря на то, что отдельные «тели» меняются, в целом количество признаков остаётся примерно устойчивым. По словам Друка, главу интервью с TechCrunch, «тели не уменьшаются» — их удаётся убрать самые известные, но появляются новые, и каждый выпуск модели приносит свои уникальные признаки.
Удивительно, что признаки остаются устойчивыми, учитывая удар лабораторий по стилю, ориентированному на близость к человеку. Так, в релизе Opus 5.5 Anthropic заявлял, что модель «общается естественнее прежних моделей», и что ранние пользователи «находят её письмо более ясным и лёгким для восприятия».
OpenAI делал аналогичные заявления при выпуске версий Sol и Luna GPT‑6, обещая «больше ясности, меньше жаргона и менее странных оборотов» в текстах. Но Друк остаётся скептиком в отношении того, насколько лаборатории смогут полностью исключить характерные обороты либо выражения.
По словам Друка, общий эффект таков: «общая гипотеза такова, что лаборатории менее способны контролировать некоторые вещи, чем можно ожидать»; это гигантские модели с миллиардами параметров, у которых есть ограниченное число тестов, и «что‑то просачивается».