Распознать текст, созданный ИИ, всё сложнее. Но, к счастью, у современных моделей всё ещё остаются «характерные привычки». Исследование маркетинговой компании Graphite выявило около 13 000 слов и фраз, которые встречаются в текстах ИИ как минимум вдвое чаще, чем в материалах людей.
Исследователи сравнили 10 000 статей, опубликованных до появления ChatGPT, с версиями этих материалов, переписанными разными ИИ-моделями.
У Claude Opus 5.5 самым заметным признаком оказалось слово «dependable» («Надежный») — оно встречается в 23 раза чаще, чем в человеческих текстах. Фраза «this matters» («Это важно») используется в 116 раз чаще, а конструкция «why X matters» («Почему X важно») — в 92 раза чаще.
У OpenAI Astra свои «особенности». Модель часто использует выражения вроде «may/can provide» («Может предоставить»). Особенно часто встречается конструкция, которую Graphite называет «исправляющей формулировкой». Например, «не просто X» или «вместо X». Такие обороты встречаются более чем в 100 раз чаще, чем в человеческих текстах.
При этом модели почти перестали злоупотреблять длинным тире, на который нынче модно указывать в качестве доказательства искусственности текста.
Источник: www.ferra.ru