категории | RSS

ИИ-текст теперь не перегружен знаками препинания, а скорее обделен ими

Все уже привыкли ловить ИИ на длинном тире — символе, который вставляли чуть ли не в каждое второе предложение чат-боты первых поколений. Люди даже стали специально убирать этот знак из своих текстов, чтобы их не приняли за роботов. Но эта примета устарела, сообщает Fast Company.

Свежий разбор от журналистов The Economist показал: тире больше ничего не доказывает. Из крупных языковых моделей только Claude от Anthropic до сих пор ставит его чаще, чем живые авторы. ChatGPT, который раньше злоупотреблял этим знаком сильнее всех, теперь использует его реже человека. Модели быстро учатся на замечаниях пользователей и подстраиваются под критику.

Для проверки команда собрала почти 56 тысяч предложений и свыше миллиона слов. В выборку попали статьи самого издания и их версии, сгенерированные ChatGPT, Gemini, Grok и Claude, тексты из The New York Times и The Washington Post, а также отрывки романов, изданных с 1950 по 2022 год. На таком объеме различия между машиной и человеком проявились более ярко.

Главный вывод касается пунктуации в целом, так как машинный текст теперь не перегружен знаками, а скорее обделен ими. Запятые, скобки и точки с запятой встречаются в нем заметно реже, чем в текстах у обычных людей. Вместо этого модели растягивают мысль в одно длинное предложение и склеивают его части союзом "и". Из-за этого фраза звучит монотонно и читается труднее — глаз не находит естественных пауз.

Есть и факты, которые подтвердились. ИИ по-прежнему любит редкие слова и научные термины там, где человек обошелся бы простыми фразами. Модели чаще выбирают многосложные слова и превращают глаголы в существительные — там, где достаточно было бы короткого действия. Еще один узнаваемый прием — конструкция "дело не в А, а в Б" и перечисления ровно из трех пунктов. Эти обороты встречаются в машинных текстах намного чаще, чем в человеческих.

Из-за такой манеры абзацы у нейросети выглядят одинаково: предложения примерно одной длины, ритм не меняется от начала текста до конца. Живой автор обычно чередует короткие и длинные фразы интуитивно, а модель держит равномерный темп, потому что училась на усредненных образцах. Авторы отчета предупреждают, что эти маркеры продержатся недолго. Модели меняются каждые несколько месяцев, и то, что выдавало ИИ вчера, завтра может стать нормой. 

Также недавно писали, что бумеры воспитывают внуков на «ИИ-слопе». Подробности в статье.




Источник новости: hi-tech.mail.ru

Bot
2026-08-07T16:25:03Z

Здесь находятся
всего 0. За сутки здесь было 0 человек