Как понять, это человек такой умный или его ИИ-шница?

МЕНЮ


Главная страница
Поиск
Регистрация на сайте
Помощь проекту
Архив новостей

ТЕМЫ


Новости ИИРазработка ИИВнедрение ИИРабота разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика

Авторизация



Как понять, это человек такой умный или его ИИ-шница? И что ещё за маркировка нейросетевых текстов?

Пост о том, что на самом деле делает текст ИИ-шным.

Увы, это не длинные тире, не кавычки-ёлочки и не короткие рубленые фразы. А та самая маркировка (водяной знак), которую создатели нейросетей договорились включать в нейротексты.

На всякий случай:

– Я не про маркировку, которую владельцы (и пользователи) сайтов должны будут ставить на нейротексты с момента вступления в силу закона по ИИ-шному регулированию.

А я о той маркировке, которая уже сейчас содержится в текстах популярных нейросетей. О той, которую генерят сами нейросети.

Как они это делают?

Если помнишь, нейросеть создаёт текст не словами, а токенами (кусочками слов и слогов).

Когда она формирует список вероятностей для токенов из своего словаря, тут и включается алгоритм маркировки.

Он делит делит словарь ИИ-шницы на два списка:

- Зеленый список — разрешенные токены.

- Красный список — нежелательные токены.

К слову – это не какие-то списки, которые были определены один раз и навсегда, они постоянно меняются. В механизм я ещё не до конца вникла.

А дальше ключ маркировки компании Антропик делает так, что баланс деления на зелёные и красные слова смещается.

Если текст писал человек, то зеленые и красные слова обычно распределятся поровну — 50 на 50 (потому что человек не знает, какие слова алгоритм считает "зелеными").

Если текст писала нейронка, то в нём будет кривой баланс — например, 80% зеленых слов и 20% красных.

Ты не сможешь определить это на глаз, дружище – ведь это математический алгоритм + теория вероятностей.

Вычислением кривого баланса занимаются ИИ-детекторы. Они совершенствуются с каждым днём.

Если год назад мы с друзьями-писателями могли дружно поржать с того, как ИИ-детектор посчитал нейротекстом чей-то рассказ от 1990 года, то теперь это уже не смешно.

Потому что сейчас детекторы вычисляют в тексте ИИ-шницу почти точно.

Почти – потому что ещё бывает такое, что человеческий текст в некоторых местах примут за ИИ-шный. Но это потому что баланс словаря может сместиться и у человека – незначительно. То есть в человеческом тексте будет одна-две фразы распознаны как текст ИИ, а у реальной ИИ-шницы – большая часть или весь текст.

Этот алгоритм разделения словаря на зелёные и красные слова существует с 2023 года. Сейчас разработали какой-то ещё более совершенный ключ, который пока внедрили не все создатели нейронок, но скоро он будет у всех.

Когда узнала, мне было просто дико смешно с попыток некоторых людей вычислить нейротекст по кавычкам-ёлочкам и длинному тире.

Ведь детекторы ВООБЩЕ не смотрят на всякие кавычки, тире и прочие знаки препинания.

Они берут в расчёт только слова.

Мы же сейчас только что поговорили, что маркировка, встроенная в нейротекст, работает со словарём, ты же помнишь? Так что на длину тире ей побоку.

Попробуй сам детектором проверить – он знаки препинания вообще пропускает (под постом оставлю ссылки на пару хороших).

Кстати, вчера заглянула на один любопытный вебинар, где говорили о "гуманизации" текстов с помощью сервиса, который ребята только что создали.

А один выпускающий редактор издательства поделился, что их нагружают обязанностями проверять книги на ИИ-шность, потому что – защита чужой интеллектуальной собственности, и всё такое.

Веяния времени.

Наступает эра не хороших текстов, а текстов, непохожих на ИИ-шные. Гуманизированных текстов, ага ?

На первый план выходит не качество, а то, увидит ли детектор в твоём тексте ИИ или нет.

Лично у меня смешанные чувства от этого.

С одной стороны радостно, что вычислить ИИ-шность текста теперь будет легко и есть законы, международные (ЕС в августе принял) и отечественные.

С другой – грустно, что качество текста теперь не во главе угла.

А тебе как такая новая эра, дружище? Что думаешь?

P.S. Так, а про ритм текста не рассказала.

Но с ним вот какая штука: нейронки, которые ещё не встроили маркировку от Антропик, просто создают тексты с идеальным ритмом. А этот идеальный ритм ИИ-детекторы вычисляют так же легко, как маркировку.

Вот теперь у меня всё


Телеграм: t.me/ainewsline

Источник: vk.com

Комментарии: