Как понять, это человек такой умный или его ИИ-шница? |
||
|
МЕНЮ Главная страница Поиск Регистрация на сайте Помощь проекту Архив новостей ТЕМЫ Новости ИИ Голосовой помощник Разработка ИИГородские сумасшедшие ИИ в медицине ИИ проекты Искусственные нейросети Искусственный интеллект Слежка за людьми Угроза ИИ Атаки на ИИ Внедрение ИИИИ теория Компьютерные науки Машинное обуч. (Ошибки) Машинное обучение Машинный перевод Нейронные сети начинающим Психология ИИ Реализация ИИ Реализация нейросетей Создание беспилотных авто Трезво про ИИ Философия ИИ Big data Работа разума и сознаниеМодель мозгаРобототехника, БПЛАТрансгуманизмОбработка текстаТеория эволюцииДополненная реальностьЖелезоКиберугрозыНаучный мирИТ индустрияРазработка ПОТеория информацииМатематикаЦифровая экономика
Генетические алгоритмы Капсульные нейросети Основы нейронных сетей Промпты. Генеративные запросы Распознавание лиц Распознавание образов Распознавание речи Творчество ИИ Техническое зрение Чат-боты Авторизация |
2026-09-26 11:25 Как понять, это человек такой умный или его ИИ-шница? И что ещё за маркировка нейросетевых текстов? Пост о том, что на самом деле делает текст ИИ-шным. Увы, это не длинные тире, не кавычки-ёлочки и не короткие рубленые фразы. А та самая маркировка (водяной знак), которую создатели нейросетей договорились включать в нейротексты. На всякий случай: – Я не про маркировку, которую владельцы (и пользователи) сайтов должны будут ставить на нейротексты с момента вступления в силу закона по ИИ-шному регулированию. А я о той маркировке, которая уже сейчас содержится в текстах популярных нейросетей. О той, которую генерят сами нейросети. Как они это делают? Если помнишь, нейросеть создаёт текст не словами, а токенами (кусочками слов и слогов). Когда она формирует список вероятностей для токенов из своего словаря, тут и включается алгоритм маркировки. Он делит делит словарь ИИ-шницы на два списка: - Зеленый список — разрешенные токены. - Красный список — нежелательные токены. К слову – это не какие-то списки, которые были определены один раз и навсегда, они постоянно меняются. В механизм я ещё не до конца вникла. А дальше ключ маркировки компании Антропик делает так, что баланс деления на зелёные и красные слова смещается. Если текст писал человек, то зеленые и красные слова обычно распределятся поровну — 50 на 50 (потому что человек не знает, какие слова алгоритм считает "зелеными"). Если текст писала нейронка, то в нём будет кривой баланс — например, 80% зеленых слов и 20% красных. Ты не сможешь определить это на глаз, дружище – ведь это математический алгоритм + теория вероятностей. Вычислением кривого баланса занимаются ИИ-детекторы. Они совершенствуются с каждым днём. Если год назад мы с друзьями-писателями могли дружно поржать с того, как ИИ-детектор посчитал нейротекстом чей-то рассказ от 1990 года, то теперь это уже не смешно. Потому что сейчас детекторы вычисляют в тексте ИИ-шницу почти точно. Почти – потому что ещё бывает такое, что человеческий текст в некоторых местах примут за ИИ-шный. Но это потому что баланс словаря может сместиться и у человека – незначительно. То есть в человеческом тексте будет одна-две фразы распознаны как текст ИИ, а у реальной ИИ-шницы – большая часть или весь текст. Этот алгоритм разделения словаря на зелёные и красные слова существует с 2023 года. Сейчас разработали какой-то ещё более совершенный ключ, который пока внедрили не все создатели нейронок, но скоро он будет у всех. Когда узнала, мне было просто дико смешно с попыток некоторых людей вычислить нейротекст по кавычкам-ёлочкам и длинному тире. Ведь детекторы ВООБЩЕ не смотрят на всякие кавычки, тире и прочие знаки препинания. Они берут в расчёт только слова. Мы же сейчас только что поговорили, что маркировка, встроенная в нейротекст, работает со словарём, ты же помнишь? Так что на длину тире ей побоку. Попробуй сам детектором проверить – он знаки препинания вообще пропускает (под постом оставлю ссылки на пару хороших). Кстати, вчера заглянула на один любопытный вебинар, где говорили о "гуманизации" текстов с помощью сервиса, который ребята только что создали. А один выпускающий редактор издательства поделился, что их нагружают обязанностями проверять книги на ИИ-шность, потому что – защита чужой интеллектуальной собственности, и всё такое. Веяния времени. Наступает эра не хороших текстов, а текстов, непохожих на ИИ-шные. Гуманизированных текстов, ага ? На первый план выходит не качество, а то, увидит ли детектор в твоём тексте ИИ или нет. Лично у меня смешанные чувства от этого. С одной стороны радостно, что вычислить ИИ-шность текста теперь будет легко и есть законы, международные (ЕС в августе принял) и отечественные. С другой – грустно, что качество текста теперь не во главе угла. А тебе как такая новая эра, дружище? Что думаешь? P.S. Так, а про ритм текста не рассказала. Но с ним вот какая штука: нейронки, которые ещё не встроили маркировку от Антропик, просто создают тексты с идеальным ритмом. А этот идеальный ритм ИИ-детекторы вычисляют так же легко, как маркировку. Вот теперь у меня всё Телеграм: t.me/ainewsline Источник: vk.com Комментарии: |
|