Маркирование текстов, созданных нейросетью: от стеганографии до SynthID-Text
Как нейросети могут незаметно маркировать сгенерированный текст без скрытых символов и метаданных? Разбираем путь от классической и лингвистической стеганографии до современных LLM-watermarking методов: green/red tokens, псевдослучайные функции, энтропию, Tournament Sampling и SynthID-Text, а также способы обнаружения, ограничения и устойчивость маркирования к редактированию и перефразированию. Прочитать статью полностью