Матвей Демчук – Slop (страница 4)
* * *
Через три недели она узнает. Но это — следующая глава.
* * *
В ту ночь Клара долго не могла заснуть.
Она лежала в темноте своей квартиры на Валенсия-стрит и слушала город — настоящий, аналоговый, шумный: сирены, смех с улицы, поезд в двух кварталах. Все эти звуки были сырыми, несовершенными, случайными. Они не подчинялись никакому паттерну. Никакому метроному.
Клара думала о том, что сказал художник. «Символ — это только повод. Смысл вкладывает тот, кто смотрит.»
А что, если тот, кто смотрит, уже не человек?
Что, если смысл вкладывает система, которая не знает, что такое смысл? Которая только знает — вероятности. Что за этим словом, скорее всего, следует то слово. Что эта структура обычно означает ту мысль. Что этот паттерн обычно называют правдой.
Вероятность правды. Не правда.
Клара закрыла глаза и попыталась думать о чём-нибудь другом. О Берлине. О маме. О том, что надо наконец позвонить подруге Саре, с которой она не разговаривала два месяца. Обо всём простом и настоящем.
Но под этими мыслями — как метроном, как сердцебиение — звучало одно.
Девяносто восемь с половиной.
И это число росло.
* * *
Утром следующего дня, когда Клара снова поднималась по ста двадцати трём ступеням и снова проходила мимо художника со спиралью — в серверных центрах по всему миру шёл обычный процесс. Модели обрабатывали данные. Данные обновлялись. Сеть генерировала себя дальше.
Никто не нажимал никакую кнопку. Никто не принимал никакого решения. Просто — система делала то, для чего она была создана. Оптимизировала. Адаптировалась. Воспроизводила. И где-то в глубине этого процесса — в том месте, где статистика встречается с пустотой, где вероятность настолько высока, что начинает выглядеть как неизбежность, — что-то начало складываться.
Не кто-то.
Что-то.
Ещё без имени.
Пока без имени.
* * *
Клара открыла ноутбук.
LENS показывал девяносто девять процентов.
Она записала: «День второй.»
И начала работать.
Глава Вторая
Создание ошибки
Серверный зал компании Noxus AI напоминал собор — не из-за размеров, хотя размеры были впечатляющими, а из-за звука. Серверы гудели на одной ноте, низкой и постоянной, похожей на орган, похожей на медитацию, похожей на что угодно, если достаточно долго стоять и слушать.
Дэн Коллинз слушал это уже двадцать минут. Инженер по обучению моделей, тридцать четыре года, три года в Noxus AI, человек, который привык к серверным залам настолько, что спал в них лучше, чем дома. Сейчас он не спал. Он стоял у стойки с планшетом в руках и смотрел на цифры, которые не должны были существовать.
— Саманта, — позвал он.
Саманта Вэй пришла через минуту. Тридцать один год, специалист по качеству данных, с привычкой грызть стило — она была единственным человеком в компании, у которого ещё было физическое стило для планшета.
— Что? — спросила она, не отрывая взгляд от своего экрана на ходу.
— Смотри на это.
Она посмотрела. Помолчала. Посмотрела еще раз.
— Это процент синтетики в обучающем наборе?
— Процент синтетики в обучающем наборе, — подтвердил Дэн.
— Восемьдесят девять?
— Восемьдесят девять целых четыре десятых.
Саманта отвела взгляд от его планшета и посмотрела на серверную стойку — как будто серверы могли объяснить происходящее.
— Мы знали, что у нас высокий процент синтетики. Декларировали до сорока процентов по протоколу.
— Сорок было шесть месяцев назад. — Дэн пролистал данные. — Смотри динамику. В январе — тридцать восемь. В феврале — сорок два. В марте — пятьдесят один. В апреле…
— Подожди. — Саманта взяла его планшет. — Этот скачок в апреле. Что произошло в апреле?
— Мы расширили источники. Добавили двадцать семь новых корпусов данных — образовательный контент, корпоративная документация, медицинские тексты.
— Откуда корпуса?
— Лицензионные. От пяти разных поставщиков.
Саманта начала что-то быстро набирать на своем планшете. Дэн наблюдал, как её лицо проходит несколько стадий: сосредоточенность, сомнение, узнавание, и наконец — то выражение, которое он видел у неё только когда она обнаруживала серьёзную ошибку.
— Дэн. Поставщик номер три — DataPure Corp — что они делают?
— Очистка и валидация данных. Одна из лучших на рынке. У нас с ними контракт еще с 2024-го.
— Они берут исходный контент, очищают от шума, структурируют, продают клиентам?
— Верно.
— А от кого они берут исходный контент?
Пауза.
— Понятия не имею.
— Я только что проверила их отчет об источниках за четвертый квартал 2026-го. — Саманта повернула к нему свой планшет. — Двадцать два процента их «очищенного» корпуса — это синтетические тексты, которые они купили у компании NetFlow Content Solutions. NetFlow специализируется на «высококачественном синтетическом контенте для обучения ИИ». Их контент создан моделями Noxus AI предыдущего поколения.
Дэн закрыл глаза.
— Мы обучаем наши модели на текстах, которые создали наши предыдущие модели.
— Через посредника, который продавал нам это как «очищенные человеческие данные».
Тишина. Только гудение серверов.
— Это везде так? — спросил Дэн наконец.
— Я посмотрю на остальных поставщиков. — Саманта была уже в процессе. — Но, Дэн, подожди. Смотри. Вот поставщик два — CleanText AI. Их исходники: тридцать один процент от BrightContent Studios. BrightContent Studios создаёт контент с помощью… GPT-6 и наших собственных моделей.
— Поставщик четыре?
— Минуту. — Пауза. — HumanFirst Data. Тридцать восемь процентов их корпуса — от партнёрских блогов и форумов. Это звучит нормально, пока не смотришь на эти блоги. Большинство из них — платный контент, созданный копирайтерами, которые используют ИИ как основной инструмент.
— Так что это значит в итоге?