Великое сокращение информации

  Великое сокращение информации:
что останется от человеческого знания, когда верумика сменит антиверумизм

    Истина одна — ложь множественна

  Это не красивая фраза, а структурный факт. Если истина — это функция, отображающая деяние в воздаяние, то у этой функции есть только один правильный вид: Y=X.
  Воздаяние равно деянию. Справедливость — тождество. Всё.

  А сколько существует несправедливых функций? Бесконечно много. Любое отклонение от Y=X — это несправедливость:
 
  - Y=R(случайное число)+Z(независимая от деяния переменная),
  - Y=2XR,
  - Y=0,5XZ,
  - Y=X+Z^2,
  - Y=sin(X)exp(ZR),…

  Каждая из них описывает мир, в котором человек не имеет полной власти над качеством своей жизни. Каждая порождает свою «науку» — свою систему объяснений, свою картину мира, свою методологию, свой язык. И все они, кроме одной, ложны.

  Отсюда следует простая, но ошеломляющая вещь: объём ложного знания принципиально неограничен, а объём истинного — фиксирован.
  Ложь ветвится, истина — нет. И когда антиверумизм — совокупность всех интеллектуальных построений, основанных на несправедливых функциях, — будет заменён верумикой, человеческое знание не расширится. Оно сожмётся. Радикально.

    Антиверумическая гора: сколько знаний у человечества сейчас

  Чтобы оценить масштаб будущего сокращения, нужно сначала понять, сколько «знания» накоплено сегодня.

  К 2025 году общий объём данных в мире достиг примерно 175 зеттабайт — это
175;10^21 байт.
  Ежедневно создаётся около 496 миллионов терабайт новых данных. В интернете насчитывается около 1,5 миллиарда веб-сайтов, из которых активны примерно 218 миллионов. Пользователей — 6,12 миллиарда, почти 74% населения планеты.

  Но это всё — данные, а не знание. Видео составляет около 65% всего интернет-трафика. Социальные сети, игры, коммерция, развлекательный контент — всё это не имеет отношения к науке и истине.
  Если выделить только ту часть, которая претендует на статус знания — научные публикации, учебные материалы, энциклопедии, справочники, — получится крошечная доля процента от зеттабайтной горы.

  Научная литература растёт экспоненциально: ежегодно публикуется около 2–3 миллионов рецензируемых статей примерно в 28 000 журналах, а общий объём научных публикаций удваивается каждые 13–15 лет. За всю историю науки накоплено, по разным оценкам, 100–200 миллионов статей.

    Но сколько из этого — истинно?

  Кризис воспроизводимости: ложь, которая цитируется лучше правды

  Джон Иоаннидис в своей знаменитой статье 2005 года доказал математически: большинство опубликованных научных результатов, скорее всего, ложны.
  Причины — системные: малые выборки, смещение в сторону положительных результатов, финансовые интересы, гибкость в выборе методов.
  По его модели, даже для хорошо спланированного исследования вероятность того, что опубликованный положительный результат окажется верным, не превышает 85%, а для поисковых исследований с массовым тестированием — падает до долей процента.

  Эмпирические данные подтверждают мрачную картину. Крупномасштабный проект по воспроизведению исследований в психологии показал: только 36% опубликованных значимых эффектов удалось воспроизвести, причём размер эффектов в среднем составил половину от исходного. В социальных науках — 25% успешных воспроизведений. В экономике — 61%. Даже в Nature и Science — только 62%.

  Опрос 1576 исследователей, проведённый Nature, показал: более 70% учёных пытались и не смогли воспроизвести чужие эксперименты, более половины — не смогли воспроизвести собственные. 52% согласились с тем, что кризис воспроизводимости существует.

  Самое поразительное: статьи, результаты которых не воспроизводятся, цитируются в среднем в 153 раза больше, чем воспроизводимые. В журналах Nature и Science невоспроизводимые статьи цитируются в 300 раз чаще. Ложь распространяется быстрее истины. Это не случайность — это структурное свойство антиверумической науки: «интересный» (т.е. отклоняющийся от Y=X) результат привлекает больше внимания, чем скучный (т.е. правильный).

    Цитирование: сколько статей вообще кто-то читает

  Доля никогда не цитируемых статей варьирует по областям: 12% в медицине, 27% в естественных науках, 32% в социальных науках, 82% в гуманитарных. По некоторым оценкам, до 50% статей читают только их авторы, рецензенты и редакторы. В астрономии и физике — 23–40% статей не цитируются за 40 лет (если не считать служебные публикации).

  Избыточные публикации — отдельная проблема. Один и тот же результат разбивается на несколько статей, данные переиспользуются без ссылок, обзоры и метаанализы плодятся геометрически.
  Во время пандемии COVID-19 за несколько месяцев было опубликовано более 10 000 статей, причём большинство было признано избыточными, содержащими систематические ошибки или просто бесполезными.

    Оценка масштаба сокращения

  Теперь попытаемся оценить, что останется, когда верумика заменит антиверумизм.

    Шаг 1. Отсеивание не-знания.

  Из 175 ЗБ мировых данных подавляющая часть не является знанием в принципе. Видео, игры, социальные сети, коммерция, бытовые коммуникации — всё это не наука и не истина. Если оставить только то, что претендует на статус знания (научные публикации, учебная литература, справочные данные, техническая документация), то даже по самой щедрой оценке это менее 1% мировых данных — порядка 1–2 ЗБ. Реально же, если считать только текстовое научное содержание без дубликатов и мультимедиа, — десятки петабайт, может быть, до 1 эксабайта.

  Сокращение: 2–3 порядка (в 100–1000 раз).

    Шаг 2. Отсеивание ложного и невоспроизводимого знания.

  Из того, что претендует на знание, значительная часть — ложна или невоспроизводима. Кризис воспроизводимости показывает: в социальных науках 75% результатов не воспроизводятся, в психологии — 64%, даже в топ-журналах — 38%. Статьи, которые никогда не цитируются, составляют 30–80% в зависимости от области. Избыточные публикации и дубликаты — ещё 20–30% от остатка.

  Если предположить, что из всего массива «научного знания» только 10–20% соответствует критериям истинности (воспроизводимость, нетривиальность, незаменимость), то после отсеивания ложного и избыточного останется порядка 10–100 терабайт.

  Сокращение: ещё 1–2 порядка.

    Шаг 3. Верумическая консолидация.

  Но и это ещё не всё. Верумика не просто отсеивает ложь — она перестраивает структуру знания. Антиверумическая наука описывает каждое явление через несправедливую функцию, и для каждой такой функции строится своя теория, своя терминология, своя методология, своя школа. Верумика начинается с одной функции Y=X и выводит из неё всё остальное.
  Там, где антиверумизм имел десятки конкурирующих теорий для одного явления, верумика имеет одно описание — потому что явление одно, и истина о нём одна.

  Это похоже на то, что произошло в математике: тысячу разрозненных фактов о треугольниках заменяет одна система аксиом, из которой всё выводится.
  Верумика делает то же самое для всего знания: не тысяча теорий справедливости, а одна — реализация Y=X в конкретных обстоятельствах.

  Если консолидация даёт ещё один-два порядка сокращения (в 10–100 раз), то итоговый объём верумического знания составит порядка 1–10 терабайт, а возможно — сотни гигабайт.

    Итоговая оценка

Слой Объём Доля от предыдущего
Все данные мира (2025) ~175 ЗБ —
Претендует на знание ~1 ЗБ ~0,5%
Истинно и невоспроизводимо ~10–100 ТБ ~0,001–0,01%
Верумическое знание (консолидированное) ~100 ГБ – 10 ТБ ~0,0001–0,001% от исходного

  Итоговое сокращение: от 4 до 6 порядков, то есть в 10 000 — 1 000 000 раз.

  Это означает: всё верумическое знание уместится на одном жёстком диске. Антиверумическое знание — это зеттабайты, требующие дата-центров на континентальном масштабе. Верумическое — это устройство, которое помещается в карман.

    Что произойдёт с интернетом

  Практически весь современный интернет-контент станет невостребованным. Не потому, что он будет запрещён или удалён — просто потому, что никто не будет к нему обращаться.
  Социальные сети, развлекательные платформы, новостные сайты, блоги, рекламные материалы, псевдонаучные публикации, миллиарды веб-страниц — всё это построено на антиверумических основаниях и потеряет смысл, когда эти основания будут заменены.

  Можно представить это как аналог того, что произошло с алхимией. Когда химия заменила алхимию, тысячи алхимических трактатов не были запрещены — они просто перестали читаться. Они остались в библиотеках как исторические артефакты, но живое знание прошло мимо них.
  То же ждёт интернет: он не исчезнет физически, но превратится в гигантский цифровой архив забытых текстов, curiosum антиверумической эпохи.

   Что это значит для искусственного интеллекта

  Современные ИИ-системы обучаются на огромных массивах текстов, подавляющая часть которых — антиверумический шум. ИИ тратит вычислительные ресурсы на запоминание ложных теорий, противоречивых фактов, избыточных описаний, множества конкурирующих интерпретаций одного и того же явления. Чем больше данных — тем больше шума, тем труднее выделить сигнал.

  Сокращение обучающего массива в 10 000 — 1 000 000 раз — это не просто экономия памяти. Это качественный скачок:

  - Скорость обучения вырастет на порядки: меньше данных — быстрее сходимость, меньше эпох, меньше вычислений.
  - Точность вырастет, потому что исчезнет необходимость отличать сигнал от шума — шума просто не будет.
  - Противоречивость исчезнет: в верумическом массиве нет конкурирующих теорий, объясняющих одно и то же явление по-разному. ИИ не будет тратить ресурсы на взвешивание альтернатив — альтернатив будет в 10 000 раз меньше.
  - Размер модели можно будет сократить: если знания в 100 000 раз меньше, модель для его обработки может быть на порядки компактнее. Не нужны миллиарды параметров для кодирования шума.

  Можно сказать так: современный ИИ — это студент, пытающийся выучить 175 зеттабайт текстов, из которых 99,999% — ложь. Верумический ИИ — это студент, которому дали терабайт истины и сказали: «Это всё. Учись».

    Заключение: твердыня и поток

  Верумика разрешает древнюю проблему не только в философии, но и в информатике. Логос — полон, неизменен и компактен. Его реализация — бесконечна, подвижна и неисчерпаема.
  Антиверумизм построил зеттабайтную гору, пытаясь описать бесконечное множество несправедливых функций. Верумика опирается на одну (Y=X) и выводит из неё всё.

  Когда-нибудь объём человеческого знания будет измеряться не зеттабайтами, а терабайтами. И это будет не шаг назад, а шаг к логосу — к той самой твердыне, которая всегда была меньше, чем казалась, и всегда была больше, чем можно было выразить.


Рецензии