Идею разложить интернет по полкам уже пробовали в 1994 году. Разбираем, из-за чего она развалилась и почему сейчас происходит то же самое.
В 1994 году два аспиранта Стэнфорда, Джерри Янг и Дэвид Файло, начали складывать в общий список ссылки на сайты, которые им понравились. Список назывался «Путеводитель Джерри и Дэвида по Всемирной паутине». Через год у него было имя покороче - Yahoo. Ещё через несколько лет уже статус главного входа в интернет.
Устроен путеводитель был как дерево. Ветки, на ветках ветки поменьше, на тех ещё. Чтобы дойти до сайта про шахматы, нужно было пройти: развлечения / игры / настольные игры / шахматы. Четыре шага, если повезло. Семь и больше, если тема лежала глубже. Люди проходили. Дерево работало, и работало хорошо.
Сегодня рубрикатор принято вспоминать свысока. Зря. У него было два свойства, которых нет ни у одной поисковой строки.
Первое, он показывал целое. Спускаясь по ветке, вы попутно видели соседние. Шли за шахматами и узнавали, что рядом лежат го и сёги. А этажом выше весь досуг разложен по полкам. Каталог был не только справочником, но и картой. По нему было видно, что вообще бывает на свете.
Второе, людей. Ссылки отбирали руками. У Yahoo этим занимались штатные редакторы. У конкурента это добровольцы. Конкурент вышел в 1998 году под именем Open Directory Project, позже его знали как DMOZ. Волонтёров там набралось около 91 тысячи по всему миру. Они спорили о рубриках, чистили мусор, отклоняли заявки. Попасть в каталог означало, что живой человек посмотрел и счёл достойным.
Чем это кончилось, понятно. Место в дереве стало ценностью, а ценность - товаром. Строка повыше в Yahoo Directory стоила 299 долларов в год, для сайтов деликатных тем - 600. Но пока дерево росло, работу свою оно делало.
Ровно на том же самом. Каталог требовал знать, где лежит ответ, до того как вы начали его искать. Рубрика это ведь уже готовое решение о природе вещи. Кто-то заранее постановил, что шахматы это досуг, а не спорт, не искусство и не наука. Человек был обязан угадать чужую разметку.
С шахматами угадать легко. А куда положить сайт мастерской, которая делает мебель из вторичного пластика? В «дом и интерьер»? В «экологию»? В «производство»? В «малый бизнес»? Редактор выбирал одно. Посетитель искал в другом. Оба правы, оба ушли ни с чем.
Дальше арифметика, и она жёсткая. Веток можно добавить сколько угодно, но глубина дерева растёт логарифмом, а сеть росла экспонентой. К концу девяностых стало ясно, пока редактор разбирает вчерашнюю почту, интернет успевает вырасти вдвое. Ручную работу двигают люди, а людей конечное число.
В 1995 году появилась AltaVista. Она собирала сайты роботом и по размеру индекса быстро обогнала Yahoo. Но выдача тонула в мусоре. Сортировка шла по тому, сколько раз слово встречается на странице, а накрутить это было делом пяти минут. Перелом случился, когда стали считать не слова на странице, а ссылки на неё с чужих страниц. Качество начали мерить чужим мнением, а не тем, что сайт говорит о себе сам.
Дальше только хроника. В октябре 2002 года Yahoo перешёл на машинную выдачу, каталог остался, но перестал быть главным. В сентябре 2014-го объявили о закрытии, 31 декабря 2014 года Yahoo Directory выключили. DMOZ закрыли в марте 2017-го. Волонтёры перезапустили его сами под именем Curlie. Он жив до сих пор - как памятник.
Тут важно понять, что именно произошло. Google не сделал каталог лучше. Он отменил вопрос, на который каталог отвечал. Больше не нужно было знать, где лежит ответ. Достаточно было описать, что вы ищете.
С магазинами приложений случилось ровно это. App Store открылся в июле 2008 года с рубриками. Сегодня рубрика «Игры» это черная дыра, попасть в неё легко, найтись нельзя. Реальный вход это поиск и подборки редакции. А подборка редакции это и есть Yahoo Directory, только свёрстан он теперь красивее.
Теперь то же самое разворачивается с ИИ-сервисами. Каталогов уже десятки. Заявленные объёмы: больше 1000 у neiroai.ru, больше 2400 у ailib.ru, больше 3000 у ailibri.com, 12 600 в описании neurofolder.com. Есть каталоги с более узкой рамкой: galleryai.ru - только российские сервисы, больше сотни карточек.
От сотен до тысяч и всё это про один рынок. Уже отсюда видно, что считают все по-своему, а проверить некому.
Место продаётся. В каталогах появляются разделы «ТОП-100 лучших», а рядом и партнёрские ссылки на курсы про заработок на нейросетях. Это не порок отдельного проекта. Так устроены деньги любого бесплатного каталога, и Yahoo прошёл ровно тот же путь двадцать лет назад.
Каталог же не ошибка. Это ранний возраст, так выглядит отрасль, пока её ещё можно пересчитать руками. Yahoo был прав в 1994 году. Он перестал быть прав году в 1999-м, и заметили это не сразу.
Логичный следующий шаг - раз рубрику надо угадывать, уберём рубрику. Пусть человек опишет задачу словами.
Такие попытки уже есть. У neiroset.com поиск начинается со строки «Введите задачу, найдём нейросеть». У каталога galleryai.ru есть проект Сфера sphere.su, которая работает так же - описываете задачу, получаете предложение, куда смотреть. Оба проекта пока не большие. У второго более сотни карточек.
Но интереснее не размер, а то, что при таком переходе теряется. Дерево показывало соседние ветки. Разговор не показывает ничего, кроме ответа. Вы спросили - вам дали три варианта. А что лежало рядом, осталось за кадром. Вы про это не спросили, потому что не знали, что оно есть.
Кто знает, чего хочет, тот выиграл. Кто не знает - потерял карту. А второй случай самый частый. Люди приходят не с запросом, а с чувством, что что-то идёт не так. Ответ на неправильно понятую задачу хуже, чем отсутствие ответа. Он выглядит как решение и закрывает вопрос.
Если коротко - три вещи.
Размер базы перестал давать фору примерно тогда же, когда перестал давать её размер индекса AltaVista. Между 400 и 12 600 карточками разница только в том, сколько вы будете крутить страницу.
Проверять некому и вот главная черная дыра. У DMOZ была 91 тысяча волонтёров, и он всё равно не справился. У нынешних каталогов нет и близко таких сил, а поток новых сервисов больше.
И третье. Вопрос «где лежит» уже сменился вопросом «что вам нужно». Каталог требовал знать ответ до поиска. Разговор требует знать вопрос. На бумаге это легче вопрос ваш, угадывать чужое не надо. На деле далеко не факт. Человек, который третий вечер подряд правит одно и то же в таблице, редко думает про это словами «мне нужна автоматизация». Он думает: «достало».
Превратить «достало» в вопрос, а вот это работа, и делать её пока некому. Тридцать лет назад мы упёрлись в то, что машина не знает, где лежит ответ. Теперь упираемся в то, что человек не знает, как спросить. Движение есть, но оно скромнее, чем кажется.