Інтернетові пошуковики до Google: коли мережа була експериментом

“Більшість людей зовсім забули, наскільки це було хаотично”.

Інтернетові пошуковики до Google: коли мережа була експериментом 1

У середині 90-х Інтернет вибухово зростав, але знайти щось справді цінне на ньому було схоже на складні переговори з будь-якою пошуковою системою-предтечею, що опинилася найближче до дверей. На відміну від сьогодні, коли Google вважається одночасно порталом і гейткипером, такі сайти, як AltaVista, Lycos, Excite, HotBot та Ask Jeeves, обіцяли приборкати хаос, кожен зі своїми особливостями, принадами та недоліками.

Справжня історія догуглівського пошуку полягає не в тому, що ранні пошуковики були гіршими. А в тому, що вони відображали зовсім інший Інтернет, де каталоги мали значення, сканування було мистецтвом, ранжування було крихким, а ідея «пошуку» ще не сформувалася в єдиний домінуючий інтерфейс.

Інший вид Інтернету

Перше, що варто пам’ятати про Інтернет до Google, це те, що не було припущення, ніби можна шукати все. Багато користувачів знаходили сторінки через каталоги в стилі Yahoo, закладки, групи новин, підписи в електронних листах та посилання з сайту на сайт, оскільки Інтернет був ще досить малим, щоб людська організація могла конкурувати з машинним індексуванням. Це була ера «Дикого Заходу» з точки зору виявлення інформації. Пошукові системи існували, але вони були лише частиною ширшої екосистеми, що поєднувала кураторство та випадковість.

Перш ніж ці пошуковики стали основним публічним інтерфейсом до Інтернету, ресурси, як-от Usenet, показували людям, як організовувати та знаходити інформацію онлайн. Заснований у 1979 році, він надавав користувачам тематичні групи новин та культуру розподілених обговорень, завдяки чому онлайн-інформація відчувалася соціальною та спільнотною ще до появи перших великих веб-пошуковиків. Usenet допоміг сформувати звичку навігації величезними, заплутаними цифровими просторами через категорії та спільноти, а не єдине поле пошуку.

Ніколь М. Радзівілл у 90-х роках працювала системним адміністратором, програмістом, менеджером проєктів та іншими посадами. Вона згадує Usenet як портал до відкриття цікавого контенту в Інтернеті. «Це був основний спосіб дізнатися про веб-сайти, які могли б вас зацікавити», — сказала вона. «Я потрапила на Usenet у 1990 році як студентка в Даремі, Північна Кароліна… це було чудово, особливо групи alt.* та misc.*. Люди залишали посилання внизу своїх повідомлень, і обізнаність зростала органічно. А якщо ви хотіли безпечніших чи надійніших рекомендацій, ви могли обмежитися модераторськими групами».

Це була ера, коли термін «виявлення» мав реальну вагу, коли ви могли автентично бути одними з перших, хто переглядає контент, незалежно від його якості чи того, як довго він існував — ера, сповнена здивування та розчарування.

«Потім, через кілька років, з’явилися веб-кільця», — згадує Радзівілл. «Ви отримували блок коду і розміщували його внизу HTML-сторінки свого сайту, і він вбудовував посилання на наступний сайт, пов’язаний із цим. Хтось інший керував списком того, що могло йти далі, тому це був чудовий спосіб збільшити охоплення. Люди, які складали списки для веб-кілець, зазвичай були досить порядними, тому ми навіть не думали про саботаж».

Веб-кільця — це ще один догуглівський артефакт, який нагадує про епоху, коли виникали мікроспільноти, схожі на ті, що існували в епоху BBS, з груп людей, які ділилися нішевими інтересами, іноді навіть локально пов’язаних у реальному світі. До появи монолітних агрегаторів, як-от Reddit, веб-кільця були одним із небагатьох способів знайти сайти, присвячені темам, які вас цікавили.

Це було важливо, тому що Інтернет ще не став чистою машиною для пошуку інформації. Він ще мав культуру дослідження, і багато сервісів були розроблені, щоб допомогти користувачам переглядати тематичні категорії, а не надсилати запит до універсального індексу. У тому світі веб-кільце чи каталог не були компромісом. Часто це була головна подія.

Каталоги перед алгоритмами

Yahoo є найвідомішим прикладом цієї ранньої логіки. Він почався як керований людьми посібник до Інтернету, організований у вкладені категорії за темами та підтримуваний людьми, а не повністю автоматизованими системами ранжування. Для молодого Інтернету такий підхід був напрочуд ефективним: людські редактори могли визначати якісні сайти, фільтрувати очевидний сміття та нав’язувати відчуття порядку середовищу, що швидко розширювалося.

«Я був системним адміністратором в „інтернет-магазині“ у 1995 і 1996 роках», — розповіла мені Радзівілл, — «і коли ми знаходив веб-сайти для нових клієнтів, головним моментом нашого процесу було надсилання сайту до Yahoo. Yahoo був як Жовті сторінки, але тільки для веб-сайтів. Була форма, яку ви заповнювали, і ви мали обґрунтувати справжнім людям у Yahoo, що цей бізнес, який ви подаєте, є законним і достатньо важливим, щоб бути в головному каталозі Yahoo».

Таке людське кураторство зараз майже немислиме.

«Я пам’ятаю, як одного разу подав веб-сайт регіонального відділення Американського онкологічного товариства і отримав відмову, тому що він „не був достатньо значущим“, — розповіла Радзівілл. — «Вони порекомендували нам зв’язатися з головним ACS і попросити їх поставити посилання на сайт зі своєї сторінки… якої тоді ще не було».

Це був час, коли потрапляння до каталогу, як-от Yahoo, від їхніх модераторів було величезним знаком честі. Але модель мала очевидні обмеження. Людське кураторство не могло масштабуватися вічно, і воно стало дорожчим та менш своєчасним, оскільки Інтернет розширювався, а контент випереджав кураторство. У той момент, коли кількість сторінок перевищила кількість людей, які могли їх розумно класифікувати, майбутнє належало сканерам та системам ранжування.

Зростання сканерів

Пошукові системи того часу вирішували проблему масштабу за допомогою програмного забезпечення. Багато перших великих комерційних систем, як-от AltaVista, Lycos, Excite та HotBot, використовували сканери та індекси для автоматичного картографування зростаючого Інтернету, а не покладалися на редакторів для ручної класифікації кожного сайту. Хоча ці пошуковики не працювали однаково, вони мали спільну основну мету: зібрати якомога більше Інтернету і дозволити алгоритму розібратися в хаосі.

Це може здатися очевидним зараз, але тоді це був стрибок. AltaVista, зокрема, представляла собою значний крок вперед, поєднуючи швидкий сканер з масштабованим програмним забезпеченням для індексації, і незабаром після запуску вже обробляла мільйони HTTP-запитів на день. Пошук почав нагадувати запит до гігантської машини, а не перегляд каталогу.

Момент AltaVista

AltaVista стала одним із визначальних пошукових механізмів 90-х років, тому що він був швидким, широким та надзвичайно потужним для свого часу. Пізніші версії підтримували пошук у стилі природної мови та створювали у користувачів відчуття, що до Інтернету можна нарешті поставитися як до індексованого цілого, навіть якщо результати були ще грубими. У десятиліття, коли багато людей ще вивчали, що таке Інтернет, і боролися з його величезністю, це здавалося майже дивом. Але це все ще був дуже обмежений інструмент порівняно з гіперсучасністю еволюціонувавшого пошуковика, як-от сучасний Google.

Марк Френд, директор IT-фірми Classroom365 Limited, працював системним оператором наприкінці 90-х. Він згадує, що в епоху до Google пошук в Інтернеті був як технічною навичкою, так і мистецтвом.

Інтернетові пошуковики до Google: коли мережа була експериментом 2 Altavista in 1999. Credit: Web Design Museum

«Більшість людей зовсім забули, наскільки це було хаотично», — сказав Френд. «Тоді, якщо ви вводили запитання в AltaVista, шанси були не на вашу користь, якщо ви шукали щось конкретне. Ви отримували 40 000 результатів, які залишали вас так само спантеличеними, як крик у переповненій кімнаті».

Порівняно зі зручним інтерфейсом Google та його більш релевантними результатами, перегляд сторінки результатів AltaVista вимагав терпіння та справжньої майстерності, яка вдосконалювалася з часом. Але AltaVista зробила одну важливу річ: вона встановила очікування, що пошук має бути миттєвим. Це очікування виявилося вирішальним. Як тільки користувачі відчули пошуковий механізм, який міг швидко сканувати величезний індекс, вони перестали задовольнятися повільними, неповними системами. AltaVista не виграла пошукову війну, але вона визначила правила гри.

Lycos, Excite та ера порталів

Lycos та Excite займали важливу проміжну нішу. Це були пошукові бренди, але також і портали, що означало, що вони прагнули бути пунктами призначення не менше, ніж інструментами. Пошук співіснував із розділами новин, електронної пошти, спорту, погоди, фінансів та іншого контенту, призначеного для того, щоб утримувати користувачів на сайті, а не перенаправляти на сторінки результатів.

Інтернетові пошуковики до Google: коли мережа була експериментом 3 Excite in 1997. Credit: Web Design Museum

Ці компанії продемонстрували, наскільки неврегульованою була категорія. Деякі пошуковики наголошували на широті охоплення, інші — на швидкості, а деякі поєднували редакційні канали з автоматизованими результатами у спосіб, що здається чужим сьогодні. Назва «пошукова система» охоплювала широкий спектр продуктів: від служб каталогів та сканерів до порталів із пошуком, доданим як третинна функція.

HotBot, Inktomi та технічна достовірність

HotBot заслужив репутацію одного з найтехнічніших пошукових механізмів тієї епохи. Він з’явився в період, коли користувачі почали помічати, що якість пошуку залежить як від розміру індексу, так і від складності системи ранжування, що стоїть за ним — масштабований бекенд надавався Inktomi. Швидкого сканування було недостатньо; люди хотіли отримувати релевантні, актуальні та не маніпульовані результати.

Інтернетові пошуковики до Google: коли мережа була експериментом 4 Hotbot in 1999. Credit: Web Design Museum

Ця напруженість виявила слабкість ранніх поколінь машинного пошуку. Якщо система занадто сильно покладалася на текстові сигнали на сторінці, люди могли просто перевантажувати свій контент словесним «наповненням» для штучного підвищення рангу. Якщо пошуковик спирався переважно на легко маніпульовані сигнали на сторінці, маркетинг міг пересилити якість. Ранній Інтернет швидко став лабораторією для маніпуляцій, ще до того, як хтось використав термін «пошукова оптимізація» (SEO) у сучасному розумінні.

Ask Jeeves та інтерфейс запитань

Ask Jeeves виділявся тим, що намагався зробити пошук розмовним, ідеєю, яка здається особливо пророчою в епоху чат-ботів зі штучним інтелектом — хоча Ask Jeeves, очевидно, не пропонував нічого близького до розмовного інтерфейсу на основі сучасних великих мовних моделей. Марк Френд сказав, що Ask Jeeves здавався справді футуристичним, тому що замість того, щоб просити користувачів думати ключовими словами, він запрошував їх ставити запитання природною мовою, створюючи враження Інтернету, керованого обізнаним помічником.

Інтернетові пошуковики до Google: коли мережа була експериментом 5 Ask Jeeves in 1999. Credit: Web Design Museum

Проблема полягала в тому, що природна мова — це складно. Користувачі не завжди ставили чіткі запитання, а базові системи ще не були достатньо досконалими, щоб надійно розуміти наміри в масштабі. Ask Jeeves запам’ятався тим, що, не маючи підґрунтя глибокого навчання та LLM, він претендував на краще розуміння користувацького досвіду, ніж дозволяла тогочасна технологія.

Пошук до SEO

Інтернет до Google також був середовищем доіндустріального SEO. Власники сайтів намагалися покращити видимість, але сучасна система пошукової оптимізації ще не стала такою величезною, професіоналізованою дисципліною, якою вона стала пізніше, з цілими відділами «експертів», які женуться за ефемерними сигналами від Google і намагаються передбачити його наступний таємничий поворот. Ранні пошуковики все ще було відносно легко вплинути очевидними сигналами, такими як повторення ключових слів, метадані та тактика подання.

«Тоді не говорили про ранжування», — згадує Френд. «Люди надсилали свої URL-адреси та терпляче чекали, щоб побачити, чи з’являться вони в пошуку. Всі серйозно ставилися до тегу Meta keywords, і практика використання «білого тексту на білому фоні» для приховування прихованих ключових слів була легітимною тактикою, яку вебмайстри використовували для включення ключових слів на своїх вебсайтах для пошукових роботів. Не було страху перед покараннями, ви створювали вебсайт, складали руки, і сподівалися на краще».

До кінця 90-х пошуковики почали ідентифікувати підхід «білий на білому» як спамдексинг і вживати заходів. У будь-якому випадку, це означало, що ранжування було простішим і крихкішим, ніж сьогодні. Ранній пошуковий Інтернет був експериментальним етапом, де правила ще не затвердилися, а зворотний зв’язок між видавцями та пошуковиками все ще був керованим і простішим для тестування та інтерпретації. Як тільки пошук став основним шлюзом до Інтернету, це відкрите середовище перетворилося на більш вороже.

«Важка правда, яку більшість людей не хочуть визнавати, полягає в тому, що скрейпінг та ранжування перетворили Інтернет на виробничий цех контенту», — сказав Френд. «Вебсайти перестали писатися для людей, а стали писатися переважно для пошукових роботів».

PageRank змінює все

Ключовий внесок Google полягав не в тому, що він відкрив пошук; він змінив логіку ранжування. Серед іншого, PageRank розглядав посилання як сигнали авторитетності, що робило релевантність частково питанням того, як сам Інтернет посилався на сторінку. Це був важливий зсув, тому що результати здавалися більш надійними, а прості маніпуляції — складнішими, хоча, очевидно, не неможливими.

Що не менш важливо, Google поєднав цей підхід до ранжування зі спрощеним інтерфейсом та сторінкою результатів, яка не заважала. Чистий дизайн мав значення, тому що він зміцнював відчуття, що пошук має бути утилітою, а не порталом-парком розваг. На практиці Google зробив так, що пошукове вікно відчувалося як парадний вхід до всього Інтернету, з такою ж властивою, життєво важливою важливістю, як парадний вхід у домі.

Чому старий Інтернет мав значення

Озираючись назад, епоха до Google була повільнішою, хаотичнішою і, у багатьох відношеннях, менш ефективною. Але вона також мала більше конкуруючих ідей про те, як інформація має знаходитися, класифікуватися та оцінюватися, поряд з беззаконною атмосферою, що свідчила про необмежений потенціал. Деякі системи довіряли людям. Деякі — сканерам. Деякі — каталогам, а деякі — запитанням, сформульованим простою англійською.

«Інтернет містив невід’ємний рівень безладу та хаосу», — згадував Френд. «Але водночас він був набагато більш гуманізованим місцем раніше. Ось чому багато хто з нас ностальгує за тим часом. Інтернет мав ремісниче відчуття. Його створювали справжні люди, використовуючи текстові редактори, як-от Notepad і Dreamweaver. Ви могли почати з одного пункту призначення і опинитися на фанатському сайті маловідомого гурту, а потім потрапити на форум, де обговорюються вінтажні синтезатори, і зрештою опинитися на сторінці NASA».

Цю різноманітність варто пам’ятати, тому що вона показує, що пошук ніколи не був приречений виглядати так, як зараз. Пошуковики до Google були не просто невдалими попередниками. Це були серйозні спроби вирішити проблему, яку Інтернет зробив нагальною, але ще не розв’язною одним очевидним способом. Google переміг, поєднавши технічне ранжування, зручність використання та масштаб саме в той момент, коли решта Інтернету була готова відмовитися від старого порядку.

За матеріалами: arstechnica.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *