Vectorscope

Vectorscope — безкоштовний браузерний інструмент, який показує, що відбувається зі сторінкою на шляху в індекс ШІ-асистента: які фрагменти з неї витягують, як вони групуються за змістом і яка частина сторінки лишається за межею відбору, а отже не читається ніколи.

6 хв читанняGEO / Пошук з ШІ

Що він робить, крок за кроком

П'ять кроків, і кожен названий у міру завершення, щоб було зрозуміло, де саме зламалось. Він отримує URL і показує код відповіді. Витягує читабельний текст, відкидаючи навігацію, обгортку й розмітку, і показує, яка частка документа вціліла. Ділить цей текст по власній структурі H2 і H3 сторінки, а не кожні N символів, — так фрагмент приходить із заголовком, який його називає. Векторизує кожен фрагмент. Тоді групує їх за косинусною близькістю, по медіані самої сторінки, тож групи описують саму цю сторінку, а не фіксований поріг.

Подільник, модель векторизації й межа відбору — ті самі, що в платному продукті на продакшні. Демо на спрощеному пайплайні лестило б тому пайплайну, який воно має демонструвати, а найкорисніше число цього інструмента — скільки довгої сторінки ніколи не доходить до індексу — існує лише тому, що застосована справжня межа.

Він бере одну адресу й показує ті частини сторінки, які машина справді прочитає, і ті, які пропустить.

Vectorscope після читання сторінки: смуга з п'яти чисел — отримано, витягнуто, поділено, векторизовано, згруповано — над сторінкою, розбитою на чотири нумеровані фрагменти зліва, і діаграмою цих фрагментів у векторному просторі справа.
Одне читання getlooploop.com/methodology: 971 слово стало чотирма фрагментами, векторизованими в 1024 вимірах і зведеними у дві групи.

Що означають ці п'ять чисел

Смуга — це все читання у п'яти числах, і кожне ламається по-своєму.

Отримано — код відповіді й хост. Витягнуто — відношення читабельного тексту до документа: довга сторінка з низьким відношенням складається переважно з навігації, а для будь-якої системи пошуку вона коротка. Поділено — на скільки фрагментів розпалась сторінка і скільки в них символів. Векторизовано — кількість векторів і їхня розмірність. Згруповано — на скільки груп упали фрагменти і скільки з них повтори.

Одна велезна група означає, що сторінка каже одне й те саме багато разів — для системи пошуку вона тонка, хоч би якою докладною виглядала для редактора. Кілька груп по одному фрагменту — протилежна проблема: сторінка постійно змінює тему й не дає системі нічого цілісного, що можна процитувати.

Як застосувати це до своєї сторінки

  • Проженіть сторінку, за якою ви вже ранжуєтесь, і читайте спершу відношення витягнутого. Якщо воно низьке, сторінка викидає основний текст, а не обгортку, — і жодне переписування цього не виправить.
  • Знайдіть фрагмент, у якому лежить ваша відповідь. Якщо він за межею відбору, лікується це підняттям його вище або розділенням сторінки, а не додаванням слів.
  • Задайте сторінці питання, на яке знаєте відповідь, і перевірте, чи верхній фрагмент — той, що її містить. Це найближче до того, щоб побачити, як модель вирішує, про що ваша сторінка.
  • Змініть один заголовок і проженіть знову. Текст заголовка виконує роботу з витягуваності, і це найшвидший спосіб побачити, наскільки велику.

Типові помилки

  • Читати кількість груп як оцінку. Це опис однієї сторінки, а не бал із десяти, і дві групи — правильно для сторінки про дві речі.
  • Вважати низьке відношення витягнутого проблемою тексту. Зазвичай це проблема рендеру: текст, який існує лише після виконання JavaScript, у документі не був.
  • Думати, що фрагменти, які отримує система пошуку, — це те, що бачить читач. Бічну панель, яку читач не помічає, екстрактор вважає основним текстом.
  • Чекати, що читання скаже, чи цитує вас асистент. Він читає одну сторінку окремо; цитування — це вимір у часі на обраних вами запитах.

Чого він сказати не може

Він не скаже, чи має конкретний асистент вашу сторінку в індексі, — цього не бачить ніхто поза тими компаніями. Не порівняє вас із конкурентом: для цього потрібен корпус обох, а не один URL. Не скаже, чи вас цитують у відповідях сьогодні, — це вимір за тижні на наборі запитів, а не властивість однієї сторінки. І він не судить про текст: він показує рішення, які ухвалив пайплайн, а це інше, ніж чи сторінка добра.

Розібраний приклад

Посібник із цін на 4000 слів виглядає авторитетно й дає відношення витягнутого 0,31, дванадцять фрагментів і одну групу. Відношення каже, що дві третини документа були обгорткою. Одна група каже, що ці дванадцять фрагментів майже однакові — сторінка повторює свою обіцянку дванадцять разів. Система пошуку, запитана про ціни, отримає один із них і не має жодної причини обрати цю сторінку замість будь-якої іншої. Лікується це не додатковими словами, а дванадцятьма фрагментами, кожен з яких відповідає на інше питання.

Поширені запитання

Чим це відрізняється від звичайного SEO-аудиту?

SEO-аудит перевіряє, чи можна сторінку обійти й проранжувати. Це перевіряє, чи можна її процитувати: що витягує пошуковий прохід, як він ділить текст і які фрагменти лежать за межею, яку модель справді читає. Технічна основа в них спільна, а розходяться вони на структурі — аудит винагороджує сторінку, що задовольняє запит, а це винагороджує фрагмент, який витримує, коли його виймають зі сторінки.

Це той самий пайплайн, що й у платному продукті?

Так — той самий подільник, та сама модель векторизації, та сама межа відбору. Це важливо для одного числа зокрема: скільки довгої сторінки ніколи не доходить до індексу, існує як число лише тому, що застосована справжня межа, а спрощене демо показало б втрату меншою, ніж вона є.

Чому моя сторінка ділиться на так мало фрагментів?

Зазвичай тому, що в ній мало заголовків. Подільник ріже по власній структурі H2 і H3, тож довга сторінка, написана одним суцільним потоком, стає кількома дуже великими фрагментами — і кожен із них система пошуку мусить брати або кидати цілим. Додати справжні заголовки — найдешевший спосіб це змінити.

Чи означає багато груп, що сторінка добра?

Ні, і доброго числа тут немає. Дві групи — правильно для сторінки про дві речі й неправильно для сторінки про одну. Діагностичні саме крайності: одна велезна група означає, що сторінка себе повторює, а по групі на фрагмент — що вона ніколи не тримається теми досить довго, щоб бути цитовною хоч у чомусь.

Скільки це коштує і де підступ?

Нічого, з лімітом на відвідувача, щоб одна людина не витратила денний бюджет, — це обмеження частоти, а не платна стіна, і без акаунта. Обмеження, якщо його так називати, у тому, що він читає одну сторінку за раз і нічого не каже про те, чи відповідає асистент вами.

Як про це питають уголос

сказане, не набране

Той самий термін словами, якими про нього питають асистента, а не набирають у рядку пошуку — написано із ситуації, тому кожне питання несе ту ситуацію, з якої виникло.

Наш головний посібник не підхоплюють відповіді ШІ, і я не можу зрозуміти чому.

Дивіться спершу на відношення витягнутого. Найчастіше відповідь у тому, що основний текст посібника — меншість документа: навігація, блоки «схожі статті» й розмітка складають решту, тож сторінка, яка читається як чотири тисячі слів, доходить як вісімсот. Інструмент показує це відношення, і жодне переписування не лікує проблему рендеру.

конкретна сторінкачому це сталось
Керівник хоче доказ, що перебудова сторінки щось дала, і треба до п'ятниці.

Проженіть сторінку до і після й збережіть обидва читання. Кількість фрагментів, відношення витягнутого й структура груп змінюються помітно, коли змінюються заголовки, — і це «до і після», на яке можна подивитись. Це доказ про читабельність сторінки, а не про трафік, і варто сказати, про що саме.

дедлайннад людиною стоять
Чи можу я перевірити це з телефону, поки не почалась зустріч?

Так. Без акаунта, без встановлення й без картки, а одне читання займає близько двадцяти секунд. Вставте адресу й прочитайте п'ять чисел угорі; подробиці під ними — для того, коли будете за столом.

у дорозіз телефону

Ще в розділі «GEO / Пошук з ШІ»