Технічний словник SEO: 5 термінів, які варто знати

Технічний словник SEO
SEO & Google

Технічні основи SEO: canonical, robots.txt, sitemap, schema, 404

П’ять термінів. Кожен зʼявляється в будь-якому технічному аудиті, і кожен окремо не тягне на статтю — обсяг пошуку замалий. Разом вони формують мінімальний технічний словник, без якого важко читати навіть базовий чекліст SEO. Без есе, без розлогих вступів — по суті кожного терміна.

canonical тег у <head>

Вказує Google, яка версія сторінки — головна, якщо існує кілька схожих чи ідентичних URL.

<link rel="canonical" href="https://site.ua/page/" />
Навіщо GoogleУникнути індексації дублів як окремих сторінок.
Типова помилкаCanonical вказує на неіснуючу чи неправильну сторінку після редизайну.
Де перевіритиВихідний код сторінки або Screaming Frog.
robots.txt файл у корені сайту

Текстовий файл, який каже пошуковим роботам, які розділи сайту сканувати можна, а які — ні.

User-agent: *
Disallow: /admin/
Sitemap: https://site.ua/sitemap.xml
Навіщо GoogleЕкономить краулінговий бюджет — робот не витрачає час на службові розділи.
Типова помилкаВипадковий Disallow: /, залишений після тестового запуску сайту.
Де перевіритиsite.ua/robots.txt у браузері.
sitemap.xml файл-карта сайту

Список усіх важливих URL сайту в машинозчитуваному форматі — прямий шлях для робота до всього, що варто проіндексувати.

Навіщо GoogleШвидше знаходить нові й оновлені сторінки, особливо на великих сайтах.
Типова помилкаSitemap не оновили після редизайну — Google орієнтується на застарілу структуру.
Де перевіритиРозділ “Файли Sitemap” у Google Search Console.
schema.org структуровані дані

Розмітка в коді сторінки, яка пояснює Google зміст контенту не текстом, а структурою — стаття це, товар, FAQ чи локальний бізнес.

Навіщо GoogleДає підстави для розширених сніпетів у видачі — зірочки рейтингу, FAQ, ціна.
Типова помилкаРозмітка є в коді, але не відповідає видимому контенту сторінки.
Де перевіритиRich Results Test від Google.
404 код відповіді сервера

Сигнал “сторінку не знайдено” — виникає, коли URL більше не існує, а нічого не редиректить на актуальну версію.

Навіщо GoogleБагато 404 на сайті витрачають краулінговий бюджет і псують досвід користувача.
Типова помилкаСторінку видалили чи перейменували, а старі посилання на неї (внутрішні й зовнішні) не оновили.
Де перевіритиScreaming Frog або звіт “Сторінки” в Search Console.

Шпаргалка одним поглядом

ТермінФорматДе живе
canonicalHTML-тег<head> кожної сторінки
robots.txtТекстовий файлКорінь домену
sitemap.xmlXML-файлКорінь домену, поданий у GSC
schema.orgJSON-LD розмітка<head> або <body> сторінки
404HTTP-код відповідіСервер, при запиті неіснуючого URL

П’ять термінів, п’ять різних форматів — тег, файл, ще один файл, розмітка, код відповіді сервера. Плутанина між ними трапляється часто саме тому, що вони звучать схоже в розмові, але технічно не мають нічого спільного.

Часті запитання

Чи обов’язкові всі п’ять елементів для будь-якого сайту?+

Robots.txt і коректна обробка 404 потрібні завжди. Sitemap і canonical стають критичними з ростом кількості сторінок. Schema.org — не обов’язкова, але суттєво підвищує шанс на розширені сніпети.

Чи можна редагувати robots.txt самостійно, без розробника?+

Технічно так — це простий текстовий файл. Але одна помилка (наприклад, зайвий Disallow) може закрити весь сайт від індексації, тому будь-яку зміну варто перевіряти через Search Console перед публікацією.

Що краще — 404 чи редирект на головну сторінку?+

Ні те, ні інше в чистому вигляді. Найкраще — редирект 301 на релевантну актуальну сторінку. Масовий редирект усіх видалених сторінок на головну Google також не вітає — це виглядає як “м’який 404”.

Далі по темі: технічний SEO-аудит сайту · як скласти семантичне ядро · що таке SEO і як воно працює