JSON-LD: структурированные данные для сайтов

JSON-LD: структурированные данные для сайтов

JSON-LD (JSON Linked Data), это формат для добавления структурированных данных в вебстраницы. Он помогает поисковым роботам вроде Googlebot понять содержание и назначение вашего сайта, что ведет к более красивым превью в поисковых результатах и потенциально улучшает ранжирование.

В статье разобраны основные типы узлов JSON-LD для личных сайтов: WebSite описывает метаданные сайта, Person, информацию об авторе (Google использует это для оценки качества), WebPage, саму страницу, SoftwareApplication, программы, которые вы разработали, BreadcrumbList, путь навигации. Каждый узел содержит свойства из Schema.org, и поисковики могут объединять эту информацию со нескольких страниц по уникальному ID, если его правильно структурировать.

Ключевые факты

  • JSON-LD помещается в тег <script type="application/ld+json"> и не выполняется браузером, но парсится специализированными краулерами.
  • Основа, контекст @context указывает на schema.org, который определяет допустимые свойства для каждого типа данных.
  • Граф узлов содержит @type (тип), @id (уникальный идентификатор, обычно URL с хешем) и свойства, описывающие атрибуты узла.
  • Поисковики объединяют свойства одного узла со нескольких страниц, если @id совпадает, но LLM-парсеры видят только одну страницу.
  • Для личного сайта необходимы узлы WebSite, Person, WebPage; опционально SoftwareApplication и BreadcrumbList для улучшения поисковой видимости.

Почему это важно

JSON-LD решает проблему машиночитаемости веба. Без структурированных данных поисковик вынужден угадывать, что конкретно на странице, и часто ошибается. С JSON-LD вы явно говорите краулеру: это профиль личности, это статья в блоге, это приложение. Google использует эту информацию не только для SEO, но и для того чтобы на знакомства вокруг вашего имени правильно строил ваш графен знаний. Все чаще LLM-краулеры (которые смотрят одну страницу за раз) опираются на JSON-LD для цитирования источников.

Кому это важно

Разработчикам личных сайтов и технических блогов, которые хотят улучшить видимость в Google и защитить авторство при использовании LLM. Специалистам по SEO, стремящимся контролировать отображение сайта в поисковых результатах. Авторам, желающим корректного цитирования в системах вроде GPT и Claude, хорошая разметка повышает вероятность того, что система вас упомянет как источник.

Как это применить

Добавьте в страницы блок <script type="application/ld+json"></script> с объектом JSON. Используйте @context: https://schema.org для стандартизации. На главной странице поместите полный WebSite узел с названием, описанием, логотипом. На всех страницах добавьте Person узел с вашей информацией (имя, описание, ссылки на профили, фото). Для блога используйте WebPage с BreadcrumbList для навигационного пути. Для проектов добавьте SoftwareApplication с ссылкой на репозиторий и лицензией.

Можно ли доверять

JSON-LD основан на открытом стандарте Schema.org, который поддерживают Google, Яндекс и другие поисковики. Это не попытка манипулировать результатами поиска, это просто более честное сообщение информации машинам. Если правильно построить граф узлов, поисковик обрабатывает его без проблем. Главное не врать в метаданных, иначе Google может наложить санкции.

Риски и подводные камни

Сложность для начинающих разработчиков, JSON-LD требует понимания Schema.org и правильной иерархии. Если вы неправильно зададите @id узла, поисковик не сможет объединить данные со нескольких страниц. Для личных сайтов слишком детальный Person узел может показаться избыточным, но это безопасно. Помните, что LLM-краулеры видят только одну страницу за раз, поэтому не рассчитывайте на объединение данных через @id, ставьте всю важную информацию на каждую страницу.

«Web crawlers can merge the properties of a node across multiple pages, as long as they share an ID. However, scrapers that only read one page, such as LLMs, will not merge the properties.»

— Ethan Hawksley, «JSON-LD Explained for Personal Websites»