Статті ·

Що таке llms.txt і чи потрібен він вашому сайту: чесна відповідь

Останнім часом власникам сайтів дедалі частіше кажуть: «Вам терміново потрібен llms.txt, інакше ChatGPT вас не побачить». Деякі сервіси перевірки сайтів навіть позначають відсутність цього файлу як помилку. Розберімося, що це за файл, хто його читає і чи варто на нього витрачати час.

Що таке llms.txt

Це текстовий файл у корені сайту за адресою ваш-сайт/llms.txt. Ідею запропонував у вересні 2024 року дослідник Джеремі Говард. Задум простий: дати мовним моделям короткий «зміст» сайту, де сказано, що це за компанія, і вказано посилання на найважливіші сторінки. Так моделі не треба продиратися крізь меню, рекламу й скрипти.

Як він виглядає

Файл пишуть у форматі Markdown, тобто звичайним текстом з кількома позначками. Зазвичай у ньому є:

  1. Назва сайту чи компанії першим рядком.
  2. Короткий опис на два-три речення: хто ви й що робите.
  3. Розділи зі списками посилань на головні сторінки, наприклад «Послуги», «Ціни», «Контакти», з коротким поясненням до кожної.

Зробити такий файл можна за 15 хвилин.

Що кажуть Google і розробники ШІ

Тут починається найцікавіше. Google публічно заявив, що llms.txt не підтримує й не планує. Представник компанії порівняв цей файл зі старим мета-тегом keywords: пошуковики давно перестали йому вірити, бо власник сайту може написати туди що завгодно. Для того, щоб потрапити в AI Overviews, Google радить звичайне SEO.

OpenAI для керування своїм ботом радить robots.txt. Жодна велика компанія не підтвердила, що використовує llms.txt, щоб вирішити, кого цитувати. А дослідження на сотнях тисяч сайтів не знайшли зв’язку між наявністю файлу й тим, як часто сайт згадують у відповідях ШІ.

То робити чи ні

Якщо у вас технічна документація, API чи продукт для розробників, файл має сенс: такі матеріали справді читають ШІ-інструменти для програмістів. Для сайту звичайної компанії це справа на 15 хвилин, яка не зашкодить, але й не допоможе помітно. Якщо підрядник продає вам llms.txt як головний спосіб потрапити в ChatGPT, це привід засумніватися в підрядникові, а не поспішати з файлом.

Що справді допомагає потрапити у відповіді ШІ

  1. Не заблокувати ШІ-ботів у robots.txt. Це часта й непомітна помилка: сайт закритий, а власник про це не знає.
  2. Віддавати текст без JavaScript. Частина ботів скриптів не виконує й бачить порожню сторінку.
  3. Давати пряму відповідь у першому абзаці сторінки, а не після трьох екранів вступу.
  4. Додати структуровані дані schema.org: хто ви, де ви, що продаєте.
  5. Скрізь однаково називати компанію, адресу й послуги.
  6. Робити звичайне якісне SEO. Для Google це той самий шлях, що й у пошук.

Як це зроблено в нас

На olbo.com.ua файл llms.txt є: він коштує 15 хвилин роботи й нічому не заважає. Але ставку ми робимо на те, що перелічено вище: відкритий robots.txt, текст без скриптів і структуровані дані.

Якщо хочете знати, як ваш сайт бачать ChatGPT і Perplexity, ми в студії OLBO робимо аудит видимості в ШІ-пошуку.