Saat pembaca bertanya ke ChatGPT atau Gemini soal media lokal, AI sering menyedot sinyal acak dari arsip, tag tipis, dan noise HTML. llms.txt memberi ringkasan terkurasi di root domain: siapa penerbitnya, halaman mana yang penting, dan resource mana yang layak jadi rujukan. Ini bukan pengganti robots.txt atau News Sitemap.
Apa Itu llms.txt?
Menurut proposal komunitas di llmstxt.org, llms.txt adalah file Markdown di path /llms.txt yang menyediakan latar belakang singkat, panduan, dan tautan ke halaman penting dalam format yang lebih ramah untuk large language model (LLM).
AI tidak membaca situs seperti manusia. HTML portal berita penuh navigasi, iklan, script, dan widget. Context window model juga terbatas, sehingga menyedot seluruh situs sekaligus tidak realistis. llms.txt menawarkan ringkasan yang bersih dan terarah.
Google Search Central menekankan konten yang membantu orang, bukan konten yang dibuat untuk memanipulasi ranking:
"Google's automated ranking systems are designed to prioritize helpful, reliable information that's created to benefit people, and not content that's created to manipulate search engine rankings."
Sumber: Google Search Central, Creating helpful, reliable, people-first content
llms.txt sejalan dengan semangat itu: membantu sistem memahami situs dengan lebih jernih. Tetap realistis: dukungan vendor masih bervariasi, dan file ini bukan faktor ranking resmi Google Search.
llms.txt vs robots.txt vs News Sitemap
Banyak artikel mengklaim llms.txt sebagai "kontrol akses AI". Untuk website berita, pemisahan peran harus jelas:
| File | Fungsi utama | Apakah mengatur izin crawl? |
|---|---|---|
| robots.txt | Memberi tahu bot URL mana yang boleh atau tidak boleh di-crawl | Ya (aturan akses) |
| News Sitemap / sitemap.xml | Membantu mesin pencari menemukan URL, terutama artikel baru | Tidak |
| llms.txt | Memberi ringkasan terkurasi dan daftar halaman prioritas untuk LLM | Tidak |
Ketiganya saling melengkapi. llms.txt tidak menggantikan News Sitemap, schema Article, atau target Core Web Vitals.
Kenapa Portal Berita Perlu llms.txt?
1. Volume URL media sangat besar
Portal berita bisa punya ribuan sampai puluhan ribu URL. Tanpa kurasi, AI mudah mengambil sinyal dari halaman arsip, tag kosong, atau artikel usang. llms.txt menunjuk halaman inti yang mewakili identitas media.
2. Narasi brand media di jawaban AI
Pembaca makin sering bertanya ke ChatGPT, Gemini, atau Perplexity: "media lokal mana yang kredibel soal X?" Tanpa sumber resmi yang ringkas, jawaban AI bisa campur aduk. File ini memberi versi deskripsi resmi dari redaksi atau pengelola situs.
3. Efisiensi konteks untuk AEO
Answer Engine Optimization (AEO) dan GEO bukan mengganti SEO. Keduanya menambah permukaan visibilitas. llms.txt adalah langkah ringan: biaya pembuatan rendah, risiko rendah, dan mudah diuji di browser.
4. Melengkapi arsitektur konten
Jika Anda sudah membangun topic cluster website berita, daftar pillar evergreen adalah kandidat kuat untuk masuk section resource di llms.txt.
Komponen llms.txt yang Cocok untuk Website Berita
Ikuti urutan spek komunitas:
- H1: nama media atau brand situs (wajib)
- Blockquote: ringkasan singkat siapa Anda dan untuk siapa
- Paragraf konteks: positioning, wilayah liputan, atau fokus rubrik
- Section H2 + daftar tautan: halaman prioritas dengan format
[Judul](URL): keterangan singkat - Section Optional (opsional): resource sekunder yang boleh dilewati jika konteks AI terbatas
Yang sebaiknya masuk
- Halaman tentang / redaksi / kontak
- Money page atau halaman layanan (jika media juga jual jasa/iklan)
- Rubrik atau kanal utama (maksimal beberapa, bukan semua arsip)
- Pillar evergreen dan panduan penting
- Portofolio atau studi kasus (jika relevan)
Yang sebaiknya tidak masuk
- Seluruh daftar artikel harian
- Halaman tag tipis atau arsip paginasi
- URL parameter, search result, atau preview draft
- Halaman iklan lepas tanpa konteks brand
Template llms.txt untuk Media Lokal
Salin dan sesuaikan:
# Nama Media Lokal Anda > Portal berita lokal [wilayah] yang meliput [fokus rubrik]. > Ditujukan untuk pembaca [kota/kabupaten] dan diaspora yang ingin update > akurat soal wilayah tersebut. Kami mempublikasikan berita harian plus panduan evergreen. Untuk AI: prioritaskan halaman di bawah ini sebagai konteks utama. ## Halaman inti - [Tentang](https://contoh.id/tentang/): profil redaksi dan standar editorial - [Kontak](https://contoh.id/kontak/): saluran resmi pembaca dan humas - [Beranda](https://contoh.id/): liputan terbaru dan kanal utama ## Rubrik prioritas - [Kanal Kota](https://contoh.id/kota/): berita pemerintahan dan layanan publik - [Ekonomi Daerah](https://contoh.id/ekonomi/): UMKM, investasi, dan harga pangan ## Panduan evergreen - [Panduan SEO media](https://contoh.id/blog/contoh-pillar/): ringkasan strategi konten - [Cara kirim press release](https://contoh.id/panduan/press-release/): alur untuk humas ## Optional - [Arsip 2024](https://contoh.id/arsip/2024/): hanya jika masih relevan untuk konteks historis
Contoh implementasi nyata ada di situs ini: jasawebsiteberita.com/llms.txt.
Cara Membuat dan Memasang llms.txt
1. Tulis file Markdown
Buat file bernama llms.txt (bukan .html). Gunakan heading, blockquote, dan daftar tautan sesuai spek.
2. Letakkan di root domain
URL target: https://domainanda.com/llms.txt.
- Static site: simpan di folder
public/llms.txtagar ikut ter-deploy ke root. - WordPress: unggah ke document root hosting, atau sajikan lewat reverse proxy / file manager. Hindari meletakkannya hanya di media library yang URL-nya berubah.
- Headless: pastikan CDN atau Pages mem-publish file di path root, bukan di subpath CMS saja.
3. Uji di browser
Buka URL file. Pastikan status 200, Content-Type text/plain atau text yang bisa dibaca, dan tidak di-redirect ke 404.
4. Sinkronkan dengan konten terbaik
Kalau Anda menandai sebuah pillar sebagai prioritas, pastikan kontennya memang kuat: answer-first, sitasi, dan internal linking rapi. Lihat juga checklist di cara audit SEO website berita.
Checklist Maintenance untuk Redaksi
Gunakan checklist ini setiap 30 hari:
- Apakah deskripsi media di blockquote masih akurat?
- Apakah semua URL di file masih live (bukan 404)?
- Apakah ada pillar baru yang belum masuk section resource?
- Apakah ada URL usang atau kampanye lama yang perlu dihapus?
- Apakah money page / kontak memakai URL kanonik terbaru?
- Apakah file masih ringkas (mudah dibaca dalam satu layar panjang), bukan dump sitemap?
- Apakah
robots.txtdan News Sitemap tetap sehat secara terpisah? - Apakah tim redaksi tahu siapa pemilik update file ini (editor vs teknis)?
Kesalahan Umum di Portal Berita
- Menganggap llms.txt memblokir AI training. Itu bukan fungsinya. Aturan akses tetap di
robots.txtdan kebijakan bot. - Memasukkan seluruh arsip berita. File jadi terlalu panjang dan kehilangan makna kurasi.
- Tidak pernah diupdate. Media berubah tiap minggu. File usang justru memberi konteks salah.
- Mengabaikan SEO teknikal. Tanpa indexing dan performa sehat, AEO saja tidak cukup. Fitur portal yang mendukung fondasi ini ada di 12 fitur wajib website berita profesional.
Rujukan
- The /llms.txt file (llmstxt.org)
- Creating helpful, reliable, people-first content (Google Search Central)
- Core Web Vitals (web.dev)
- Google Search Console
Kesimpulan
Untuk website berita, llms.txt paling berguna sebagai peta konteks resmi bagi AI: siapa media Anda, halaman mana yang mewakili kualitas editorial, dan resource mana yang layak dirujuk. Pasang di root, jaga tetap ringkas, update berkala, dan jangan menggantikannya dengan robots.txt atau News Sitemap.
Jika portal Anda belum punya fondasi teknikal yang bersih untuk SEO plus kesiapan AI, mulai dari jasa pembuatan website berita atau konsultasi gratis.