
Berdasarkan Louise Linehan
Content Marketer di Ahrefs
Konten Anda bisa saja bagus, tetapi tetap tidak pernah masuk ke jawaban AI.
Setiap taktik optimasi AI mengasumsikan sistem AI bisa menjangkau halaman Anda, membacanya, dan memahami siapa Anda. Tidak ada satu pun yang bisa dianggap pasti. Sekitar 5,89% situs memblokir GPTBot secara langsung, ChatGPT tampaknya meninggalkan halaman yang butuh lebih dari sekitar dua detik untuk merespons, dan sebagian besar crawler AI sama sekali tidak menjalankan JavaScript.
Kabar baiknya, ini adalah bagian AEO yang paling mudah diperbaiki. Tidak ada satu pun hal di sini yang otomatis membuat Anda mendapatkan kutipan, tetapi satu saja dari masalah ini dapat diam-diam membuat Anda kehilangan semua kutipan yang seharusnya Anda dapatkan.
Lanjutkan belajar di YouTube
Tidak satu pun tips di panduan ini penting jika crawler AI tidak bisa membaca halaman Anda. Halaman yang diblokir tidak dapat dikutip, dan ini sering terjadi tanpa sengaja.
Kami menganalisis sekitar 140 juta situs web dan menemukan GPTBot kini menjadi bot AI yang paling sering diblokir (5,89% situs), dengan ClaudeBot menyusul di belakangnya.
Cloudflare secara default memblokir platform AI, jadi pastikan CDN Anda tidak diam-diam menonaktifkan akses Anda.
“Mengizinkan crawler AI” bukanlah satu keputusan saja, karena setiap platform menjalankan beberapa bot yang melakukan pekerjaan berbeda.
OpenAI saja menjalankan tiga:
Komprominya berbeda untuk masing-masing. Memblokir GPTBot membuat konten Anda tidak masuk ke data pelatihan model berikutnya—ini keputusan yang biasanya sedang dipertimbangkan penerbit. Memblokir OAI-SearchBot menghapus Anda dari indeks yang digunakan ChatGPT untuk melakukan pencarian, dan inilah yang saat ini membuat Anda kehilangan kutipan dan traffic rujukan. Banyak situs tidak sengaja memblokir yang kedua, padahal hanya bermaksud memblokir yang pertama.
Cara tercepat untuk melihat posisi Anda adalah menggunakan tool seperti AI Crawler Access Checker, yang membaca robots.txt Anda dan memberi tahu crawler mana yang diizinkan masuk.

Untuk melihat bot mana yang benar-benar muncul, bukan sekadar mana yang diizinkan, cek Bot Analytics Ahrefs. Ini melacak kunjungan di 12 kategori bot, termasuk filter AI khusus, menggunakan data sisi server melalui Cloudflare, jadi bisa berfungsi tanpa menambahkan JavaScript apa pun ke situs Anda.
Crawler AI cenderung membaca HTML mentah dan biasanya tidak merender JavaScript seperti yang dilakukan browser.
Artinya, apa pun yang hanya muncul setelah JS sisi klien bisa jadi tidak terlihat oleh mereka.
Main aman dan gunakan server-side rendering agar halaman Anda punya peluang terbaik untuk terlihat oleh AI.
Halaman yang lambat dimuat dapat berdampak negatif pada performa Anda di pencarian tradisional, tetapi tampaknya dampaknya bahkan lebih besar di mesin jawaban. Kecepatan halaman tampaknya membantu menentukan apakah Anda bisa masuk ke jendela konteks model sama sekali.1
Periksa kecepatan halaman Anda (dikenal sebagai time-to-first-byte) di Site Audit:
llms.txt adalah standard yang diusulkan untuk file Markdown di root domain Anda (misalnya website.com/llms.txt) yang memberi tahu LLM di mana konten terbaik Anda berada: dokumentasi, kebijakan, taksonomi produk. Pada prinsipnya, ini seperti robots.txt untuk model bahasa.
Namun dalam praktiknya, tidak ada penyedia LLM besar yang berkomitmen untuk membacanya. Bukan OpenAI, bukan Anthropic, bukan Google.
Kami memeriksa apa yang sebenarnya terjadi ketika sebuah website menambahkan llms.txt. Dari 137.000 domain yang menggunakan Ahrefs Web Analytics, 28% menerbitkan file llms.txt. Dari ~38.000 yang memiliki file valid, 97% menerima nol permintaan untuk file tersebut pada bulan yang kami ukur.
97% file llms.txt tidak pernah diminta
Studi Ahrefs terhadap 137.000 domain menggunakan Ahrefs Web Analytics.

Dari sebagian kecil file yang memang sempat diambil, 96% permintaan berasal dari bot. Slackbot, bot pratinjau link, mengambil llms.txt lebih sering daripada PerplexityBot. Singkatnya, mesin pencari AI terpenting tampaknya tidak menggunakannya.
Google sudah menyatakannya dengan jelas. Panduannya tentang mengoptimalkan fitur AI generatif memiliki bagian yang secara harfiah berjudul “membongkar mitos” yang mengatakan bahwa file yang dapat dibaca mesin seperti llms.txt tidak diperlukan agar bisa muncul di penelusuran AI generatif. John Mueller melangkah lebih jauh, membandingkannya dengan tag meta keywords lama:
Sejauh yang saya tahu (AFAIK), tidak ada layanan AI yang mengatakan bahwa mereka menggunakan LLMs.TXT (dan Anda bisa melihat dari log server bahwa mereka bahkan tidak mengeceknya). Bagi saya, ini mirip dengan meta tag keywords—ini adalah klaim pemilik situs tentang topik situsnya… (Apakah situsnya benar seperti itu? Ya, Anda bisa mengeceknya. Kalau begitu, kenapa tidak langsung cek situsnya saja?)
John Mueller, Search Advocate, Google
Jadi, apakah Anda perlu membuatnya? Jika Anda menerbitkan dokumentasi developer, biayanya sekitar sepuluh menit dan ada kasus penggunaan yang masuk akal. Mueller menggambarkannya sebagai “penopang sementara, mungkin untuk menghemat beberapa token” bagi tool coding AI yang mengurai dokumentasi. Untuk yang lain, ini adalah upaya tanpa hasil yang terukur, ditambah sedikit sisi negatif karena membuat konten Anda lebih mudah di-scrape secara massal oleh kompetitor.
Asisten AI mengarang link ke website Anda, dan mereka sering melakukannya. Kami memeriksa status HTTP dari 16 juta URL yang dikutip oleh ChatGPT, Perplexity, Copilot, Gemini, Claude, dan Mistral, dan menemukan bahwa asisten AI mengarahkan pengunjung ke halaman 404 2,87 kali lebih sering daripada Google Search.
ChatGPT adalah yang paling bermasalah dengan selisih yang jauh. Sebanyak 1,01% URL yang dikliknya menghasilkan 404, dibandingkan patokan Google sebesar 0,15%.
Tingkat 404 berdasarkan channel rujukan
Data Web Analytics - 16.000.000 URL dianalisis.

Perplexity (0,87%) dan Gemini (0,86%) berada hampir tepat di angka 0,84% milik Google sendiri untuk URL yang dikutip. Itu masuk akal, karena keduanya mengambil dari indeks Google, sehingga mereka mewarisi tautan rusak dari Google alih-alih menciptakan link mereka sendiri.
URL yang dikarang disimpulkan dari pola yang sudah ada. Salah satu URL halusinasi yang umum untuk situs kami adalah ahrefs.com/keywords, karena kami terus-menerus menulis tentang kata kunci dan model menganggap halaman seperti itu pasti ada. Ternyata tidak ada.
Ini adalah salah satu dari sedikit kemenangan AEO yang benar-benar gratis. Seseorang dengan niat yang nyata bertanya tentang produk Anda, diarahkan ke situs Anda, lalu menemui jalan buntu. Anda akan menemukan tiga tipe yang berbeda:
Karena itu, kami menambahkan filter di Web Analytics yang akan membantu Anda menemukan URL halusinasi hanya dalam dua klik. Jika Anda mencari alternatif Google Analytics yang sederhana, gratis hingga 1 juta event tiap bulan, cek ini:
Jika URL halusinasi terus diminta, model itu sedang memberi tahu Anda halaman mana yang pengunjung Anda harapkan tersedia di situs Anda.
Setiap taktik dalam panduan ini pada akhirnya bergantung pada satu hal: apakah sistem AI mengenali brand Anda sebagai entitas yang berbeda.
Tahukah Anda?
Entitas adalah segala sesuatu yang berbeda dan nyata di dunia yang dapat dikenali dan dibedakan oleh mesin pencari atau AI dari hal lainnya—orang, tempat, perusahaan, produk, atau konsep tertentu (seperti “Dmytro Gerasymenko”, “Ahrefs”, atau “Singapore”), bukan sekadar kata-kata yang digunakan untuk mendeskripsikannya.

Knowledge Graph Google—basis data berisi 54 miliar entitas dan lebih dari 1,6 triliun fakta tentang bagaimana entitas-entitas tersebut saling berhubungan—kini bukan lagi sekadar mesin di balik panel pengetahuan.
Sekarang ini menjadi infrastruktur inti untuk AI Overview, AI Mode, dan Gemini.
Jika merek Anda tidak terbentuk dengan jelas sebagai sebuah entitas—dengan sinyal yang konsisten di seluruh situs Anda, data terstruktur, dan sumber pihak ketiga yang otoritatif—Anda berisiko tidak terlihat dalam jawaban AI, bukan hanya di link biru.
Schema sering dipromosikan sebagai kemenangan cepat untuk visibilitas AI, dan korelasi permukaannya terlihat meyakinkan: halaman yang dikutip AI hampir tiga kali lebih mungkin memiliki JSON-LD.
Schema jauh lebih umum pada halaman yang dikutip oleh AI
Studi Ahrefs terhadap 6 juta halaman (2 juta halaman per grup).

Namun korelasi bukanlah sebab. Kami melacak 1.885 halaman yang menambahkan JSON-LD dibandingkan 4.000 kontrol dan tidak menemukan peningkatan yang berarti di AI Mode maupun ChatGPT, serta penurunan kecil di AI Overview yang tidak bisa kami kaitkan dengan schema.
Jadi, apakah schema tidak berguna? Tidak, tetapi perannya lambat dan tidak langsung, bukan taktik untuk meraih hasil cepat.
Anda bisa memeriksa apakah Google sudah mengenali Anda dengan Knowledge Graph API milik Google atau pemeriksa gratis untuk melihat jenis entitas apa yang diberikan kepada Anda dan apakah atributnya sudah benar.
Misalnya, Knowledge Graph Tool dari Carl Hendy menampilkan hasil untuk orang, perusahaan, produk, tempat, dan entitas lainnya.

Dari sana, cobalah mendapatkan penyebutan dari publikasi yang berotoritas dan jaga agar fakta Anda konsisten di mana pun: nama, deskripsi, dan kategori yang sama di seluruh situs Anda, profil Anda, dan listing pihak ketiga.
Lalu tambahkan schema secara wajar, dengan memprioritaskan tipe yang mendefinisikan entitas Anda dan relasinya:
Schema Organization dan sameAs yang menaut ke Wikipedia, Wikidata, dan profil sosial Anda
Schema Person untuk penulis situs Anda
Schema Product untuk penawaran Anda
Tip
Temukan halaman dengan otoritas tertinggi Anda dan pastikan halaman-halaman tersebut memiliki markup schema yang bersih.
Anda bisa melakukan ini dengan membuka laporan Page Explorer di Site Audit, lalu mengurutkan berdasarkan “Peringkat Halaman”.
Page Rating (PR) menunjukkan kekuatan profil backlink internal dan eksternal URL dibandingkan dengan URL lain yang disertakan di dalam crawl.
Lalu periksa kolom “Item Schema” untuk mengaudit schema yang sudah ada, dan kolom “Masalah data terstruktur” untuk menemukan data terstruktur yang hilang atau tidak valid.
Saya tutup dengan pemikiran terakhir ini: semakin banyak “pembaca” yang Anda coba pengaruhi sebenarnya adalah agen AI yang menjelajah dan membeli atas nama audiens Anda.
Bahkan, pada Juni 2026, CEO Cloudflare, Matthew Prince, mengungkapkan bahwa traffic agentic (bot/crawler/agent) untuk pertama kalinya melampaui angka 50% dalam sejarah internet.2, 3

Jauh dari sekadar kasus khusus atau hal baru, pencarian untuk “agentic AI” melonjak 84 kali dalam tiga tahun, seiring biaya menjalankan agen turun dari dolar menjadi sen.
Anda belum perlu membangun ulang website semata-mata untuk agen AI. Namun, saran lama untuk membuat konten hanya untuk manusia dan tidak perlu mengkhawatirkan robot mungkin sudah tidak sepenuhnya relevan seperti dulu.
Bab ini membahas cara memengaruhi AI yang dipercaya manusia, dan pemasaran antaragen adalah hal itu—tetapi dibawa selangkah lebih jauh.

Louise adalah Pemasar Konten di Ahrefs. Selama sepuluh tahun terakhir, ia memegang posisi konten senior di berbagai merek SaaS: Pi Datametrics, BuzzSumo, dan Cision. Selama periode ini, ia telah menerbitkan ratusan postingan blog, memimpin riset terkemuka di industri, dan mengembangkan program webinar yang dipandu ahli.
Louise pertama kali mempelajari seluk-beluk SEO saat bekerja di perusahaan enterprise SEO, Pi. Dalam hitungan minggu setelah bergabung, ia menerbitkan sebuah artikel tentang kanibalisasi yang menarik perhatian nama terbesar di dunia SEO pada saat itu: Rand Fishkin. Sejak itu, ia menulis tentang berbagai topik, mulai dari link building manipulatif hingga sindikasi konten, dan peramalan permintaan penelusuran. Di waktu luangnya, ia memperdalam pemahaman praktisnya tentang SEO dengan membangun website untuk dua bisnis lokal.
Anda dapat membaca tulisan Louise di publikasi industri seperti Search Engine Watch, The Drum, The Telegraph, dan Spin Sucks.
Mulai dari sini. Apa itu AEO, apa bedanya dengan SEO, dan tujuh langkah untuk memulainya.
Bagaimana proses antara prompt dan jawaban, serta di mana merek Anda bisa masuk dalam proses itu.
Anda tidak bisa mengoptimalkan sesuatu tanpa bukti. Tujuh cara mengukur di mana merek Anda muncul dalam jawaban AI.
Lacak klaster prompt, bukan respons satu kali. Sebelas tempat untuk menemukan kueri yang layak dipantau.
Mendapatkan peringkat membuat Anda dipertimbangkan. Ini cara agar Anda dikutip — topik, format, dan perubahan on-page yang efektif.
AI merekomendasikan merek yang pernah dilihatnya dibahas di tempat lain. Ini cara memantau dan mendapatkan lebih banyak penyebutan.
Perbaikan teknis yang akan menentukan AI dapat menjangkau halaman Anda, membacanya, dan memahami siapa Anda.