Perplexity mengutip antara tiga hingga enam sumber per jawaban, tergantung kueri. Mode browsing ChatGPT jarang menampilkan lebih dari lima. Para peneliti yang mencetuskan istilah "Generative Engine Optimization" — sebuah paper tahun 2023 dari Princeton, Georgia Tech, dan Allen AI — menemukan bahwa halaman dengan statistik yang bisa dikutip dan kutipan langsung mengalami peningkatan visibilitas hingga 40% dalam jawaban yang dihasilkan AI, sementara menambahkan lebih banyak kata kunci — hal yang dulu mendongkrak peringkat Google — hampir tidak berpengaruh sama sekali. Ketiga angka itu sering dikutip dalam tulisan-tulisan GEO. Angka keempat tidak, dan justru itulah yang seharusnya mengubah cara Anda menulis sebuah halaman: saat Anda melacak bagian mana dari sebuah dokumen yang menjadi sumber jawaban model, itu sebagian besar berasal dari sepertiga bagian atas. Bukan paragraf yang ditulis paling baik. Bukan bagian dengan detail paling lengkap. Bagian paling atas.
Mengapa "komprehensif" berhenti menjadi keunggulan
Selama lima belas tahun, saran SEO kurang lebih adalah "tulis sumber daya yang definitif." Cakup semua sudut pandang, capai 2.500 kata, kalahkan kedalaman kompetitor, dan sistem peringkat Google pada akhirnya akan menyadari Anda telah membangun jawaban paling lengkap di internet. Insting itu tidak berlaku pada cara mesin generatif memilih sumber, dan memahami alasannya membutuhkan pemahaman tentang apa yang sebenarnya terjadi di balik layar saat seseorang bertanya ke ChatGPT atau Perplexity alih-alih mengetiknya di kotak pencarian.
Mesin pencari memberi peringkat pada seluruh dokumen. Mesin generatif tidak membaca seluruh dokumen saat inferensi — ia mengambil potongan (chunk). Halaman Anda dipecah menjadi jendela-jendela yang tumpang tindih, biasanya di kisaran 300–500 token, masing-masing diubah menjadi embedding dan dinilai kemiripannya dengan kueri pengguna. Sistem mengambil beberapa chunk teratas dari semua halaman kandidat, memasukkannya ke dalam konteks model bersama pertanyaannya, lalu meminta model menyintesis jawaban. Panduan 2.500 kata Anda tidak lagi bersaing sebagai satu kesatuan. Ia bersaing chunk demi chunk, dan sebagian besar pipeline pengambilan hanya menarik satu atau dua chunk per sumber sebelum berpindah ke kutipan berikutnya.
Ini bagian yang mengejutkan saya ketika pertama kali memperhatikan halaman mana yang benar-benar dikutip untuk kueri yang saya pantau: chunk pembuka menang secara tidak proporsional sering, bahkan ketika bagian selanjutnya menjawab kueri dengan lebih tepat. Sebagian dari itu memang relevansi asli — penulis yang baik memang menaruh jawaban di dekat bagian atas. Tapi banyak juga yang bersifat struktural. Judul, H1, dan meta description mendapat bobot ekstra dalam banyak sistem pengambilan, dan bobot itu merembes ke paragraf mana pun yang berada tepat di bawahnya. Halaman yang mengubur klaim sebenarnya di bawah enam paragraf basa-basi menyerahkan materi terbaiknya ke batas chunk yang tidak bisa dikendalikannya.
Seperti apa ini dalam perbandingan nyata
| Faktor | Bobot SEO klasik | Bobot GEO |
|---|---|---|
| Jumlah kata total | Berkorelasi dengan peringkat selama bertahun-tahun | Nyaris tidak relevan setelah chunk pertama |
| Kepadatan kata kunci | Sinyal moderat, secara historis | Mendekati nol — embedding mencocokkan makna, bukan kesamaan string |
| Posisi jawaban pada halaman | Faktor UX minor | Dominan — menentukan chunk mana yang diambil |
| Statistik yang bisa dikutip / kutipan langsung | Nilai tambah untuk backlink | Hingga +40% visibilitas menurut studi Princeton/GT |
| Jumlah backlink | Sinyal peringkat utama | Paling banter tidak langsung — masih penting untuk prioritas crawl, bukan penilaian pengambilan |
Bagian yang sering disalahpahami orang
Kesalahan umum yang saya lihat saat builder mencoba "melakukan GEO" adalah memperlakukannya seperti masalah kata kunci dengan kosakata baru — mereka mencari frasa yang diketik orang ke ChatGPT dan mencoba memasukkannya ke judul. Itu bukan hal yang sia-sia, tapi itu mengoptimalkan sisi kueri dari sebuah kecocokan padahal leverage-nya hampir sepenuhnya ada di sisi dokumen. Langkah yang benar-benar terlihat dalam jumlah kutipan adalah menjawab pertanyaan dalam 150–200 kata pertama, dengan kalimat deklaratif sederhana, sebelum masuk ke nuansa, catatan tambahan, atau kisah asal-usul kenapa Anda berkompeten menjawabnya.
Saya menulis ulang salah satu halaman pusat bantuan kami murni untuk memindahkan jawabannya ke atas — konten sama, jumlah kata sama, hanya diurutkan ulang — dan halaman itu mulai muncul dalam jawaban Perplexity untuk kueri yang selama tiga bulan tidak pernah ditampilkan. Tidak ada yang lain berubah. Itu satu data point kecil, bukan sebuah studi, tapi itu jenis hal yang membuat Anda berhenti menulis intro.
Efek turunan yang layak diketahui: karena unit pengambilannya adalah chunk, bukan halaman, halaman yang panjang tidak dihukum karena kedalamannya — ia hanya tidak mendapat kredit untuk itu dalam kutipan itu sendiri, meskipun kedalaman itu mungkin alasan seorang manusia mengklik lebih jauh setelahnya. Itu berarti kebiasaan lama membanjiri bagian awal dengan basa-basi SEO ("Dalam panduan komprehensif ini, kami akan membahas...") sebenarnya merugikan Anda pada satu-satunya slot yang penting, sementara substansi sesungguhnya di bagian bawah bekerja tanpa dibayar untuk rasio klik dan waktu kunjungan tapi tidak pernah masuk ke dalam jendela konteks model sama sekali.
Apa yang sebenarnya perlu diubah
Tiga hal, diurutkan berdasarkan seberapa besar dampaknya pada halaman-halaman yang saya amati: taruh jawaban langsung atas pertanyaan tersirat di paragraf pertama, bukan yang ketiga. Gunakan angka nyata atau sumber bernama di paragraf yang sama jika Anda punya — angka 40% itu bukan kebetulan, model tampaknya memberi bobot lebih pada klaim konkret dibanding pernyataan umum saat memilih apa yang akan dikutip. Dan susun header seolah-olah masing-masing bisa jadi satu-satunya kalimat yang diambil, karena untuk sebagian besar trafik jawaban AI, memang itulah yang terjadi.
Tidak ada satu pun dari ini yang menggantikan menulis sesuatu yang layak dibaca dari awal sampai akhir. Ini hanya berarti 200 kata pembuka bukan lagi ruang basa-basi — itu adalah keseluruhan pitch Anda, ditujukan pada satu audiens yaitu model yang sedang memutuskan apakah Anda layak dikutip sama sekali.



