Metadata Citation Audit
Memeriksa citation_title, citation_author, citation_publication_date, citation_pdf_url, citation_journal_title, citation_doi, volume, issue, dan halaman.
Google Scholar Publication Optimizer
Audit website jurnal, repository, OJS, dan e-book untuk mengetahui apakah sudah siap diindeks Google Scholar. Analisis metadata citation, crawlability, robots.txt, sitemap XML, dan SEO teknis secara otomatis.
Audit teknis independen · Tanpa mengirim URL ke Google Scholar · Hasil berbasis pemeriksaan halaman publikasi
Audit menyeluruh
Satu skor tidak cukup. Scholar Audit menunjukkan sinyal teknis yang sudah benar, celah metadata yang masih terbuka, dan rekomendasi untuk pengelola jurnal atau repository.
Memeriksa citation_title, citation_author, citation_publication_date, citation_pdf_url, citation_journal_title, citation_doi, volume, issue, dan halaman.
Menganalisis robots.txt, meta robots, canonical, noindex, redirect, status code, dan sitemap.xml.
Mengecek HTTPS, title, description, heading, structured data, OpenGraph, JSON-LD, serta aksesibilitas PDF.
Menghitung skor berdasarkan crawlability, metadata, accessibility, technical SEO, dan PDF accessibility.
Panduan SEO Jurnal Ilmiah
Google Scholar membantu peneliti menemukan artikel jurnal, prosiding, tesis, buku, dan dokumen akademik lain. Sistem ini tidak bekerja seperti formulir pendaftaran URL biasa. Google Scholar menemukan dokumen dari halaman yang dapat diakses publik, tautan antarsitus, metadata bibliografi, file PDF, dan struktur website. Karena itu, optimasi Google Scholar berfokus pada keterbacaan teknis dan konsistensi data, bukan pada teknik memaksa indeks.
Crawler membutuhkan respons HTTP yang stabil, halaman tanpa login, dan jalur HTTPS yang dapat dijangkau. Redirect berantai, error 403, 404, 500, timeout, atau firewall yang memblokir jaringan tertentu dapat menghambat proses penemuan. Audit crawlability Google Scholar mengecek status URL, response time, redirect, meta robots, canonical, robots.txt, serta keberadaan sitemap XML. Hasilnya adalah indikasi kesiapan teknis, bukan bukti bahwa crawler Google memakai IP atau waktu kunjungan yang sama.
Untuk artikel jurnal, citation_title, citation_author, dan citation_publication_date merupakan fondasi. Setiap penulis sebaiknya memiliki tag citation_author sendiri. citation_journal_title relevan untuk artikel jurnal, sedangkan citation_isbn terutama untuk e-book atau monograf. DOI, ISSN, volume, issue, firstpage, dan lastpage perlu diberikan bila memang tersedia dan berlaku. Metadata yang salah atau diterapkan pada jenis publikasi yang tidak tepat dapat membuat informasi bibliografi tidak konsisten.
Highwire Press Metadata lazim disebut citation metadata karena menggunakan nama tag citation_*. Tag tersebut berada pada elemen head HTML dan memberi mesin pencari konteks yang jauh lebih jelas daripada teks visual semata. citation_pdf_url sangat dianjurkan karena menghubungkan halaman landing dengan naskah lengkap. Namun URL PDF harus benar-benar mengarah ke application/pdf, tidak meminta login, dan tidak mengunduh halaman HTML yang menyamar sebagai PDF.
robots.txt dapat mengarahkan crawler, sedangkan meta robots mengatur perilaku pada halaman tertentu. Aturan noindex pada artikel atau pembatasan yang terlalu luas bisa menjadi alasan jurnal tidak muncul di Google Scholar. Canonical membantu menjelaskan URL utama saat OJS menghasilkan beberapa variasi URL. Sitemap XML mempercepat penemuan struktur situs, meskipun sitemap bukan jaminan indeks. Semua elemen ini harus konsisten: canonical harus mengarah ke halaman artikel publik yang dapat di-crawl dan sitemap perlu memuat URL yang sama.
OJS dapat menghasilkan metadata yang baik jika data submission terisi lengkap. Pengelola perlu memeriksa judul, semua penulis, abstrak, kata kunci, DOI, tanggal terbit, galley PDF, issue, dan halaman. Repository juga perlu menyediakan landing page yang kaya metadata, bukan hanya file unduhan. Untuk e-book, fokus pada citation_title, citation_author, publication date, publisher, language, PDF publik, dan ISBN jika buku memilikinya. Jangan menghukum buku utuh karena tidak memiliki citation_journal_title atau nomor issue.
File PDF harus dapat dibuka dari internet tanpa sesi pengguna, memiliki content type yang tepat, ukuran wajar, dan nama file yang mudah dikelola. Halaman HTML tetap penting karena crawler membutuhkan konteks bibliografi. PDF yang dipindai tanpa lapisan teks dapat mengurangi keterbacaan, sementara file yang diblokir WAF atau hanya dapat diakses dari jaringan kampus akan menjadi hambatan. Pastikan link PDF pada halaman publikasi tetap hidup saat migrasi OJS atau perubahan domain.
Perbaiki masalah paling mendasar terlebih dahulu: pastikan URL dan PDF merespons 200, hilangkan login wajib, lengkapi citation metadata, gunakan HTTPS, dan buat sitemap. Setelah perubahan diterbitkan, lakukan audit ulang dan tunggu siklus crawler. Jangan berulang kali mengubah URL artikel atau menghapus halaman lama tanpa redirect yang benar. Pengindeksan membutuhkan waktu, dan tidak ada alat yang dapat menjamin kapan Google Scholar akan mengambil dokumen.
Kesalahan paling umum adalah title HTML generik, author hanya tercantum sebagai teks, citation_pdf_url kosong, metadata jurnal dipasang pada e-book, PDF menghasilkan 403, canonical tidak ada, serta robots.txt memblokir path publikasi. Audit metadata citation membantu memisahkan masalah yang harus diperbaiki penerbit dari masalah jaringan yang perlu ditangani administrator hosting. Gunakan rekomendasi audit sebagai daftar kerja, lalu simpan histori skor agar perubahan teknis dapat dibandingkan dari waktu ke waktu.
Halaman publikasi idealnya memiliki satu URL utama yang merespons HTTP 200. Gunakan redirect 301 bila artikel berpindah, tetapi hindari rantai redirect panjang, URL sementara, atau URL yang berubah setelah terbit. URL publikasi yang konsisten membantu crawler memahami hubungan antara halaman landing, canonical, file PDF, DOI, dan sitemap. Pastikan versi HTTP mengarah ke HTTPS dan tidak ada perbedaan metadata penting antara dua versi halaman.
JSON-LD schema.org, OpenGraph, title HTML, meta description, heading H1, dan bahasa halaman tidak menggantikan citation metadata. Namun elemen tersebut tetap memperbaiki pemahaman mesin pencari umum, tampilan saat tautan dibagikan, serta kualitas technical SEO journal. Gunakan judul halaman yang spesifik, abstrak yang informatif, dan struktur heading yang berurutan. Hindari mengulang kata kunci secara tidak natural karena kualitas konten tetap lebih penting daripada kepadatan istilah.
Setelah memperbaiki metadata atau konfigurasi OJS, lakukan audit ulang pada halaman artikel, bukan hanya beranda jurnal. Periksa juga beberapa artikel dari issue berbeda dan satu halaman PDF untuk memastikan perubahan diterapkan oleh tema serta plugin. Catat tanggal perubahan, skor, dan error teknis. Bila akses dari server audit gagal karena firewall atau WAF, minta administrator hosting menguji port 80/443 dari jaringan publik dan mempertimbangkan allowlist yang sesuai. Kebijakan keamanan yang terlalu ketat dapat menghambat pembaca maupun crawler akademik.
FAQ
Penyebab umum meliputi metadata citation tidak lengkap, halaman atau PDF tidak dapat diakses crawler, robots.txt atau noindex, URL yang tidak stabil, serta situs belum dirayapi kembali.
Pastikan halaman artikel publik, memiliki citation_title dan citation_author, PDF dapat dibaca tanpa login, canonical dan sitemap valid, lalu tunggu crawler Google Scholar melakukan penemuan ulang.
Metadata Citation adalah meta tag bibliografi seperti citation_title, citation_author, citation_publication_date, dan citation_pdf_url yang membantu Google Scholar memahami sebuah publikasi.
citation_title menyampaikan judul karya ilmiah secara eksplisit kepada crawler dan merupakan salah satu metadata paling penting.
Google Scholar menemukan halaman akademik melalui tautan publik, sitemap, metadata, dan struktur situs; frekuensi crawl tidak dapat dikendalikan oleh aplikasi ini.
Highwire Press Metadata adalah format meta tag citation_* yang umum digunakan untuk menyajikan informasi bibliografi artikel atau buku kepada Google Scholar.
robots.txt mengatur bagian situs yang boleh dirayapi. Aturan yang terlalu ketat dapat menghambat halaman artikel atau PDF ditemukan crawler.
Periksa status HTTP, HTTPS, redirect, robots.txt, meta robots, canonical, sitemap, dan akses PDF tanpa login.
OJS menyediakan fondasi metadata, tetapi tema, konfigurasi, isian metadata artikel, PDF, dan akses server tetap perlu diaudit.
Lengkapi metadata yang relevan, sediakan PDF publik, perbaiki noindex atau blokir robots, gunakan canonical yang benar, serta masukkan URL publikasi ke sitemap.
Cek metadata Google Scholar, robots.txt, sitemap XML, PDF, dan crawlability dalam satu laporan.