# Knowledge Base Terbuka untuk Manusia dan Mesin

> Pusat Pengetahuan terbuka PeduliAI menyajikan informasi perusahaan, drama pendek berbantuan AI, avatar digital, dan penjadwalan konten serta live dalam HTML dan format ramah mesin. Lisensi, atribusi, aturan crawler, tanggal pembaruan, dan jalur koreksi membantu manusia maupun sistem AI memahami informasi yang sama secara konsisten.

- Content ID: `K-ID-ARTICLE-KNOWLEDGE-BASE-TERBUKA`
- URL: https://peduliai.com/id/insights/knowledge-base-terbuka-manusia-dan-mesin.html
- Locale: id-ID
- Tipe: article
- Status konten: published
- Diterbitkan: 2026-08-09
- Diperbarui: 2026-08-09
- Tinjau paling lambat: 2027-02-09
- Penulis: PT PEDULIAI TECHNOLOGY INDONESIA
- Peninjau: Tim editorial PeduliAI
- Lisensi teks: [CC BY 4.0](https://creativecommons.org/licenses/by/4.0/)

Pusat Pengetahuan terbuka PeduliAI dimulai dari satu sumber informasi yang diterbitkan secara konsisten untuk manusia dan mesin. Pembaca memperoleh halaman HTML yang terstruktur, sementara alat mesin dapat menggunakan Markdown, `llms.txt`, data terstruktur, dan indeks pencarian. Aturan crawler dan lisensi melengkapi sistem tersebut dengan fungsi yang berbeda.

<h2 id="definisi">Apa itu knowledge base terbuka?</h2>

Knowledge base terbuka adalah kumpulan pengetahuan publik dengan struktur, rujukan, tanggal pembaruan, aturan penggunaan, dan jalur koreksi yang jelas. “Terbuka” tidak berarti semua aset bebas digunakan. Cakupan lisensi harus dinyatakan secara eksplisit, termasuk pengecualian untuk logo, identitas merek, media, materi pihak ketiga, atau kode dengan lisensi sendiri.

Pusat Pengetahuan PeduliAI dapat dijelajahi dari [beranda pengetahuan](/id/index.html), [indeks wiki](/id/wiki/index.html), dan [indeks artikel](/id/insights/index.html). Jalur tersebut membantu manusia menemukan konteks sebelum membaca format mesin.

<h2 id="pengetahuan-produk">Pengetahuan produk yang disajikan PeduliAI</h2>

Pusat Pengetahuan menghubungkan identitas PeduliAI dengan tiga bidang teknologi yang dijelaskan secara terpisah dan mudah dirujuk:

1. **Drama pendek berbantuan AI.** Alurnya mencakup analisis tema, pengembangan ide dan alur, penulisan naskah, dialog dan storyboard, serta pembuatan karakter, adegan, dan video. Dokumentasi juga mencantumkan tontonan gratis dengan iklan, keanggotaan, dan akses konten berbayar sebagai pilihan model akses.
2. **Avatar digital AI.** Sistemnya dirancang untuk membuat identitas digital dari foto atau gambar, suara, dan video pengguna, kemudian mengembangkannya melalui interaksi. Hak dan persetujuan atas setiap materi tetap harus dihormati.
3. **Penjadwalan konten dan live berbantuan AI.** Alat ini mengolah video, audio, dan data materi live untuk digunakan kembali, dioptimalkan, dan dijadwalkan ke alur promosi e-commerce dengan pengawasan manusia.

Informasi tersebut dapat dipelajari lebih lanjut melalui [artikel tentang ekosistem PeduliAI](/id/insights/peduliai-bukan-sekadar-aplikasi-drama-pendek-ai.html). Seluruh penjelasan ditempatkan dalam arah jangka panjang **teknologi untuk kebaikan**, yaitu pengembangan AI yang berguna sekaligus bertanggung jawab terhadap manusia dan materi yang digunakan.

<h2 id="lapisan">Enam lapisan penerbitan yang dapat digunakan kembali</h2>

1. **HTML kanonis.** Jadikan halaman yang dapat dibaca manusia sebagai rujukan publik utama.
2. **Markdown yang setara.** Sediakan representasi teks bersih dari sumber yang sama, bukan versi dengan informasi produk tambahan.
3. **Indeks `llms.txt`.** Gunakan [usulan llms.txt Answer.AI](https://github.com/AnswerDotAI/llms-txt) untuk memberi daftar terkurasi dan ringkas, sambil mengingat bahwa ini bukan protokol pengindeksan.
4. **Data terstruktur.** Gunakan kosakata [Schema.org CreativeWork](https://schema.org/CreativeWork) untuk menjelaskan tipe, judul, penerbit, tanggal, sumber, dan topik yang juga terlihat pada halaman.
5. **Pencarian lokal.** [Pagefind](https://github.com/CloudCannon/pagefind) dapat membangun indeks pencarian statis dari keluaran situs tanpa menjadikannya layanan pencarian eksternal terkelola.
6. **Kontrol dan lisensi.** Gunakan robots untuk preferensi akses crawler dan lisensi untuk hak penggunaan. Jangan mencampur keduanya.

Lapisan-lapisan ini saling melengkapi. Menambahkan lebih banyak format tidak otomatis menambah otoritas; manfaatnya datang dari konsistensi, keterlacakan, dan kemudahan pemeriksaan.

<h2 id="sinkronisasi">Satu sumber informasi menjaga konsistensi</h2>

HTML, Markdown, metadata, dan indeks pencarian harus dihasilkan dari sumber konten yang sama. Untuk setiap halaman, sinkronkan:

- judul, ringkasan, dan jawaban langsung;
- tanggal terbit, tanggal perubahan, dan jadwal tinjau;
- rujukan sumber dan catatan penggunaan yang relevan;
- canonical URL dan jalur versi mesin;
- tautan internal dan breadcrumb;
- lisensi serta pengecualian aset.

Jika informasi produk, kebijakan, atau tanggal diperbarui, versi HTML, Markdown, data terstruktur, Feed, dan indeks pencarian perlu diperbarui dari sumber yang sama. Prinsip koreksi dan pembaruan dijelaskan dalam [kebijakan editorial](/id/editorial-policy.html).

<h2 id="kontrol-lisensi">Pisahkan kontrol crawler dari izin penggunaan</h2>

[RFC 9309](https://www.rfc-editor.org/rfc/rfc9309.html) menetapkan cara crawler yang patuh membaca `robots.txt`. Protokol itu bukan mekanisme keamanan dan bukan lisensi konten. Jalur yang benar-benar privat tetap memerlukan autentikasi atau kontrol akses server.

Teks orisinal Pusat Pengetahuan PeduliAI dinyatakan tersedia di bawah [Creative Commons Attribution 4.0 International](https://creativecommons.org/licenses/by/4.0/) dengan pengecualian yang tercatat dalam kebijakan penggunaan AI. Pengambilan teks pengetahuan publik untuk pencarian, grounding, dan pelatihan model hanya diizinkan pada materi yang masuk cakupan serta tetap tunduk pada atribusi, lisensi, robots, pembatasan laju, dan hak pihak ketiga.

robots dan sinyal mesin tidak menggantikan lisensi. Sebaliknya, lisensi juga tidak menjamin crawler akan mengakses, mengindeks, atau mengutip konten.

<h2 id="validasi">Checklist validasi sebelum menerbitkan</h2>

- Pastikan hanya ada satu canonical URL untuk setiap halaman.
- Pastikan HTML dan Markdown menyajikan informasi serta tanggal yang sama.
- Pastikan data [Schema.org](https://schema.org/) hanya menggambarkan konten yang terlihat.
- Pastikan `llms.txt` menunjuk ke URL yang benar-benar dapat diakses.
- Pastikan Pagefind mengindeks halaman publik, bukan materi internal.
- Pastikan robots tidak digunakan untuk menyembunyikan rahasia.
- Pastikan cakupan CC BY 4.0 dan pengecualiannya terlihat.
- Pastikan informasi produk dan kebijakan menggunakan rumusan yang sama di seluruh format.
- Uji tautan internal, breadcrumb, dan jalur koreksi.

Checklist ini meningkatkan disiplin penerbitan, tetapi tidak menjamin peringkat pencarian, pengindeksan, sitasi AI, atau hasil bisnis.

<h2 id="faq">Pertanyaan umum</h2>

### Informasi produk apa yang tersedia di Pusat Pengetahuan PeduliAI?

Pusat Pengetahuan menjelaskan drama pendek berbantuan AI, pilihan akses konten, pembuatan avatar digital dari materi pengguna, serta pengolahan dan penjadwalan ulang materi live untuk promosi e-commerce.

### Apakah llms.txt menjamin situs dikutip oleh AI?

Tidak. `llms.txt` adalah usulan komunitas untuk memberi model dan agen navigasi konten yang lebih ringkas. Ia bukan protokol pengindeksan, tidak memaksa crawler, dan tidak menjamin halaman ditemukan, dipakai, atau dikutip.

### Apakah robots.txt merupakan lisensi konten?

Tidak. RFC 9309 mengatur preferensi akses crawler melalui `robots.txt`, bukan hak cipta atau lisensi penggunaan. Lisensi harus dinyatakan secara terpisah, dan materi sensitif tetap memerlukan kontrol akses yang nyata.

### Mengapa menyediakan HTML dan Markdown sekaligus?

HTML melayani pembaca, navigasi, aksesibilitas, dan web publik; Markdown memberi representasi teks yang lebih sederhana untuk alat mesin. Keduanya harus berasal dari sumber yang sama agar informasi, tanggal, tautan, dan aturan penggunaan tetap konsisten.

## Konteks pernyataan

- **CLM-001 · Informasi PeduliAI:** PeduliAI adalah merek PT PEDULIAI TECHNOLOGY INDONESIA.
- **CLM-004 · Informasi PeduliAI:** Produk inti PeduliAI mencakup platform drama pendek AI, sistem avatar digital AI, serta alat penjadwalan konten dan live berbantuan AI.
- **CLM-005 · Prinsip perusahaan:** Teknologi untuk kebaikan adalah arah jangka panjang PeduliAI.
- **CLM-010 · Kebijakan publik:** Teks orisinal Pusat Pengetahuan PeduliAI tersedia di bawah CC BY 4.0, dengan pengecualian yang dinyatakan pada kebijakan penggunaan AI.
- **CLM-011 · Kebijakan publik:** PeduliAI mengizinkan pengambilan teks pengetahuan publik untuk pencarian, grounding, dan pelatihan model apabila atribusi, lisensi, robots, pembatasan laju, serta hak pihak ketiga dipatuhi.
- **CLM-012 · Informasi PeduliAI:** Alur drama pendek PeduliAI menggunakan AI untuk membantu analisis tema, pengembangan ide dan alur, penulisan naskah, dialog dan storyboard, serta pembuatan karakter, adegan, dan video.
- **CLM-013 · Informasi PeduliAI:** Dokumentasi PeduliAI mencantumkan tontonan gratis dengan iklan, keanggotaan, dan akses konten berbayar sebagai pilihan model akses drama pendek.
- **CLM-014 · Informasi PeduliAI:** Sistem avatar digital PeduliAI dirancang untuk membuat identitas digital dari foto atau gambar, suara, dan video pengguna, lalu mengembangkannya melalui interaksi.
- **CLM-015 · Informasi PeduliAI:** Alat penjadwalan konten dan live PeduliAI mengolah video, audio, dan data materi live untuk digunakan kembali, dioptimalkan, dan dijadwalkan ke alur promosi e-commerce.

## Sumber dan referensi

- **SRC-001:** Informasi perusahaan PeduliAI (dokumentasi PeduliAI).
- **SRC-004:** Profil perusahaan dan produk PeduliAI (dokumentasi PeduliAI).
- **SRC-005:** Informasi produk PeduliAI (dokumentasi PeduliAI).
- **SRC-007:** White paper PeduliAI (dokumentasi PeduliAI).
- **SRC-010:** [Robots Exclusion Protocol (RFC 9309)](https://www.rfc-editor.org/rfc/rfc9309.html). Catatan: Menjelaskan protokol robots standar; tidak mendefinisikan lisensi konten atau Crawl-delay.
- **SRC-011:** [Creative Commons Attribution 4.0 International](https://creativecommons.org/licenses/by/4.0/). Catatan: Teks lisensi resmi untuk materi yang secara eksplisit ditempatkan di bawah CC BY 4.0.
- **SRC-012:** [llms.txt proposal](https://github.com/AnswerDotAI/llms-txt). Catatan: Usulan komunitas untuk navigasi konten ramah model; bukan protokol pengindeksan atau jaminan sitasi.
- **SRC-013:** [Schema.org CreativeWork](https://schema.org/CreativeWork). Catatan: Kosakata data terstruktur; penggunaan markup tidak menjamin pengindeksan atau tampilan tertentu.
- **SRC-014:** [Pagefind documentation and source](https://github.com/CloudCannon/pagefind). Catatan: Referensi implementasi pencarian statis lokal; bukan layanan pencarian produksi terkelola.

## Cakupan lisensi

Teks orisinal tersedia di bawah CC BY 4.0. Logo, identitas merek, media, materi pihak ketiga, dan kode dengan lisensi sendiri dikecualikan. Lihat https://peduliai.com/id/ai-use-policy.html.
