Desain Guardrail dan Kontrol Biaya Agent
Rancang lapisan kebijakan yang menahan prompt injection, menegakkan izin seminimal mungkin, membatasi biaya berlapis, dan meninggalkan jejak audit yang bisa dipertanggungjawabkan.
Prompt latihan
Ruang Lingkup, Kebutuhan Fungsional, dan Asumsi Skala
Tentukan apa yang dijaga platform ini: aksi agent, data yang tersentuh, dan biaya yang dikeluarkan. Perjelas siapa yang menetapkan kebijakan, siapa yang bisa mengubahnya, dan aksi apa yang selalu butuh manusia. Nyatakan non-goal, misalnya penyaringan konten umum dan keamanan jaringan. Tutup dengan asumsi skala: jumlah agent, keputusan kebijakan per detik, dan proporsi aksi yang tidak dapat dibatalkan.
Kebutuhan Non-Fungsional
Tetapkan NFR: latency evaluasi kebijakan yang muat di jalur kritis setiap panggilan tool, ketersediaan, postur ketika mesin kebijakan tidak bisa dihubungi, akurasi pencatatan biaya, serta daya tahan dan retensi jejak audit. Nyatakan juga kebutuhan yang bersifat kepatuhan: siapa boleh membaca audit dan berapa lama disimpan.
Analisis Kuantitatif
Turunkan angka pengendali biaya: biaya rata-rata per tugas agent, kuota harian per pengguna, dan ambang pemutus arus organisasi yang masuk akal terhadap rata-rata tujuh hari. Hitung juga beban evaluasi kebijakan per detik dan volume jejak audit per hari beserta biaya penyimpanannya pada retensi yang Anda pilih.
Desain API Kebijakan dan Audit
Rancang API: evaluasi satu rencana aksi (mengembalikan izinkan, tahan, atau tolak beserta alasan yang bisa dibaca manusia), pembuatan dan pembaruan kebijakan dengan versi, pencatatan pemakaian token, pemeriksaan sisa kuota, serta kueri jejak audit berdasarkan tugas, pengguna, atau rentang waktu. Tentukan bagaimana argumen yang berisi data pribadi disamarkan sebelum dicatat.
Desain Tingkat Tinggi
Gambar komponennya: titik penegakan di jalur tool, mesin kebijakan, penyimpanan kebijakan berversi, pencatat pemakaian token, pemutus arus organisasi, antrean persetujuan, pembatas jaringan keluar, dan penyimpanan audit. Tunjukkan jalur satu rencana aksi dari usulan model sampai eksekusi atau penolakan, serta di mana biaya dicatat.
Pertanyaan Lanjutan Desain Tingkat Tinggi
Jawab tiga hal. Pertama, bagaimana Anda memisahkan kemampuan agar satu dokumen jahat tidak bisa mengeksfiltrasi data: siapa yang boleh membaca konten eksternal dan siapa yang memegang jalur keluar. Kedua, bagaimana perubahan kebijakan menyebar ke semua titik penegakan dan berapa lama lag yang Anda terima. Ketiga, apa yang terjadi pada tugas yang sedang berjalan ketika pemutus arus organisasi terbuka.
Deep Dive Prompt Injection dan Kebocoran Data
Masuk ke detail keamanan. Jelaskan kenapa instruksi di dalam prompt bukan kontrol yang memadai, lalu rancang pertahanan berlapis: penandaan data tidak tepercaya, pembatasan izin per kelas tool, allowlist tujuan keluar, dan persetujuan manusia. Bahas juga tiga jalur kebocoran data yang paling sering: hasil tool yang membawa terlalu banyak field, ringkasan yang menyalin data sensitif ke memori jangka panjang, dan aksi keluar ke tujuan yang dikendalikan penyerang. Sebutkan risiko sisa yang Anda terima.
Kesiapan Serah Terima Final Review
Tutup desain: sebutkan model izin, titik penegakan, batas biaya berlapis beserta angkanya, isi jejak audit, dua risiko terbuka, dan rencana peluncuran mulai dari mode pemantauan tanpa penegakan sampai penegakan penuh.
Preview solusi
Jalur referensi Solusi Guardrail dan Kontrol Biaya Agent adalah materi baca read-only. Pakai untuk membandingkan desain Anda sebelum latihan atau sesudahnya. Keamanan agent ditegakkan di kode dan izin, bukan di kalimat prompt. Tempatkan titik penegakan di dalam tool runner supaya tidak ada aksi yang bisa lewat tanpa dievaluasi. Keputusan kebijakan punya tiga…