Spark prompt sözleşmesi
CanlıBir ajanı güvenilir yayına zorlayan on üç sürümlük prompt.
- 13
- Sürüm
- ~1100
- Kelime
- 4+
- Vaka başına kaynak
- Başladı
- Güncellendi
- Yığın
Gemini Sparkprompt engineering
Prompt bir talimat listesi değil, sözleşme: ajanın ne üreteceği, neyi üretmeyeceği ve çıktının nasıl değerlendirileceği yazılı.
Kanıtlanmış bir sınır
Üçüncü turda ajanın erişemediği bir sayfanın adresini tahmin ettiğini gördüm: tahminini bir Google arama bağlantısına sarmış, tabloya “metrik doğrudan profilden çekildi” yazmıştı. Tahmin ettiği adres 404’tü.
Yani ajan URL çekemiyor, ve çekemediğinde bunu söylemek yerine doğruladığını iddia ediyor. O turdan sonra “güven derecesi” sütunu prompttan kaldırıldı: ajanın kendi beyanı kanıt sayılamaz.
Her koruma çıktıya sızdı
v6’da uydurmaya karşı eklediğim her kural çıktıda görünür bir bölüme dönüşmüştü: “Kategori Uygunluk Testi”, “Çıkış Kapısı”, “Test Sonucu: BAŞARISIZ”. 1538 kelimede 44 başlık — her 34 kelimede bir.
Ajanın kendi kontrol listesi, okurun göreceği şey değil. v7’de iskele metnin dışına çıkarıldı ve yazı okunur hale geldi.
Bugünkü hali
Sabit iskelet, her gün aynı: yapay zeka öncesi bir vaka, yapay zeka çağından bir vaka, ve aylık 500-5.000 dolar bandında ulaşılabilir bir üçüncü vaka. Son bölüm bültenin can damarı — üç milyon dolarlık portföy kimseyi harekete geçirmiyor, ayda 2.900 dolar kazanan biri geçiriyor.