prompt-eng

Prompt Sürümleme

Prompt sürümleme, prompt şablonlarını -git veya özel bir prompt yönetim platformunda izlenen, sürüm tanımlayıcılarıyla etiketlenen, değişiklik incelemesine tabi ve geri alınabilir- uygulama kodunun içine gömülü, izlenmeyen dizeler olarak rastgele değiştirilen üretim promptları yerine, sürümlenmiş varlıklar olarak ele alma disiplinidir. Bu, promptların güvenilirlik açısından önemli olan her bakımdan kod gibi davranması (bir değişiklik üretim davranışını bozabilir) ama sıklıkla çok daha az titizlikle ele alınması nedeniyle vardır -inceleme veya test olmadan dağıtılan tek satırlık bir prompt düzenlemesi, yapay zeka odaklı şirketlerde gerçek, maliyetli üretim olaylarına neden olmuş, bir özelliğin her kullanıcısı genelinde doğruluğu sessizce düşürmüş veya marka dışı ya da güvensiz çıktılar getirmiştir. Olgun prompt sürümleme pratiği şunları içerir: promptları satır içi dizeler yerine ayrı dosyalar/kayıtlar olarak saklamak, böylece farklar pull taleplerinde incelenebilir olur; her sürümü ayarlandığı/değerlendirildiği model ve model sürümüyle etiketlemek (aynı prompt farklı model sürümleri veya sağlayıcıları arasında anlamlı şekilde farklı performans gösterebilir -bir model ailesi için ayarlanmış bir prompt, başka birine geçerken ayarlama gerektirebilir); üretime yükseltmeden önce her aday prompt sürümünü sabit bir değerlendirme kümesine karşı çalıştırmak ve değerlendirme puanını sürümle birlikte günlüğe kaydetmek; ve tam bir kod dağıtımı olmadan önceki bir prompt sürümüne anında geri dönebilme yeteneğini sürdürmek, tipik olarak prompt depolamasını uygulama kodu dağıtımlarından tamamen ayırarak ("mevcut üretim promptunu" sabit kodlamak yerine bir veritabanından veya yapılandırma servisinden almak, böylece şablon güncellemeleri uygulama sürümlerinden bağımsız olarak yayınlanabilir). Bu ayrıştırma aynı zamanda özellik bayraklarına (feature flags) doğrudan benzer güvenli yayınlama desenlerini de mümkün kılar -trafiğin %5'ine yeni bir prompt sürümü göndermek, kalite/maliyet metriklerini mevcut sürümle karşılaştırmak, ardından kademeli olarak artırmak. Somut örnek: bir SaaS şirketinin yapay zeka e-posta taslağı özelliği iki aydır sistem promptu v7'de. Bir mühendis, kullanıcı geri bildirimine dayanarak yanıtları kısaltma talimatı ekleyen v8'i öneriyor. Ekip doğrudan dağıtmak yerine, v8'i mevcut v7 ile birlikte 150 örneklik değerlendirme kümesine karşı çalıştırır ve her ikisini de puanlamak için bir LLM-hakem meta promptu kullanır -v8 "özlülük" konusunda daha yüksek puan alır ama karmaşık istekler için "eksiksizlik" konusunda belirgin şekilde daha düşük puan alır. Bu, v8'in sessiz bir satır içi düzenleme değil izlenen, değerlendirilebilir bir sürüm olması sayesinde dağıtımdan önce yakalanır; ekip v8'i yalnızca kısa/basit istekler için gönderir (dallanma mantığı) ve karmaşık olanlar için v7'yi korur -izlenmeyen prompt düzenlemesinin asla ortaya çıkaramayacağı incelikli bir karar.

İlgili terimler

Daha fazla Komut Mühendisliği terimi