Seçim yok — hepsi listeleniyor, en ucuz çözüm önce.
Her tool tanımı her turda token yiyor. Ajan yavaşlamalarının çoğu model sorunu değil, context sorunu.
- Problem
- Bir ajan yavaş, pahalı ya da görevin ortasında dağılıyor.
- Bağlam
- Tanım listesinde birkaç taneden fazla tool olan her ajan.
Darboğaz okuma yüküyse en ucuz doğru cevap neredeyse hiçbir zaman sharding değildir.
- Problem
- Veritabanı doyuyor ve ekip bir sharding projesi öneriyor.
- Bağlam
- Tek bölgeli OLTP Postgres/MySQL, ~2 TB altı, okuma ağırlıklı (>%80 okuma).
Idempotent olmayan bir endpoint'e retry eklemek, görünür bir hatayı görünmez bir hataya çevirir.
- Problem
- Kararsız bir downstream hata üretiyor ve biri retry ekleyen bir PR açtı.
- Bağlam
- Uçtan uca sahibi olmadığın servisler arası senkron HTTP veya RPC.
Bir yazım iki yere düşecekse tek yere yaz, oradan bir okuyucu dağıtsın.
- Problem
- Bir servis hem veritabanını güncelleyip hem olay yayınlamalı, bazen sadece biri oluyor.
- Bağlam
- İşlemsel deposu ve mesaj broker'ı olan her servis. Özellikle Kafka.