open-source
4 bülten
Gradyan matrisini düşük dereceli alt uzaya yansıtarak optimizer bellek yükünü yüzde altmış beş azaltan ve tek GPU'da 7B ön eğitimini mümkün kılan çalışma.
Referans modeli ortadan kaldırıp uzunluk normalize edilmiş ödül marjıyla LLM hizalamasında bellek ihtiyacını yarıya indiren optimizasyon analizi.
Model ağırlıklarını büyüklük ve yön olarak ayrıştırıp LoRA'nın kapasite tavanını kıran ve tam ince ayar başarımı sunan adaptasyon analizi.
Finansal muhasebe ve transfer operasyonları için sıfır dinamik bellek tahsisi ve io_uring mimarisi üzerine kurulu deterministik OLTP veritabanı.