Otonom ince ayar nedir?
Google Developers Blog'da paylaşılan "autofinetune" projesi, büyük dil modellerinin (LLM) eğitim sonrası süreçlerini insan müdahalesi olmadan yürüten bir araştırma döngüsü öneriyor. Kapsam, denetimli ince ayar (SFT) ile GRPO üzerinden pekiştirmeli öğrenmeyi içeriyor.
Nasıl çalışıyor?
Geliştirici tek bir Markdown dosyasında sınır koşullarını ve değerlendirme metriklerini tanımlıyor. Ardından bir yapay zekâ ajanı devreye giriyor:
- Eğitim betiklerini yinelemeli olarak düzenliyor,
- Deneyleri başlatıyor,
- Doğrulanan hiperparametre iyileştirmelerini otomatik olarak Git'e işliyor.
Böylece manuel ayar döngüleri ortadan kalkıyor.


