Qwen3-VL-32B’nin güvenilir işlev çağırma ve belge anlama için optimize edilmiş çok kipli tool-use LoRA ince ayarı — tek bir on-prem GPU düğümünde çalışacak şekilde kuantize edildi.
Raftan alınan modeller, üretim ajanları için araç kullanımında nadiren yeterince güvenilirdir — argüman uydurur, şemaları kaçırır ve çok kipli girdide kırılır. mdAgent-Hermes-32B, 32B görü-dil modelini doğru aracı doğru argümanlarla çağırmada güvenilir kılan hedefli bir ince ayardır.
Küratörlenmiş çok kipli tool-use verisi üzerinde LoRA ile eğitilip ardından verimli serving için kuantize edilen model, gerçekçi bir on-prem donanım bütçesine sığarken güçlü işlev çağırma doğruluğunu korur.
LMXAI’nin dahili BFCL-v3 tek tur işlev çağırma eval’inde (evalscope) mdAgent-Hermes-32B %82,3 başarıya ulaştı. Bu, Berkeley Function-Calling Leaderboard v3 tek tur paketinin bizim koşumumuzdur — yayımlanmış üçüncü taraf bir sıralama değildir.