Robust generalization of supervised fine-tuning for multilingual API grounding
Determine whether supervised fine-tuning improvements in argument-language consistency extend robustly to unseen APIs, diverse argument structures, and cross-lingual transfer in multilingual API calling.
References
However, it remains unclear whether such improvements extend robustly to more challenging settings, such as unseen APIs, diverse argument structures, or cross-lingual transfer.
— When the API Speaks the Wrong Language: Revisiting Post-Training for Multilingual Tool Use
(2608.11715 - Chauhan et al., 12 Aug 2026) in Section 1, Introduction, page 1