Ferret-UI Lite: Lessons from Building Small On-Device GUI Agents
Ferret-UI Lite: Lessons from Building Small On-Device GUI Agents [79.8] Ferret-UI Liteは、様々なプラットフォームで動作する、コンパクトでエンドツーエンドのGUIエージェントである。 Ferret-UI Liteは、他の小規模GUIエージェントとの競合性能を達成する。 論文参考訳(メタデータ) (Tue, 30 Sep 2025 17:13:56 GMT)
AppleによるGUIエージェントの報告、「In this work, we present Ferret-UI Lite, a 3B multimodal LLM designed for GUI agentic tasks with a focus on lightweight, on-device settings. Through real and synthetic data curation, inference-time visual tool use, and a two-stage SFT–RL training strategy, Ferret-UI Lite achieves competitive grounding and navigation performance relative to larger models.」と小型のモデル。