Ein leistungsfähiges ~3B LLM in deiner iOS-App ausliefern — Guided Generation, Tool Calling und wann du trotzdem zu Claude greifen solltest
Teil von: On-Device & Edge AI