Contexte
Explorer une solution d’avatar conversationnel en limitant la dépendance aux API externes.
Problème
Les solutions hébergées peuvent ajouter coût et dépendances.
Solution
Déploiement conteneurisé d’un moteur conversationnel et d’un LLM local sur VM ARM.
Leçon retenue
Les contraintes de calcul doivent être mesurées tôt pour dimensionner une démo temps réel.