Tapez un sujet, même mal orthographié, et obtenez un quiz dessus. Le modèle tourne sur votre machine via Ollama ; la seule chose qui sort, c'est une recherche Wikipédia.
sujet ──▶ gemma corrige ──▶ vous validez ──▶ extrait wikipédia ──▶ gemma écrit le quiz ──▶ vous jouez
Comment ça marche
- Un modèle Gemma local transforme votre saisie approximative en sujet Wikipédia propre (
revoltion french→French Revolution), et vous validez. - Il lit le vrai article Wikipédia de ce sujet.
- Il écrit un quiz à choix multiples à partir de l'article : 3, 5, 10, 15 ou 20 questions.
- Vous jouez, avec un retour immédiat et une courte explication par question.
Ancrer les questions dans l'article, c'est tout l'intérêt : le modèle écrit à partir d'un vrai texte, pas de sa mémoire.
Deux réglages à connaître
- Modèle par défaut
gemma4:e2b. Mesuré sur un GPU Intel Arc, il tourne à environ 28–32 tokens/s contre environ 16 pourgemma4:latest: à peu près 2× plus rapide, et largement suffisant pour des quiz.OLLAMA_MODEL=gemma4:latestpour la qualité maximale. - La réflexion est désactivée. Gemma est un modèle qui « réfléchit », mais pour du JSON structuré comme la correction de sujet et la génération de quiz, ce raisonnement ajoute de la latence sans meilleur résultat.
OLLAMA_THINK=1le réactive.
Le lancer
ollama pull gemma4:e2b
git clone https://github.com/brbousnguar/gemmaquiz.git
cd gemmaquiz && npm install && npm start
Ouvrez http://localhost:3000. Il écoute sur toutes les interfaces, donc les autres appareils du réseau peuvent jouer aussi. Seule dépendance à l'exécution : Express, et le frontend est en JS pur, sans build.
Texte brut: gemmaquiz.md · Tous les projets