Upgrade to Pro — share decks privately, control downloads, hide ads and more …

VoxxedDaysLuxembourg - CoeurIA : Et si on refai...

VoxxedDaysLuxembourg - CoeurIA : Et si on refaisait ChatGPT au service de la SolidarIT ?

Avatar for Julien Briault

Julien Briault

September 09, 2026

More Decks by Julien Briault

Other Decks in Programming

Transcript

  1. Les Restos en quelques chiffres … 163 millions de repas

    servis (2023-2024) 80 000 Bénévoles réguliers (dont 35 000 qui utilisent l’informatique au quotidien) 112 Associations départementales 2348 Lieux d’accueil (centre de distribution, etc). @ju_hnny5 + de 40 Applications fonctionnelles (Applications utilisées par les bénévoles au quotidien)
  2. openstack flavor create vllm-mi50 \ --ram 65536 \ --disk 200

    \ --vcpus 24 openstack flavor set vllm-mi50 \ --property hw:cpu_policy=dedicated \ --property hw:mem_page_size=large \ --property pci_passthrough:alias=mi50:1 @ju_hnny5
  3. Ethernet pour les usages classiques du Cloud du Coeur (stockage,

    underlay, routage) Infiniband pour les GPUs @ju_hnny5
  4. 1. 2. 3. 4. 5. 6. 7. Procédures internes Guides

    bénévoles Fiches logistiques Mails Comptes-rendus Documentation informatique Bases de connaissances “Comment gérer une rupture de chaîne du froid ?” “Quelle est la procédure pour l’accueil d’une personne sans justificatif” ? @ju_hnny5
  5. 80 000 Bénévoles réguliers (dont 35 000 qui utilisent l’informatique

    au quotidien) + de 40 Applications fonctionnelles (Applications utilisées par les bénévoles au quotidien) @ju_hnny5
  6. • Inférence très haute performance • Optimisation du débit (tokens/seconde)

    • Réduction de la latence utilisateur • Réduction de la fragmentation mémoire GPU • Meilleure densité d’utilisateurs simultanés @ju_hnny5
  7. 1. Amélioration de la haute disponibilité (fallback auto d’un provider

    à l’autre) 2. Réduction des coûts (politique de routage) 3. Gouvernance centralisée (contrôle d’accès, quotas par équipe, journalisation, authentification OIDC, etc) 4. L’observabilité (compatible Prometheus) @ju_hnny5
  8. C’est simple mais : 1. Ça coûte des tokens ;

    2. Ça ajoute de la latence ; 3. Ça peut être imprévisible 4. Ça devient difficile à maintenir quand on a beaucoup d’outils @ju_hnny5
  9. La mauvaise solution : réentraîner un LLM Une réaction classique

    est : "Mettons tout nos documents dans le modèle." @ju_hnny5
  10. Problèmes : • • • • • coûteux complexe lent

    nécessite de réentraîner régulièrement risque de fuite d'informations @ju_hnny5
  11. La bonne question "Pourquoi apprendre au modèle quelque chose qu'il

    peut simplement aller chercher ?" C'est précisément le principe du RAG. @ju_hnny5
  12. cdctl ai “lister les serveurs de PAR1” cdctl ai “Analyser

    les logs de web001 sur PAR1” @ju_hnny5