IA & Agents — vue plateforme
Aucun GPU à administrer : le calcul IA est entièrement délégué à la passerelle LiteLLM, en amont d’OpenRouter, facturé au jeton. Ce qui suit décrit l’usage — modèles appelés, agents publiés — pas une capacité matérielle.
Pas de parc GPU sur cette plateforme
Jetons appelés 30 j
81,2 % sur les modèles marqués souverains
Chiffre d’affaires IA
Démonstration — pas encore une lecture réelle
Organisations actives
Modèles appelés
Volume par modèle sur l’ensemble de la plateforme, tous clients confondus — pas de notion de réplica ou de carte, uniquement des appels à la passerelle.
| Modèle | Orgs | Jetons 30 j | Part du trafic IA |
|---|---|---|---|
| Mistral Small 3.2 24B | 34 | 4,18 Md | 68 % |
| Llama 3.3 70B Instruct | 21 | 2,64 Md | 74 % |
| BGE-M3 | 29 | 3,91 Md | 41 % |
| Qwen3 32B | 11 | 820,0 M | 52 % |
| Codestral 25.08 | 9 | 640,0 M | 46 % |
| Whisper large-v3 | 14 | — | 22 % |
| Pixtral 12B | 3 | 96,0 M | 88 % |
Agents et orchestration
La consommation ne vient plus seulement d’appels directs : deux tiers des jetons servis passent aujourd’hui par un agent ou un flux, ce qui change la nature de la charge — plus de petits appels enchaînés, moins de gros appels isolés.
Agents déployés
30 publiés
Flux d’orchestration
1 684 200 exécutions sur 30 j
Trafic orchestré
Part des jetons issus d’un agent
Outils déclarés
dont 11 serveurs MCP
| Organisation | Agents | Publiés | Flux | Exécutions 30 j | Canaux ouverts |
|---|---|---|---|---|---|
| Digital Business Africa | 6 | 5 | 2 | 486 000 | Widget, WhatsApp, SMS, Telegram, REST |
| AMUGA | 4 | 4 | 1 | 214 800 | WhatsApp, SMS, REST |
| BICICI Lab | 3 | 1 | 0 | 42 100 | REST |
| OC²S | 11 | 8 | 4 | 612 400 | Tous canaux |
| Autres organisations | 19 | 12 | 3 | 328 900 | Widget, REST |
Vingt-et-un agents créés ne sont jamais publiés
Souverain ou externe reste un choix de résidence, pas d’hébergement