IA & Agents — vue plateforme

Aucun GPU à administrer : le calcul IA est entièrement délégué à la passerelle LiteLLM, en amont d’OpenRouter, facturé au jeton. Ce qui suit décrit l’usage — modèles appelés, agents publiés — pas une capacité matérielle.

Pas de parc GPU sur cette plateforme

Contrairement à un hébergeur qui réserverait des cartes pour un client, Synelia Cloud n’achète ni ne loue de GPU : chaque appel de modèle part vers OpenRouter via la passerelle LiteLLM, avec la clé SYNELIA_OPENROUTER_KEY — une clé d’inférence standard, pas une clé de provisionnement. Il n’y a donc rien à dimensionner, à mettre en veille ou à remplacer sous garantie côté matériel.

Jetons appelés 30 j

12,29 Md

81,2 % sur les modèles marqués souverains

Chiffre d’affaires IA

18 420 000 FCFA

Démonstration — pas encore une lecture réelle

Organisations actives

8

Modèles appelés

Volume par modèle sur l’ensemble de la plateforme, tous clients confondus — pas de notion de réplica ou de carte, uniquement des appels à la passerelle.

ModèleOrgsJetons 30 jPart du trafic IA
Mistral Small 3.2 24B344,18 Md68 %
Llama 3.3 70B Instruct212,64 Md74 %
BGE-M3293,91 Md41 %
Qwen3 32B11820,0 M52 %
Codestral 25.089640,0 M46 %
Whisper large-v31422 %
Pixtral 12B396,0 M88 %

Agents et orchestration

La consommation ne vient plus seulement d’appels directs : deux tiers des jetons servis passent aujourd’hui par un agent ou un flux, ce qui change la nature de la charge — plus de petits appels enchaînés, moins de gros appels isolés.

Agents déployés

43

30 publiés

Flux d’orchestration

10

1 684 200 exécutions sur 30 j

Trafic orchestré

63,8 %

Part des jetons issus d’un agent

Outils déclarés

84

dont 11 serveurs MCP

OrganisationAgentsPubliésFluxExécutions 30 jCanaux ouverts
Digital Business Africa652486 000Widget, WhatsApp, SMS, Telegram, REST
AMUGA441214 800WhatsApp, SMS, REST
BICICI Lab31042 100REST
OC²S1184612 400Tous canaux
Autres organisations19123328 900Widget, REST

Vingt-et-un agents créés ne sont jamais publiés

Sur 43 agents, 13 restent en brouillon — pour la plupart parce que leur jeu d’épreuves ne passe pas le seuil de 80 %. C’est le garde-fou qui fonctionne, mais c’est aussi une promesse commerciale non tenue chez le client. Un accompagnement sur la constitution des jeux d’épreuves aurait plus d’effet sur l’adoption que n’importe quelle remise.

Souverain ou externe reste un choix de résidence, pas d’hébergement

Le champ « hébergement » d’un modèle (souverain / externe) régit la politique de résidence des données — quelle classe de données peut partir vers quel modèle — pas une infrastructure GPU que la plateforme posséderait. Les deux catégories passent aujourd’hui par la même passerelle OpenRouter ; « souverain » désigne les modèles dont l’éditeur ou le point de présence est jugé acceptable pour des données sensibles, pas un GPU maison.