Inférence IA sans GPU. Pas de maux de tête avec les configurations, pas d'inquiétudes en matière de sécurité. Juste une vitesse pure grâce à un calcul d'inférence uniquement dans l'🇪🇺 UE, conforme au RGPD.
Choisissez votre itinéraire d'inférence IA – ne payez que pour ce que vous utilisez (par jeton) :
Chargement des itinéraires d'API disponibles
Infrastructure et conformité – entièrement gérée, sécurisée et prête pour la réglementation dès le premier jour.
/v1/chat/completions, utilisez n'importe quel SDKInférence intelligente et médias – une intelligence intégrée qui gère les cas limites pour que vous n’ayez rien à faire.
Sécurité et résilience – renforcé, auto-réparateur, toujours opérationnel.
Utilisez une SDK compatible avec OpenAI. Il suffit de la configurer sur votre point d'accès (endpoint) Trooper.AI :
curl https://router.trooper.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_TROOPER_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "clara",
"messages": [{"role": "user", "content": "Hello!"}],
"max_tokens": 512
}'
Les API Blibs sont la solution la plus simple pour démarrer avec l’inférence de modèles de langage (LLM) hébergés en privé dans l’UE — et le complément idéal à un serveur dédié GPU. Accédez aux derniers modèles open-source haut de gamme — Google Gemma 4, Mistral Ministral 3 et NVIDIA Nemotron 3 Nano — via une API entièrement gérée au paiement par jeton (pay-per-token), sans avoir besoin de configurer le moindre GPU. Les requêtes sont traitées sur des backends optimisés vLLM avec équilibrage automatique de charge, garantissant des réponses à faible latence constante même sous fort trafic. Aucun coût d’inactivité lorsque vous n’utilisez pas l’API, aucune gestion opérationnelle ni facture inattendue : uniquement de l’inférence à la demande.
Commencez ici pour prototyper et déployer en quelques minutes, puis passez à votre propre serveur privé LLM GPU lorsque vous avez besoin d’un accès complet root, de performances prévisibles et d’un tarif prépayé fixe pour des charges de travail stables. De nombreuses équipes utilisent les deux simultanément : les API Blibs pour le trafic sporadique ou occasionnel, ainsi qu’un serveur dédié GPU pour une inférence lourde et toujours active – même résidence des données dans l’UE, mêmes modèles ouverts, même qualité sur les deux.
Derrière chaque API Blib se trouve du matériel d'entreprise recyclé et optimisé, entretenu par notre propre équipe. Ici, Markus et Jaimie installent un cluster NVIDIA A100 dans l'un de nos centres de colocalisation certifiés ISO/IEC 27001 en Allemagne — les mêmes serveurs GPU que vous pouvez également louer comme votre propre serveur LLM privé. Nous réutilisons des composants haute performance pour créer des configurations dédiées à l'inférence, prolongeant ainsi la durée de vie du matériel tout en réduisant les déchets électroniques. Nous ne revendons pas de capacité tierce ; nous possédons et exploitons notre propre infrastructure dans des centres de colocalisation situés en Allemagne et aux Pays-Bas, ce qui nous permet de garantir des performances, une sécurité et une résidence des données à tous les niveaux de la pile technologique.
Les API Blibs sont à 100 % compatibles avec le format de l’API des complétions de chat d’OpenAI (/v1/chat/completions). Si votre application utilise déjà le SDK OpenAI — en Python, Node.js ou tout autre client HTTP —, passer à Trooper.AI ne nécessite qu’un changement de ligne : mettez à jour l’URL de base et la clé API. Vous conservez le même point d’accès, le même schéma de requête et de réponse, ainsi que le soutien complet pour les flux (streaming), le mode JSON, les appels de fonction et les entrées multimodales. Aucune réécriture du code, aucune nouvelle abstraction ni verrouillage fournisseur — votre intégration reste portable et vous gardez le contrôle.
Cherchez-vous une alternative à l'API OpenAI hébergée en Europe ? Les API Blibs vous offrent une fonctionnalité équivalente pour les Chat Completions avec résidence des données dans l'UE et un tarif par jeton transparent.
Chaque route de l'API Blibs fonctionne exclusivement sur des centres de données en colocalisation certifiés ISO/IEC 27001 situés en Allemagne et au sein de l’Union européenne. Vos invites (prompts) et leurs réponses (completions) sont traitées uniquement en mémoire vive (RAM) – sans état, sans journalisation des invites ou des réponses, sans stockage, et sans entraînement du modèle à partir de vos données. Seules les métadonnées nécessaires à la facturation sont conservées selon les exigences légales. Cette architecture en fait une solution idéale pour les secteurs fortement régulés tels que la santé, le legal tech, la fintech et le secteur public, ainsi que pour toutes entreprises où la souveraineté des données et la conformité RGPD constituent des impératifs absolus.
Tous les appels à l'API Blib sont traités dans toute l'Union européenne au sein de nos centres de données certifiés ISO/IEC 27001 en Allemagne et dans l'Union européenne — il n'y a pas de pays séparé à sélectionner, et vos données ne quittent jamais l'UE. Associée à notre interface API renforcée et à la récupération d'images sécurisée contre les attaques SSRF (Server-Side Request Forgery), vous obtenez une couche d'inférence IA qui répond aux exigences de sécurité des entreprises dès sa mise en œuvre.
Avec API Blibs, vous ne payez que pour les jetons consommés — entrées et sorties, facturés par million de jetons. Aucun frais de mise en route, aucun minimum mensuel, aucune charge pour le temps d'inactivité. Prépayez des crédits à votre rythme et votre budget est débité uniquement lors des appels API effectifs. En plus de cela, chaque campagne mensuelle ajoute des crédits bonus à votre recharge — le pourcentage exact dépendant de la promotion en cours. Cela simplifie grandement la prévision des coûts, que ce soit pour un chatbot orienté client, une chaîne d'extraction documentaire ou une classification par lots à grande échelle.
La facturation à la token rend les API Blibs idéales pour des charges de travail variables ou occasionnelles et permet de démarrer sans engagement. Une fois votre utilisation stable et en continu, un serveur dédié GPU server avec un tarif prépayé fixe peut être une solution naturelle pour passer à l’étape suivante — vous pouvez ainsi combiner les deux : envoyer le trafic ponctuel aux API Blibs et confier les charges lourdes à votre propre serveur.
Le choix d’un fournisseur de gestion d’inférence pour modèles de langage en Europe implique un équilibre entre le prix, la résidence des données et la simplicité opérationnelle. Voici comment les API Blibs se comparent aux principales alternatives basées sur le cloud.
| API Blibs de Trooper.AI | Concurrence (typique) | |
|---|---|---|
| Résidence des données dans l' |
Oui – par défaut ; toutes les requêtes traitées à l'échelle de l'🇪🇺 UE | Variable – les régions de l’UE peuvent être disponibles, mais leur accès peut être limité à certains abonnements, nécessiter une approbation d’éligibilité ou impliquer un routage interrégional. |
| Rétention des données | Aucun journal des requêtes/réponses – inférence sans état en mémoire vive uniquement ; métadonnées de facturation conservées conformément à la loi fiscale | Personnalisable – certains fournisseurs conservent les données par défaut pour la surveillance des abus ou le journalisation ; une désactivation peut être nécessaire. |
| Traitement à l'échelle de l'UE | Oui – toutes les demandes traitées à l’échelle de l’UE, aucune configuration régionale requise | Variable – un déploiement régional peut être disponible, mais tous les modèles ne sont pas accessibles dans chaque région ; le contrôle au niveau pays est souvent indisponible sur les forfaits standards. |
| Modèle tarifaire | Par jeton en €, sans minimum, crédits prépayés + crédits promotionnels supplémentaires | Généralement facturé par jeton en dollars (USD) ; certains fournisseurs appliquent des tranches tarifaires complexes, des unités de débit provisionnées ou des surcoûts pour la priorité. |
| Coûts supplémentaires | Transparente – facturation à la token, aucuns frais d'infrastructure ou de configuration | Frais supplémentaires courants pour les services complémentaires, l'hébergement de modèles optimisés, les outils plateforme et la surcharge d'infrastructure |
| Compatibilité avec l'API | Oui – 100 % compatible avec l’API OpenAI Chat Completions, migration en une ligne | Variable – certains proposent des points de terminaison compatibles avec OpenAI, tandis que d'autres utilisent des APIs propriétaires nécessitant des modifications de code. |
| Complexité de configuration | Faible – clé API + URL de base, terminé | Peut être élevé – peut nécessiter des abonnements cloud, groupes de ressources, configurations IAM et demandes manuelles d'accès aux modèles. |
| Engagement fournisseur | Faible – compatible avec l'API des complétions de chat d'OpenAI, changement instantané | Faible à élevé – allant d'APIs standards portables à une intégration profonde dans l'écosystème avec des outils propriétaires |
| Fonctionnalités intégrées | Compression automatique du contexte, vision de PDF, récupération de réflexion, JSON garanti et téléchargement d'images sécurisé contre les SSRF | Les ensembles de fonctionnalités varient ; généralement des APIs par lots, mise en cache des invites (prompts), garde-fous et outils RAG proposés en options payantes. |
| Certifications | Centres de données en colocation certifiés ISO/IEC 27001 🇩🇪 | Les principaux fournisseurs détiennent généralement les certifications SOC 2, ISO 27001 et des certifications régionales. |
| Pour qui c'est fait | Équipes axées sur l’UE cherchant une inférence conforme au RGPD sans configuration et à prix transparents | Équipes déjà intégrées dans un écosystème cloud spécifique ou nécessitant une surface d'API plus large que les complétions de conversation |
À partir d'avril 2026. « Compétition » reflète les tendances communes parmi les principaux fournisseurs de services d'inférence pour modèles de langage (LLM) gérés. Les offres individuelles peuvent varier. Aucune garantie quant à l'exactitude ou à l'exhaustivité.
En résumé : Les grands fournisseurs de cloud proposent une résidence des données dans l’UE – mais cela peut impliquer des exigences d’éligibilité, des coûts supplémentaires ou un verrouillage à leur écosystème. API Blibs vous offre une inférence hébergée en UE et conforme au RGPD dès le départ, avec un déploiement simplifié et une facturation transparente basée sur les tokens.
Les API Blibs vous donnent accès à des modèles open source soigneusement sélectionnés, optimisés pour les charges de travail en production sur nos backends d'inférence vLLM. Chaque modèle est choisi pour son rapport prix-rendement, sa couverture linguistique européenne et la clarté de ses licences.
La solution la plus économique — un modèle multimodal compact qui traite le texte, les images, l'audio et le raisonnement en une seule requête. Idéal pour des charges de travail à haut volume où le coût par jeton est primordial, que ce soit pour la classification ou le résumé, mais aussi pour la génération de légendes d'images ou la transcription audio.
Un modèle axé sur la vision et optimisé pour le débit. Performances linguistiques solides en UE, analyse multi-images et extraction structurée à un prix intermédiaire – idéal pour le traitement de documents, les pipelines d'OCR (reconnaissance optique de caractères) ainsi que pour des chatbots orientés client nécessitant une compréhension visuelle.
Le moteur de raisonnement. Une architecture mixture-of-experts offrant une capacité avancée d'analyse logique et des compétences en codage performantes à un coût d'inférence optimisé. Idéal pour la génération de code, les chaînes de raisonnements complexes, l'appel de fonctions et les flux de travail autonomes (agentic).
Tous les modèles sont accessibles via des points de terminaison compatibles avec OpenAI. Passez d'une route à une autre en modifiant le paramètre du modèle. model paramètre — aucun changement de code requis.
Alimentez des PDF, des images et des documents scannés dans les routes dotées de la vision comme clara ou liv. Les API Blib convertissent automatiquement les PDF en images de pages et normalisent les entrées d’images – votre pipeline RAG reçoit ainsi des données propres et structurées sans étapes de pré-traitement. Grâce au mode JSON garanti, vous obtenez une sortie structurée fiable pour l’indexation en aval.
Déployez un chat alimenté par l'IA avec une latence inférieure à la seconde et une conformité totale au RGPD. Définissez un invite système personnalisable via le tableau de bord d'administration, utilisez les appels de fonction pour l'intégration côté serveur, puis laissez la compression automatique du contexte gérer les longues conversations sans atteindre les limites de contexte. Une rétention nulle des données signifie que vos échanges clients ne sont jamais conservés.
Confiez les tâches de codage complexes à nikola pour un raisonnement approfondi et des appels de fonctions précis. L'API compatible avec OpenAI s'intègre directement aux chaînes d'outils de développement — extensions VS Code, pipelines CI/CD, robots de revue de code — en modifiant simplement l'URL de base.
Traitez les images, fichiers audio et PDF en un seul appel d'API. liv gère ces trois modalités ; clara se spécialise dans les tâches de vision haute résolution. Les images sont optimisées automatiquement (métadonnées supprimées, redimensionnées, validation SSRF effectuée) et les PDF sont convertis en images de pages côté serveur. Aucune pré-traitement côté client nécessaire.
Exécutez la classification, le taggage, l'analyse de sentiment ou l'extraction d'entités à grande échelle. Un tarif par jeton sans coûts fixes signifie que vous ne payez qu'en cours de traitement. Associez-le au mode JSON garanti pour une sortie lisible par machine qui s'intègre directement dans votre pipeline de données.
Non. Les API Blibs utilisent une architecture entièrement sans état et basée uniquement en mémoire vive (RAM). Vos requêtes et réponses sont traitées en mémoire puis supprimées immédiatement après l'envoi de la réponse. Aucune journalisation des requêtes ou complétions, aucun stockage, aucune formation du modèle avec vos données. Seules les métadonnées facturationnelles (comptage de jetons, identifiants de transactions) sont conservées conformément à la législation fiscale.
Oui. Toutes les routes de l'API Blibs prennent en charge l'appel de fonctions compatible avec OpenAI. Définissez vos outils dans le paramètre « tools » standard. tools le paramètre et le modèle renverra des appels d’outils structurés dans la réponse. Fonctionne avec toutes les routes.
Au lieu de rejeter votre demande, les API Blibs compriment automatiquement la partie centrale de la conversation pour qu'elle tienne dans la fenêtre de contexte du modèle. Vous obtenez une réponse complète sans perdre le début ou la fin de votre échange.
Oui. Diffusion en continu standard via le paramètre stream: true paramètre, entièrement compatible avec l'interface de streaming du SDK OpenAI.
Modification en une ligne. Mettez à jour votre base_url to https://router.trooper.ai/v1 et remplacez votre clé API. Le format de la requête, le schéma de réponse et le comportement du flux restent identiques.
Toutes les requêtes API Blib sont traitées à l'échelle de l'UE dans nos centres de données certifiés ISO/IEC 27001 en Allemagne et dans l'UE — vos données ne quittent jamais l'UE. Aucune région distincte n'est disponible ; le traitement à l'échelle de l'UE est la configuration par défaut.
Les API Blibs incluent une fonction de secours pour la réflexion : nous détectons quand un modèle reste bloqué dans une boucle de raisonnement et relançons automatiquement le processus, garantissant ainsi que vous recevez toujours une réponse exploitable plutôt qu'une expiration ou une réponse vide.
Oui. Lorsque vous demandez une sortie au format JSON, nous validons la structure de la réponse. Si le modèle ne produit pas un JSON valide, vous n’êtes pas facturé pour cette requête.
Non. Les images sont automatiquement normalisées (métadonnées supprimées, redimensionnées à la résolution maximale du modèle, vérifiées pour la sécurité). Les PDF sont convertis en images de pages côté serveur. Vous envoyez des fichiers bruts ; nous gérons le reste.
Toute l'infrastructure fonctionne dans des centres de données en colocation certifiés ISO/IEC 27001 situés en Allemagne et dans l'UE. Associée à la conformité RGPD, sans journalisation des prompts ou des réponses, ainsi qu'à une interface API sécurisée, API Blibs répond aux exigences de sécurité d'entreprise dès le départ.
from openai import OpenAI
client = OpenAI(
base_url="https://router.trooper.ai/v1",
api_key="YOUR_TROOPER_KEY"
)
response = client.chat.completions.create(
model="clara",
messages=[{"role": "user", "content": "Summarize this document."}],
max_tokens=1024
)
print(response.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://router.trooper.ai/v1",
apiKey: "YOUR_TROOPER_KEY",
});
const response = await client.chat.completions.create({
model: "nikola",
messages: [{ role: "user", content: "Write a unit test for this function." }],
max_tokens: 2048,
});
console.log(response.choices[0].message.content);
from langchain_openai import ChatOpenAI
llm = ChatOpenAI(
base_url="https://router.trooper.ai/v1",
api_key="YOUR_TROOPER_KEY",
model="clara",
max_tokens=1024
)
response = llm.invoke("Extract all dates from the following text: ...")
print(response.content)
from llama_index.llms.openai_like import OpenAILike
llm = OpenAILike(
api_base="https://router.trooper.ai/v1",
api_key="YOUR_TROOPER_KEY",
model="nikola",
max_tokens=2048
)
response = llm.complete("Explain the EU AI Act in simple terms.")
print(response.text)
curl https://router.trooper.ai/v1/chat/completions \
-H "Authorization: Bearer YOUR_TROOPER_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "clara",
"messages": [{
"role": "user",
"content": [
{"type": "image_url", "image_url": {"url": "https://example.com/invoice.png"}},
{"type": "text", "text": "Extract all line items from this invoice as JSON."}
]
}],
"max_tokens": 2048,
"response_format": {"type": "json_object"}
}'
Le règlement européen sur l’IA (règlement UE 2024/1689) entre en vigueur de manière générale le 2 août 2026, instaurant le premier cadre juridique complet au monde pour l’intelligence artificielle. Pour les entreprises opérant en Allemagne et dans l’UE, cela implique de nouvelles obligations en matière de transparence, de documentation et de gestion des risques – avec des sanctions pouvant aller jusqu’à 35 millions d’euros ou 7 % du chiffre d’affaires mondial.
Bien que le règlement vise principalement les fournisseurs et utilisateurs de systèmes d'IA à haut risque (comme ceux utilisés dans le recrutement, la notation crédit ou les infrastructures critiques), toute entreprise utilisant l'IA doit comprendre où ses systèmes se situent dans la pyramide des risques – et s'assurer que son infrastructure d'inférence respecte la conformité.
Même pour les cas d'utilisation de l'IA à risque minimal et limité, le règlement européen sur l'IA insiste sur la transparence et la gouvernance des données. Le choix d'un fournisseur d'inférence opérant au sein de l'UE, ne conservant aucune donnée et offrant une documentation claire simplifie votre conformité :
Les entreprises allemandes sont soumises à une double charge de conformité : le RGPD (en vigueur depuis 2018) et l’AI Act (mise en application progressive jusqu’en 2027). Ces deux cadres exigent que vous démontriez que les données personnelles sont traitées légalement, de manière transparente et avec des garanties appropriées. Le recours à un fournisseur d’inférence basé aux États-Unis sans résidence des données dans l’UE crée une superficie réglementaire inutile – il faut alors s’appuyer sur des clauses contractuelles types, évaluer les décisions d’adéquation et documenter les flux transfrontaliers de données.
Les API Blibs éliminent cette complexité : tout traitement s’effectue au sein de l’UE, sans journalisation des prompts ou des réponses et avec une infrastructure d’hébergement certifiée ISO. Votre responsable à la protection des données (Datenschutzbeauftragter) peut ainsi attester d’un flux de données strictement européen, exempt de transferts vers des pays tiers.
Pour les entreprises opérant dans des secteurs réglementés – fintech (soumis à la régulation de la BaFin), santé numérique (healthtech), legal tech et secteur public –, les exigences sont encore plus strictes. Les auditeurs s’attendent à :
Les API Blibs couvrent les quatre exigences suivantes : traitement au sein de l’UE (vos données ne quittent jamais l’UE), absence d’enregistrement des prompts ou des réponses générées (les métadonnées facturielles sont conservées conformément à la législation fiscale), spécifications du modèle publiquement disponibles et bascule automatique avec des points de terminaison auto-réparateurs.
Aucun long processus d'achat n'est nécessaire pour déployer une inférence de modèle de langage conforme au RGPD et à l'AI Act. Créez un compte Trooper.AI, rechargez vos crédits prépayés et commencez à effectuer des appels API – toute l'infrastructure est déjà certifiée, toutes les données restent dans l'UE, et il n'y a rien à configurer côté conformité.
Pour les demandes de contrat de traitement des données (AVV/DPA) ou pour toute question concernant vos exigences spécifiques en matière de conformité, contactez-nous à l'adresse [email protected] ou appelez le +49 6126 9289991.
Puisque les API Blibs sont compatibles avec l’API OpenAI Chat Completions, vous pouvez les intégrer à presque tous les outils d’IA, environnements de développement (IDE) ou plateformes d’automatisation – il suffit de définir l’URL de base sur https://router.trooper.ai/v1 et ajoutez votre clé. Voici quelques exemples populaires :
… et bien d’autres encore — toute application, agent ou SDK compatible avec une endpoint OpenAI fonctionne directement.
PAIEMENT – À RETENIR :
Facturation au prorata du nombre de tokens utilisés, débitée depuis votre budget prépayé.
Aucuns frais fixes – vous n'êtes facturé qu'au moment des appels à l'API.
Facture officielle émise le jour suivant. La TVA est déjà incluse si applicable.
AUCUNE RESTITUTION !
Consulter la documentation complète sur les paiements.