Choisissez votre modele IA souverain
Azure OpenAI EU, Mistral Cloud France, AWS Bedrock EU, Google Vertex EU, Anthropic, LLM local au choix (Llama, Mistral, Gemma...), ou votre propre endpoint BYOK — une seule interface, fallback automatique, metriques en temps reel.
Inclus dans tous les plans Pro, Elite et Ultra. Aucune carte bancaire pour l'essai.
7 providers disponibles
Chaque provider a ses forces : latence, qualite, souverainete, cout. ZappRouter vous laisse arbitrer par usage.
Azure OpenAI
EU Data Zone (Sweden Central)
GPT-4o, GPT-4o mini
Mistral Cloud
France (Paris)
mistral-large, mistral-small
AWS Bedrock EU
eu-central-1 (Frankfurt) + eu-west-3 (Paris)
Claude opus-4 / sonnet-4, Mistral large, Haiku 3.5
Vertex AI EU
europe-west1 (Belgium) + europe-west4 (Netherlands)
Gemini 1.5 Pro / Flash, Gemini 2.0 Flash
Anthropic natif
US (prompt caching actif)
Claude Opus 4, Sonnet 4
LLM local self-hosted
Votre machine (tunnel Connector)
Llama 3.2, Mistral 7B, Gemma 2/3, Qwen, Phi... (modele au choix)
BYOK generique
Votre endpoint OpenAI-compatible
Tout endpoint OpenAI-compat
Fonctionnalites serieuses
Pense pour la production : haute dispo, securite, observabilite.
Fallback chain configurable
Primary / fallback / fallback-2. Si Mistral Cloud down, bascule auto sur Azure puis Bedrock EU. 0 interruption pour vos users.
Niveau de reflexion par action
Chat quotidien sur LLM local (rapide, prive). Estimation complexe sur Claude Opus 4. Vous decidez modele par type d'action.
Metriques + cost tracking
Dashboard super-admin : latence P50/P75/P95 par provider + tokens consommes + cout estime. Detection derive automatique.
BYOK avec encryption AES-GCM
Vos clefs API jamais affichees apres save (masquees). Chiffrees au repos, dechiffrees cote serveur uniquement.
Alerting success rate
Ntfy alerte si un provider descend sous 99% sur 1h. Latence P95 > 10s pendant 5min ? Bascule auto vers fallback.
Audit trail complet
Chaque requete logee (tenant, user, model, tokens, latence, cache hit). Exportable CSV pour votre DPO ou audit ANSSI.
Vos donnees restent la ou vous voulez
3 niveaux de souverainete selon vos exigences DPO / CNIL / AO public.
Residency EU (AWS + GCP)
Bedrock eu-central-1 / eu-west-3 et Vertex europe-west1 / europe-west4. Donnees jamais hors UE.
A noter : Certifications actuelles : SOC 2, ISO 27001/27017/27018, HDS (AWS pending), C5 Germany (GCP). Pas de SecNumCloud a ce jour.
France sovereign (Mistral)
Mistral Cloud heberge en France (Paris), entreprise francaise, DPA RGPD-aligned.
A noter : Catalogue plus restreint que Bedrock (mistral-large, mistral-small uniquement).
100% local (LLM auto-heberge)
Exposez le LLM de votre choix (Llama, Mistral, Gemma, Qwen, Phi...) via le Connector ZappImmo (tunnel signe). Aucune donnee ne quitte votre machine, aucun modele impose.
A noter : Latence + qualite = au modele local choisi. Recommande pour usages sensibles (donnees nominatives, dossiers medicaux).
SecNumCloud reste a l'etude — aucun des providers majeurs n'est qualifie SecNumCloud au 21 Avril 2026. Pour les AO qui l'exigent, utilisez le mode LLM local via Connector ZappImmo (0 data externe).
Questions frequentes
Tout ce que votre DPO, votre DSI et votre directeur general veulent savoir avant de basculer en production.
- Chaque action IA dans ZappImmo (estimation, chat, scoring, etc.) expose un selecteur de niveau de reflexion. Les super-admins configurent le mapping action→provider→modele via le dashboard /dashboard/super-admin/zapp-router. Le switch prend effet sur la prochaine requete, sans redemarrage.
- ZappRouter bascule automatiquement vers le fallback configure. Chaque chaine a un primary + fallback + fallback-2 (ex: Mistral → Azure → Bedrock EU). Le budget d'erreur est de 3 echecs par fenetre de 60s avant bascule. L'utilisateur ne voit aucune interruption.
- Non. AWS Bedrock est configure sur eu-central-1 (Frankfurt) + eu-west-3 (Paris). Google Vertex AI est configure sur europe-west1 (Belgium) + europe-west4 (Netherlands). Les DPA sont signes par les entites europeennes (AWS Europe SARL Luxembourg, Google Cloud EMEA Ireland). Aucun transfert hors UE.
- Dans Settings > ZappRouter > BYOK, collez votre clef OpenAI-compatible. Elle est chiffree AES-256-GCM avec pgcrypto + dechiffree cote serveur uniquement. Jamais affichee apres save (masquee avec les 4 derniers caracteres). Revocation immediate possible.
- Oui. Installez le Connector ZappImmo Desktop (Windows/Mac/Linux), il expose votre LLM local (Llama 3.2, Mistral, Gemma 2/3, Qwen, Phi... — tout modele Ollama-compatible) via tunnel signe. Votre machine devient votre LLM : 0 data externe, latence reseau minimale, cout marginal nul sur votre materiel. Vous choisissez le modele a installer, ZappImmo ne vous en impose aucun.
- Mesuree P50/P75/P95 sur nos dashboards : Azure EU ~600ms P50, Mistral France ~550ms P50, Bedrock Frankfurt ~800ms P50, Vertex Belgium ~900ms P50, Anthropic US ~1200ms P50. Le LLM local depend du modele choisi et de votre hardware (typiquement 200-500ms sur RTX 4090 pour un modele 7-13B quantifie). Streaming SSE preserve en cross-provider.
- Oui, nettement. Les prompts system longs + contexte tool-use sont caches cote Anthropic (ephemeral 5 min). Sur les workflows RAG repetitifs, economie 60-90% sur les tokens input. Actif par defaut sur Anthropic direct et via Bedrock Claude.
- Toutes les clefs BYOK (OpenAI-compat, Anthropic, cles workspace Vertex, secrets Bedrock IAM) sont chiffrees au repos via AES-256-GCM avec pgcrypto. Dechiffrement cote serveur uniquement (jamais cote frontend ni logs). Rotation mensuelle automatique.
