Volten AI
SaaS d'assistance IA omnicanal avec gestion de la vérité et moteur RAG hybride.

Volten AI est une plateforme SaaS d'assistance virtuelle omnicanale d'entreprise conçue pour automatiser le support client sur WhatsApp, Instagram et Facebook avec une précision supérieure à 99% grâce à un moteur RAG hybride et un système de reprise en main par un agent humain.
Les entreprises font face à des coûts de support élevés et à des temps de réponse lents sur les canaux de messagerie instantanée, tandis que les chatbots IA génériques hallucinent souvent et manquent d'intégration sécurisée avec la documentation officielle.
LA SOLUTION TECHNIQUEUne architecture microservices distribuée combinant l'ingestion Go haut débit, la recherche hybride PostgreSQL (pgvector + GIN) et un pipeline RAG basé sur une hiérarchie de gestion de la vérité, avec basculement automatique vers des agents humains via WebSockets.
Impact & Métriques Clés
< 100ms
Temps de réponse webhook Meta (Gateway Go)
99%+
Précision des réponses sans hallucination
-65%
Réduction de la charge du support client
< 2s
Latence d'inférence RAG de bout en bout
Spécifications Techniques Completes
Frontend & UI
- Next.js 16 (App Router)
- React 19
- TypeScript
- TailwindCSS v4
- TanStack Query v5
- Socket.io Client
- Zod v4
- Shadcn UI
Backend & Services
- Golang (Go)
- Node.js / Bun
- NestJS (BFF)
- Meta Graph API
- OpenAI API
- Anthropic Claude API
Données & Cache
- PostgreSQL (pgvector)
- GIN Full-Text Search
- HNSW Vector Indexing
- Redis
- RabbitMQ
Infrastructure & DevOps
- Docker
- Docker Compose
- Nginx / Caddy
- VPS Deployment
- Tenant Isolation Architecture
Intégrations Tiers
- WhatsApp Business API
- Instagram DMs
- Facebook Messenger
- Stripe
- Firecrawl Web Parser
Décisions d'Architecture Clés
Moteur RAG Hybride & Gestion de la Vérité (pgvector + GIN)
Combinaison de la recherche vectorielle HNSW (OpenAI embeddings) et de la recherche textuelle PostgreSQL tsvector avec réordonnancement selon la priorité des sources (FAQ 1.0 > PDF 0.7 > Crawl Web 0.4) pour éliminer les hallucinations.
Passerelle Webhook Go Haute Concurrence pour Meta Cloud API
Microservice Go dédié pour la vérification de signature HMAC sub-milliseconde et la réponse HTTP 200 instantanée, transmettant les payloads de messages à RabbitMQ pour un traitement asynchrone sans perte.
Passation Agent Humain en Temps Réel & Briefings Neuraux IA
Architecture WebSocket Socket.io déclenchant l'escalade vers un agent humain dès que la confiance IA baisse, générant automatiquement un résumé synthétique de la conversation pour l'agent.
Isolation Multi-Tenant & Audit Transparent des Ressources
Filtrage scalaire strict par tenant_id au niveau de la base et des index vectoriels, couplé à un suivi télémétrique détaillé des jetons d'inférence, du stockage et de la facturation Stripe.
Fonctionnalités Principales
Bibliothèque de Connaissances Multi-Sources (RAG Hybride)
Ingestion et vectorisation de documents PDF, de documentation technique et de sites web pour créer une base de connaissances privée et sécurisée.
Boîte de Réception Omnicanale Unifiée (WhatsApp, Instagram, FB)
Tableau de bord unifié pour suivre, inspecter et répondre aux messages clients provenant de tous les canaux Meta en temps réel.
Passation Agent Humain & Résumés Neuraux IA
Transfert fluide des conversations de l'IA vers les agents humains avec résumés contextuels générés automatiquement.
Audit de Conflits Sémantiques & Intégrité
Scanner d'arrière-plan détectant les contradictions et politiques obsolètes au sein de la documentation ingérée.
Terrain d'Essai & Terminal de Latence
Environnement bac à sable pour tester le raisonnement du modèle, la consommation de tokens et la latence avant mise en production.
Suivi des Ressources & Facturation à l'Usage
Analyse détaillée des jetons d'inférence, de l'espace de stockage vectoriel et des volumes de messages avec facturation Stripe.