IK
Inefable KoumbaIngénieur Logiciel · Data & Réseaux
arrow_backRetour aux projets
OMNICHANNEL AIHYBRID RAGGOLANG GATEWAYPGVECTOR

Volten AI

SaaS d'assistance IA omnicanal avec gestion de la vérité et moteur RAG hybride.

Volten AI
PRÉSENTATION DU PROJET

Volten AI est une plateforme SaaS d'assistance virtuelle omnicanale d'entreprise conçue pour automatiser le support client sur WhatsApp, Instagram et Facebook avec une précision supérieure à 99% grâce à un moteur RAG hybride et un système de reprise en main par un agent humain.

LE DÉFI / PROBLÈME

Les entreprises font face à des coûts de support élevés et à des temps de réponse lents sur les canaux de messagerie instantanée, tandis que les chatbots IA génériques hallucinent souvent et manquent d'intégration sécurisée avec la documentation officielle.

LA SOLUTION TECHNIQUE

Une architecture microservices distribuée combinant l'ingestion Go haut débit, la recherche hybride PostgreSQL (pgvector + GIN) et un pipeline RAG basé sur une hiérarchie de gestion de la vérité, avec basculement automatique vers des agents humains via WebSockets.

Impact & Métriques Clés

< 100ms

Temps de réponse webhook Meta (Gateway Go)

99%+

Précision des réponses sans hallucination

-65%

Réduction de la charge du support client

< 2s

Latence d'inférence RAG de bout en bout

Spécifications Techniques Completes

Frontend & UI

  • Next.js 16 (App Router)
  • React 19
  • TypeScript
  • TailwindCSS v4
  • TanStack Query v5
  • Socket.io Client
  • Zod v4
  • Shadcn UI

Backend & Services

  • Golang (Go)
  • Node.js / Bun
  • NestJS (BFF)
  • Meta Graph API
  • OpenAI API
  • Anthropic Claude API

Données & Cache

  • PostgreSQL (pgvector)
  • GIN Full-Text Search
  • HNSW Vector Indexing
  • Redis
  • RabbitMQ

Infrastructure & DevOps

  • Docker
  • Docker Compose
  • Nginx / Caddy
  • VPS Deployment
  • Tenant Isolation Architecture

Intégrations Tiers

  • WhatsApp Business API
  • Instagram DMs
  • Facebook Messenger
  • Stripe
  • Firecrawl Web Parser

Décisions d'Architecture Clés

01. HIGHLIGHT

Moteur RAG Hybride & Gestion de la Vérité (pgvector + GIN)

Combinaison de la recherche vectorielle HNSW (OpenAI embeddings) et de la recherche textuelle PostgreSQL tsvector avec réordonnancement selon la priorité des sources (FAQ 1.0 > PDF 0.7 > Crawl Web 0.4) pour éliminer les hallucinations.

02. HIGHLIGHT

Passerelle Webhook Go Haute Concurrence pour Meta Cloud API

Microservice Go dédié pour la vérification de signature HMAC sub-milliseconde et la réponse HTTP 200 instantanée, transmettant les payloads de messages à RabbitMQ pour un traitement asynchrone sans perte.

03. HIGHLIGHT

Passation Agent Humain en Temps Réel & Briefings Neuraux IA

Architecture WebSocket Socket.io déclenchant l'escalade vers un agent humain dès que la confiance IA baisse, générant automatiquement un résumé synthétique de la conversation pour l'agent.

04. HIGHLIGHT

Isolation Multi-Tenant & Audit Transparent des Ressources

Filtrage scalaire strict par tenant_id au niveau de la base et des index vectoriels, couplé à un suivi télémétrique détaillé des jetons d'inférence, du stockage et de la facturation Stripe.

Fonctionnalités Principales

Bibliothèque de Connaissances Multi-Sources (RAG Hybride)

Ingestion et vectorisation de documents PDF, de documentation technique et de sites web pour créer une base de connaissances privée et sécurisée.

Next.js 16Go Ingestion ServicePostgreSQL pgvectorFirecrawl

Boîte de Réception Omnicanale Unifiée (WhatsApp, Instagram, FB)

Tableau de bord unifié pour suivre, inspecter et répondre aux messages clients provenant de tous les canaux Meta en temps réel.

Go Webhook GatewayNestJS BFFMeta Graph APISocket.ioReact 19

Passation Agent Humain & Résumés Neuraux IA

Transfert fluide des conversations de l'IA vers les agents humains avec résumés contextuels générés automatiquement.

Node.js Human Agent ServiceSocket.ioOpenAI GPT-4oTanStack Query v5

Audit de Conflits Sémantiques & Intégrité

Scanner d'arrière-plan détectant les contradictions et politiques obsolètes au sein de la documentation ingérée.

Go Ingestion EngineNode.js OrchestrationPostgreSQL GINTailwindCSS

Terrain d'Essai & Terminal de Latence

Environnement bac à sable pour tester le raisonnement du modèle, la consommation de tokens et la latence avant mise en production.

Next.js App RouterReact 19Socket.ioShadcn UI

Suivi des Ressources & Facturation à l'Usage

Analyse détaillée des jetons d'inférence, de l'espace de stockage vectoriel et des volumes de messages avec facturation Stripe.

Node.js Dispatch & Billing ServiceStripe APIPostgreSQLRecharts