Réalisation

Un assistant IA pour sites web que j'ai conçu, développé et exploite comme produit SaaS

Stewie est un assistant intégrable qui apprend à partir du site et des documents d'une entreprise. Une balise script ajoute un chat qui répond uniquement depuis ce contenu, cite ses sources, capture les prospects et détecte leur intention. Le concierge visible dans la navigation de ce site est ce même produit, sur une architecture Cloudflare avec résidence des données en Europe.

Dernière mise à jour : juin 2026 stewie.io
stewie.io
Tableau de bord et widget de l'assistant IA Stewie
Coût IA par conversation
~0,012 $
Analyse de 200 pages
15–30 s
Stockage et traitement IA
UE
Code d'intégration
1 ligne

Le défi.

La recherche et les FAQ statiques répondent rarement à la vraie question d'un visiteur. Un chatbot générique peut faire pire en inventant ou en sortant du contexte. Je voulais transformer le contenu existant d'une entreprise en assistant disponible en continu, avec preuves citées et capture des conversations pertinentes, sans entretenir des centaines de réponses écrites.

La difficulté concernait toute la chaîne : explorer des sites au HTML variable, découper et vectoriser le contenu, isoler chaque client, retrouver et reclasser le bon contexte, puis générer une réponse fondée en résistant aux injections de prompt. Le coût devait permettre une formule gratuite et tout le traitement IA devait rester en Europe.

L'approche.

J'ai conçu Stewie comme un SaaS multi-tenant autour d'une boucle RAG : explorer, analyser, découper, vectoriser, stocker, retrouver, reclasser et répondre avec des sources. Cloudflare Workflows gère l'ingestion avec reprise, Queues amortit les pics et R2 conserve les sources.

Chaque client est isolé par identifiant dans les requêtes vectorielles et relationnelles. Le produit comprend le widget, une boîte de réception, les prospects, la base de connaissances, les statistiques et la configuration. Stewie est en bêta ouverte ; le concierge de ce site est le produit en production.

Architecture et choix.

Le fil conducteur est une architecture edge entièrement Cloudflare, presque sans coût au repos, avec traitement IA volontairement européen.

  • ·

    SvelteKit sur Cloudflare Workers. L'application et le widget tournent à l'edge sans serveur à administrer ni démarrage à froid.

  • ·

    Vectorize et D1 isolés par client. Chaque recherche vectorielle filtre l'espace du client et chaque requête relationnelle son identifiant. D1 conserve aussi le registre des vecteurs pour l'effacement RGPD.

  • ·

    Workflows, Queues et R2. Exploration, analyse, découpage, vectorisation et insertion forment un flux durable avec reprise par étape.

  • ·

    IA résidente en Europe. Claude génère via Amazon Bedrock à Francfort, Cohere aide à la recherche et Mistral traite les documents dans des régions européennes, sans entraînement sur les données.

  • ·

    Durable Objects pour le temps réel. Limitation par client et relais WebSocket permettent à un humain de reprendre une conversation.

Les problèmes les plus difficiles, résolus.

  • 1

    Génération en streaming depuis l'Europe. Bedrock demandait un décodeur propre pour son flux binaire et ses appels d'outils fragmentés. Cette couche de protocole a été développée avec des tests avant intégration.

  • 2

    Isolation approfondie des clients. Filtres d'espace, périmètres relationnels, registre vectoriel et réponses 404 non révélatrices empêchent toute fuite entre entreprises.

  • 3

    Injection de prompt sur des entrées non fiables. Pages explorées et messages visiteurs sont traités comme non fiables. Frontières d'instructions, neutralisation, détection d'abus, outils limités et rate limiting protègent le flux.

  • 4

    Un widget sur une page inconnue. Un lanceur Shadow DOM et un panneau dans une iframe de même origine évitent de voler les clics ou d'hériter des styles du site hôte.

Le résultat.

Stewie fonctionne comme assistant multi-tenant : il explore un site en quelques secondes, répond avec des citations, capture les prospects et reconnaît l'intention. Produit, tableau de bord, crawler et pipeline RAG tournent en production sur une architecture européenne.

Pour un client, cela démontre toute la chaîne, de l'ingestion jusqu'à l'interface intégrée et l'exploitation. Stewie peut être installé tel quel ou ses composants peuvent servir à un assistant davantage intégré aux processus internes.

Sous le capot.

SvelteKitCloudflare WorkersVectorizeD1Cloudflare WorkflowsDurable ObjectsR2 + QueuesAmazon Bedrock (UE)Claude Haiku 4.5CohereRAG

Questions fréquentes.

Votre question n'y figure pas ? Écrivez-moi directement.

Puis-je installer un assistant comme celui-ci sur mon site ? +

Oui. Stewie s'ajoute avec une balise script et utilise votre site et vos documents. Il peut apparaître en bulle ou via un lanceur personnalisé comme la barre de recherche de ce site.

Comment évite-t-il d'inventer ? +

Il retrouve et reclasse les passages pertinents, génère depuis ce contexte et cite la source. Si la réponse n'existe pas, il doit le dire plutôt que deviner. D'autres contrôles limitent les injections de prompt.

Où les données sont-elles traitées ? +

Le stockage Cloudflare est fixé en Europe et les traitements utilisent des régions européennes, notamment Bedrock à Francfort et Mistral à Paris. Les données de chaque client sont isolées et l'effacement est traçable.

Avez-vous tout développé vous-même ? +

Oui. J'ai conçu et construit le crawler, le pipeline RAG, le tableau de bord, le widget et la base de facturation. Stewie est en bêta ouverte et le concierge de ce site est le produit réel.

Combien coûte un tel assistant ? +

Le prix dépend de la première version et des intégrations. Le coût d'exploitation est déjà mesuré : environ 0,012 $ d'IA pour une conversation complète. Une intégration client reçoit un périmètre et un prix fixes.

Voir aussi
En savoir plus sur intégration ia

Vous avez un projet similaire ?
Le premier échange est gratuit.