Assistant hors réseau
Hypothétique. Ni un client ni un résultat.
// Le problème
Les techniciens fouillent à la main des milliers de pages de manuels techniques à accès restreint, et aucun service d’IA externe n’a le droit d’en approcher.
// Ce que nous bâtirions
Un assistant sur un modèle open source qui roule sur un serveur GPU dans un réseau isolé, répond à partir des propres manuels de l’organisation en citant la section, et reçoit ses mises à jour par des supports approuvés. Rien n’atteint Internet, dans un sens comme dans l’autre.
// Ce qu’il comprend
- Manuels et bulletins de service indexés à l’intérieur du réseau isolé
- Des réponses qui citent la section du manuel, pour que le technicien vérifie
- Un accès par rôle : chaque utilisateur ne voit que les manuels auxquels il a droit
- Un modèle open source sur un serveur GPU sans aucune voie vers l’extérieur
- Mises à jour et nouveaux manuels chargés selon votre processus de supports approuvés
// Technologies
- Llama ou Mistral (open source)
- vLLM
- PostgreSQL avec pgvector
- Next.js
- Serveur GPU Lenovo isolé du réseau
// estimation
- Développement
- ≈ 120 000 USD à 183 000 USD, livré en 25 semaines au plus171 200 $ CA à 260 200 $ CA
- Hébergement
- ≈ 176 USD par mois250 $ CA par mois
- Soutien
- ≈ 2 500 USD par mois3 565 $ CA par mois
- Matériel
- ≈ 47 800 USD à 197 000 USD68 000 $ CA à 280 800 $ CA
Les prix dans votre devise sont des estimations au taux du jour de la Banque du Canada. Toute la facturation se fait en CAD ou en USD.
- Approche d’IA
- Modèle open source
- Coût d’exploitation du modèle
- ≈ 176 USD par mois250 $ CA par mois
Échéancier par étape
- Découverte
- 2,9 à 3,4 semaines
- Spécification et plan d’évaluation
- 0,4 semaine
- Maquettes approuvées
- 2,4 à 3,4 semaines
- Règles d’accès revues avec votre responsable désigné
- 1,4 à 2,4 semaines
- Fonctions principales
- 1,4 à 2,4 semaines
- Développement complet
- 0,9 à 1,4 semaine
- Projet pilote fonctionnel
- 3,9 à 6,9 semaines
- Tests et corrections
- 0,4 à 0,9 semaine
- Constats du test d’intrusion fermés
- 0,9 à 1,9 semaine
- Mise en ligne
- 0,9 à 1,4 semaine
- Production
- 0,9 à 1,4 semaine
Hors de notre contrôle, et ajouté au calendrier
- Livraison du matériel, après la commande
- 2 à 6 semaines
- Test d’intrusion indépendant et nouveau test
- 2 à 4 semaines
Modalités de paiement
- Acompte 20 %
- 34 180 $ CA à 51 980 $ CA
- Découverte 1,5 %
- 2 563,50 $ CA à 3 898,50 $ CA
- Spécification et plan d’évaluation 8 %
- 13 672 $ CA à 20 792 $ CA
- Maquettes approuvées 1,5 %
- 2 563,50 $ CA à 3 898,50 $ CA
- Règles d’accès revues avec votre responsable désigné 7,7 %
- 13 159,30 $ CA à 20 012,30 $ CA
- Fonctions principales 4,6 %
- 7 861,40 $ CA à 11 955,40 $ CA
- Développement complet 3,1 %
- 5 297,90 $ CA à 8 056,90 $ CA
- Projet pilote fonctionnel 24,2 %
- 41 357,80 $ CA à 62 895,80 $ CA
- Tests et corrections 1,5 %
- 2 563,50 $ CA à 3 898,50 $ CA
- Constats du test d’intrusion fermés 7,7 %
- 13 159,30 $ CA à 20 012,30 $ CA
- Mise en ligne 1,5 %
- 2 563,50 $ CA à 3 898,50 $ CA
- Production 8,7 %
- 14 868,30 $ CA à 22 611,30 $ CA
- Retenue, 30 jours après la mise en ligne (10 %)
- 17 090 $ CA à 25 990 $ CA
- Temps GPU pour l’entraînement et les tests, au coût
- 300 $ CA. Facturé d’avance, au coût, en dehors des étapes
- Serveur GPU pour l’IA, pour le modèle
- 68 000 $ CA à 280 800 $ CA. Facturé d’avance, au coût, en dehors des étapes