Recherche dans les devis sur place
Hypothétique. Ni un client ni un résultat.
// Le problème
Les ingénieurs fouillent des milliers de devis, de dessins et de documents fournisseurs pour répondre à une question, et les contrats interdisent d’envoyer ces documents à un modèle externe.
// Ce que nous bâtirions
Un assistant sur un modèle open source qui roule sur un serveur GPU dans votre propre centre de données, répond à partir des devis, des dessins et des données fournisseurs en citant la page d’origine, rédige des vérifications de nomenclature et signale les incohérences entre documents pour qu’un ingénieur les confirme.
// Ce qu’il comprend
- Devis, fiches techniques et documents fournisseurs indexés et tenus à jour
- Des réponses qui citent le document et la page d’où elles viennent
- Des vérifications de nomenclature rédigées selon les devis, à confirmer par un ingénieur
- Des signalements quand deux documents ne concordent pas sur une valeur
- Un jeu d’évaluation tiré de vraies questions, exécuté avant chaque changement
- Un modèle open source sur un serveur GPU qui vous appartient, sans rien envoyer à l’extérieur
// Technologies
- Llama ou Qwen (open source)
- vLLM
- PostgreSQL avec pgvector
- Next.js
- Serveur GPU Lenovo sur place
// estimation
- Développement
- ≈ 148 000 USD à 225 000 USD, livré en 27 semaines au plus210 600 $ CA à 320 600 $ CA
- Hébergement
- ≈ 176 USD par mois250 $ CA par mois
- Soutien
- ≈ 2 500 USD par mois3 565 $ CA par mois
- Matériel
- ≈ 47 800 USD à 197 000 USD68 000 $ CA à 280 800 $ CA
Les prix dans votre devise sont des estimations au taux du jour de la Banque du Canada. Toute la facturation se fait en CAD ou en USD.
- Approche d’IA
- Modèle open source
- Coût d’exploitation du modèle
- ≈ 176 USD par mois250 $ CA par mois
Échéancier par étape
- Découverte
- 2,9 à 3,4 semaines
- Spécification et plan d’évaluation
- 0,4 semaine
- Maquettes approuvées
- 2,4 à 3,9 semaines
- Fonctions principales
- 1,4 à 2,4 semaines
- Développement complet
- 0,9 à 1,4 semaine
- Projet pilote fonctionnel
- 5,9 à 10,4 semaines
- Tests et corrections
- 1,4 à 2,4 semaines
- Mise en ligne
- 0,9 à 1,4 semaine
- Production
- 0,9 à 1,4 semaine
Hors de notre contrôle, et ajouté au calendrier
- Livraison du matériel, après la commande
- 2 à 6 semaines
- Examen de sécurité informatique du client et intégration du fournisseur
- 4 à 8 semaines
Modalités de paiement
- Acompte 20 %
- 42 060 $ CA à 64 060 $ CA
- Découverte 1,6 %
- 3 364,80 $ CA à 5 124,80 $ CA
- Spécification et plan d’évaluation 11 %
- 23 133 $ CA à 35 233 $ CA
- Maquettes approuvées 1,6 %
- 3 364,80 $ CA à 5 124,80 $ CA
- Fonctions principales 4,9 %
- 10 304,70 $ CA à 15 694,70 $ CA
- Développement complet 3,2 %
- 6 729,60 $ CA à 10 249,60 $ CA
- Projet pilote fonctionnel 33,1 %
- 69 609,30 $ CA à 106 019,30 $ CA
- Tests et corrections 1,6 %
- 3 364,80 $ CA à 5 124,80 $ CA
- Mise en ligne 1,6 %
- 3 364,80 $ CA à 5 124,80 $ CA
- Production 11,4 %
- 23 974,20 $ CA à 36 514,20 $ CA
- Retenue, 30 jours après la mise en ligne (10 %)
- 21 030 $ CA à 32 030 $ CA
- Temps GPU pour l’entraînement et les tests, au coût
- 300 $ CA. Facturé d’avance, au coût, en dehors des étapes
- Serveur GPU pour l’IA, pour le modèle
- 68 000 $ CA à 280 800 $ CA. Facturé d’avance, au coût, en dehors des étapes