Aller au contenu
AtheronLABS

Pays détecté : États-Unis. Les prix sont affichés en dollars américains. Ce n’est pas le bon pays ?

labs@atheron:~/industries/media/ai$ train agent --grounded

IA pour les archives

Le bon extrait à l’heure de tombée, droits compris.

Des archives valent ce qu’un réalisateur peut y trouver à l’heure de tombée. Nous les transcrivons, les indexons et y ajoutons un assistant qui renvoie directement à l’extrait, sur des modèles open source que vous contrôlez, parce que le matériel inédit et à droits restreints ne devrait pas vous échapper.

// ce qui compte ici

Ce qui change dans ce secteur.

01

Jusqu’au moment précis

La recherche trouve le code temporel où un sujet a été abordé, pas seulement l’émission.

02

Les droits à côté de chaque résultat

Chaque extrait affiche ses notes de droits : le réalisateur sait ce qui peut passer en ondes avant de bâtir un segment autour.

03

Privé par conception

Les modèles open source roulent sur des GPU que vous contrôlez. Les émissions inédites et les images restreintes ne sont jamais envoyées à un fournisseur d’IA externe.

04

Testé sur de vraies recherches

Nous bâtissons un jeu d’évaluation à partir de recherches réellement faites par vos réalisateurs, et l’assistant y est évalué avant chaque changement.

// exemples de projets

Exemples chiffrés pour ce service.

Chacun est hypothétique, présenté comme tel et chiffré en direct à partir de notre grille tarifaire. Ouvrez-le dans l’estimateur et adaptez-le.

Exemple de projetApplication webIAModèle open source

Assistant d’archives

Hypothétique. Ni un client ni un résultat.

// Le problème

Un diffuseur détient des décennies d’émissions et de reportages, et les réalisateurs passent des heures à chercher un extrait parce que les archives ne connaissent que les titres et les dates.

// Ce que nous bâtirions

Chaque émission transcrite et indexée, avec un assistant qui trouve le moment où un sujet a été abordé et renvoie au code temporel. Il roule sur des modèles open source, sur des GPU que le diffuseur contrôle, parce que le matériel inédit et les images à droits restreints ne devraient pas aller chez un fournisseur externe.

// Ce qu’il comprend

  • Transcriptions du fonds d’archives et de chaque nouvelle émission
  • Recherche par sujet, par personne et par lieu, jusqu’au code temporel
  • Des réponses qui renvoient à l’extrait et affichent les notes de droits à côté
  • Détection des intervenants et de la langue, en français et en anglais
  • Un jeu d’évaluation tiré de vraies recherches de réalisateurs, exécuté avant chaque changement

// Technologies

  • Whisper (open source)
  • Llama ou Qwen (open source)
  • vLLM
  • PostgreSQL avec pgvector
  • GPU DigitalOcean

// estimation

Développement
≈ 109 000 USD à 166 000 USD, livré en 21 semaines au plus154 900 $ CA à 236 700 $ CA
Hébergement
≈ 4 530 USD par mois6 450 $ CA par mois
Soutien
≈ 1 000 USD par mois1 425 $ CA par mois

Les prix dans votre devise sont des estimations au taux du jour de la Banque du Canada. Toute la facturation se fait en CAD ou en USD.

Approche d’IA
Modèle open source
Coût d’exploitation du modèle
≈ 4 190 USD par mois5 960 $ CA par mois

Échéancier par étape

Découverte
2,9 à 3,4 semaines
Spécification et plan d’évaluation
0,4 semaine
Maquettes approuvées
2,4 à 3,9 semaines
Fonctions principales
1,4 à 1,9 semaine
Développement complet
0,9 à 1,4 semaine
Projet pilote fonctionnel
3,4 à 5,4 semaines
Tests et corrections
0,9 à 1,9 semaine
Mise en ligne
0,9 à 1,4 semaine
Production
0,9 à 1,4 semaine

Modalités de paiement

Acompte 20 %
30 920 $ CA à 47 280 $ CA
Découverte 2 %
3 092 $ CA à 4 728 $ CA
Spécification et plan d’évaluation 10,3 %
15 923,80 $ CA à 24 349,20 $ CA
Maquettes approuvées 2 %
3 092 $ CA à 4 728 $ CA
Fonctions principales 6 %
9 276 $ CA à 14 184 $ CA
Développement complet 4 %
6 184 $ CA à 9 456 $ CA
Projet pilote fonctionnel 31,1 %
48 080,60 $ CA à 73 520,40 $ CA
Tests et corrections 2 %
3 092 $ CA à 4 728 $ CA
Mise en ligne 2 %
3 092 $ CA à 4 728 $ CA
Production 10,6 %
16 387,60 $ CA à 25 058,40 $ CA
Retenue, 30 jours après la mise en ligne (10 %)
15 460 $ CA à 23 640 $ CA
Temps GPU pour l’entraînement et les tests, au coût
300 $ CA. Facturé d’avance, au coût, en dehors des étapes

// questions

Ce qu’on nous demande à ce sujet.

Combien de temps pour transcrire tout le fonds?

Ça dépend de la taille du fonds et du nombre de GPU qui travaillent en même temps. L’estimation chiffre le temps de GPU, et les nouvelles émissions sont transcrites dès leur diffusion.

Un modèle de pointe conviendrait-il?

Oui, pour le matériel déjà publié, et le départ coûte moins cher. Pour les images inédites ou restreintes, un modèle open source sur des GPU que vous contrôlez les garde privées; nous chiffrons les deux.

Fonctionne-t-elle en français comme en anglais?

Oui. La transcription et la recherche fonctionnent dans les deux langues, et les résultats indiquent la langue de l’extrait.

// la suite

Ce n’est pas tout à fait votre projet?

Décrivez-nous ce que vous avez en tête. Nous vous reviendrons avec une fourchette et les questions qui permettront de la resserrer. Ou réservez un appel pour en discuter.

Recherche par IA dans les archives médias, sur modèles open source | Atheron Network Labs