Zum Inhalt springen
AtheronLABS

Erkanntes Land: Vereinigte Staaten. Preise werden in US-Dollar angezeigt. Nicht richtig?

labs@atheron:~/industries/media/ai$ train agent --grounded

KI für die Archivsuche

Der richtige Ausschnitt zum Redaktionsschluss, mit seinen Rechten.

Ein Archiv ist so viel wert, wie eine Produzentin darin zum Redaktionsschluss findet. Wir transkribieren und erfassen es und setzen einen Assistenten darüber, der direkt auf den Ausschnitt verlinkt, auf Open-Source-Modellen, die Sie kontrollieren, weil unveröffentlichtes und rechtebeschränktes Material Ihre Hände nicht verlassen sollte.

// worauf es hier ankommt

Was in dieser Branche anders ist.

01

Bis auf den Moment

Die Suche findet den Timecode, an dem über ein Thema gesprochen wurde, nicht nur die Sendung, in der es vorkam.

02

Rechte neben jedem Ergebnis

Jeder Ausschnitt zeigt seine Rechtehinweise, sodass eine Produzentin weiß, was gesendet werden darf, bevor sie einen Beitrag darum baut.

03

Von Grund auf privat

Open-Source-Modelle laufen auf GPUs, die Sie kontrollieren. Unveröffentlichte Sendungen und beschränkte Aufnahmen gehen nie an einen externen KI-Anbieter.

04

An echten Suchen getestet

Wir bauen einen Prüfsatz aus Suchen, die Ihre Produktion wirklich gemacht hat, und der Assistent wird vor jeder Änderung daran bewertet.

// Beispielprojekte

Beispiele mit Preis.

Jedes ist angenommen, als solches gekennzeichnet und live aus unserer Preisliste berechnet. Öffnen Sie eines im Rechner und machen Sie es zu Ihrem.

BeispielprojektWeb-AppKIOpen-Source-Modell

Assistent für die Archivsuche

Angenommen. Kein Kunde, kein Ergebnis.

// Das Problem

Ein Sender hält Jahrzehnte von Sendungen und Beiträgen, und Produzenten suchen stundenlang nach einem Ausschnitt, weil das Archiv nur Titel und Daten kennt.

// Was wir bauen würden

Jede Sendung transkribiert und erfasst, mit einem Assistenten, der die Stelle findet, an der über ein Thema gesprochen wurde, und auf den Timecode verlinkt. Er läuft auf Open-Source-Modellen auf GPUs, die der Sender kontrolliert, weil unveröffentlichtes Material und rechtebeschränkte Aufnahmen nicht an einen externen Anbieter gehen sollten.

// Was drin ist

  • Transkripte für das Archiv und jede neue Sendung
  • Suche nach Thema, Person und Ort, bis auf den Timecode
  • Antworten, die auf den Ausschnitt verlinken und die Rechtehinweise daneben zeigen
  • Sprecher- und Spracherkennung für Englisch und Französisch
  • Ein Prüfsatz aus echten Suchen der Produktion, der vor jeder Änderung läuft

// Tech-Stack

  • Whisper (Open Source)
  • Llama oder Qwen (Open Source)
  • vLLM
  • PostgreSQL mit pgvector
  • DigitalOcean GPU

// Schätzung

Entwicklung
≈ 109.000 USD bis 166.000 USD, delivered within 21 weeksCAD 154,900 to 236,700
Hosting
≈ 4.530 USD im MonatCAD 6,450 im Monat
Support
≈ 1.000 USD im MonatCAD 1,425 im Monat

Preise in Ihrer Währung sind Schätzungen zum heutigen Kurs der Bank of Canada. Alle Rechnungen werden in CAD oder USD gestellt.

KI-Weg
Open-Source-Modell
Laufende Modellkosten
≈ 4.190 USD im MonatCAD 5,960 im Monat

Zeitplan je Meilenstein

Découverte
2.9 to 3.4 weeks
Spécification et plan d’évaluation
0.4 weeks
Maquettes approuvées
2.4 to 3.9 weeks
Fonctions principales
1.4 to 1.9 weeks
Développement complet
0.9 to 1.4 weeks
Projet pilote fonctionnel
3.4 to 5.4 weeks
Tests et corrections
0.9 to 1.9 weeks
Mise en ligne
0.9 to 1.4 weeks
Production
0.9 to 1.4 weeks

Wie bezahlt wird

Anzahlung 20%
CAD 30,920 to 47,280
Découverte 2%
CAD 3,092 to 4,728
Spécification et plan d’évaluation 10.3%
CAD 15,923.80 to 24,349.20
Maquettes approuvées 2%
CAD 3,092 to 4,728
Fonctions principales 6%
CAD 9,276 to 14,184
Développement complet 4%
CAD 6,184 to 9,456
Projet pilote fonctionnel 31.1%
CAD 48,080.60 to 73,520.40
Tests et corrections 2%
CAD 3,092 to 4,728
Mise en ligne 2%
CAD 3,092 to 4,728
Production 10.6%
CAD 16,387.60 to 25,058.40
Holdback, 30 days after launch (10%)
CAD 15,460 to 23,640
Temps GPU pour l’entraînement et les tests, au coût
CAD 300. Im Voraus berechnet, zum Einkaufspreis, außerhalb der Meilensteine

// questions

Fragen, die wir dazu bekommen.

Wie lange dauert es, ein ganzes Archiv zu transkribieren?

Das hängt von der Größe des Archivs ab und davon, wie viele GPUs gleichzeitig laufen. Die Schätzung preist die GPU-Zeit, und neue Sendungen werden transkribiert, sobald sie laufen.

Könnte die Archivsuche stattdessen ein Spitzenmodell nutzen?

Ja, für bereits veröffentlichtes Material, und es ist für den Anfang günstiger. Für unveröffentlichte oder beschränkte Aufnahmen hält ein Open-Source-Modell auf GPUs, die Sie kontrollieren, sie privat; wir preisen beides.

Verarbeitet es französische und englische Sendungen?

Ja. Transkription und Suche funktionieren in beiden, und die Ergebnisse zeigen, in welcher Sprache der Ausschnitt ist.

// weiter

Nicht ganz Ihr Projekt?

Sagen Sie uns, was Sie vorhaben. Wir melden uns mit einer Spanne und den Fragen, die sie eingrenzen würden. Oder buchen Sie ein Gespräch und wir reden darüber.

KI-Archivsuche für Medien auf Open-Source-Modellen | Atheron Network Labs