Über Coresynthetics

Sechs Leute in Hamburg bauen Welten, die niemand betreten muss.

Coresynthetics ist ein Hamburger Dienstleister für synthetische Bild-, Sprach- und Textdaten. Wir produzieren Trainingsmaterial für Teams, deren Modelle an Fällen scheitern, die sich mit echten Aufnahmen kaum belegen lassen: Nebel auf Rotorblättern, Rost an Schweißnähten, Genuscheltes in einer lauten Küche. Seit 2015 bauen wir dafür Szenen in 3D, Stimmprofile auf dem Modellserver und Korpora mit Zeitmarken pro Wort.

Prozedurale Szenen Bounding-Boxen Raumimpulsantworten Tiefenkarten Dialektkorpora Edge-Case-Katalog Prozedurale Szenen Bounding-Boxen Raumimpulsantworten Tiefenkarten Dialektkorpora Edge-Case-Katalog
In Zahlen

Zahlen, die man nachprüfen kann.

Keine Marketingprosa. Diese Werte stammen aus internen Protokollen der letzten zwölf Monate und lassen sich für einzelne Aufträge belegen.

2015
Jahr der ersten Auslieferung
26
Kameramodelle in der Asset-Bibliothek
2.100
Sprechstunden pro Produktionsmonat
4.900
gerenderte Bilder an einem einzelnen Tag
F/01

Die Werkstatt zuerst

Wir haben 2015 mit drei Rechnern in einem Hinterhof angefangen. Die ersten Aufträge waren zwei Schweißnaht-Szenen für einen Hersteller von Kesselanlagen. Aus dieser Zeit stammt die Gewohnheit, vor jedem großen Batch eine kleine Stichprobe abzunehmen und dem Kunden zu zeigen.

F/02

Nichts wird verkauft

Alle Assets im Haus wurden entweder selbst gebaut oder mit kommerzieller Lizenz erworben.

F/03

Sechs Kollegen

Zwei Modellierer, zwei Toningenieure, ein Maschinenlerner, ein Vertriebsleiter. Mehr Leute braucht ein Auftrag nicht, weil wir jeden Batch als Dienstleistung und nicht als Produkt behandeln.

F/04

Ehrliche Absagen

Wenn ein synthetischer Datensatz für einen Fall nicht passt, sagen wir das im Erstgespräch. Bisher haben wir zwölf Anfragen abgelehnt, weil ein ehrlicher Drehtag billiger gewesen wäre.

Haltung

Wir sind kein Ersatz für Kameras und Mikrofone.

Synthetische Daten sind eine Ergänzung. Sie füllen die Lücken, die sich echt nicht schließen lassen, und sparen dort am meisten Zeit, wo das Warten auf den passenden Moment teurer wäre als das Rendern.

Deshalb mischen wir bei fast jedem Auftrag ein paar echte Aufnahmen unter. Fünf bis fünfzehn Prozent reichen meistens, um dem Modell etwas mitzugeben, das ein reiner Render-Batch nicht liefern kann. Diese Empfehlung macht unsere Aufträge kleiner, und wir sagen sie trotzdem. Wer Modelle baut, kennt den Unterschied zwischen einem guten Recall im Trainingsbericht und einem, der auf dem Hof hält.

  • Kein Datensatz ohne dokumentierte Herkunft aller Assets
  • Keine Lieferung ohne Prüfprotokoll
  • Kein Auftrag ohne klare Absage, wenn er nicht passt
Renderfarm mit Kabeln, Racks und Monitoren im Halbdunkel
Racks im Hamburger Standort, aufgenommen im Aufnahmeraum
Das Team

Sechs Leute, drei Handwerke, ein Werkzeugkasten.

Die Mischung aus Visual Effects, Vermessung und maschinellem Lernen ist der Grund, warum unsere Datensätze brauchbar sind. Jeder Blickwinkel fehlt ohne den anderen.

Jonas Wehrhahn

Jonas Wehrhahn

Inhaber und Leitung

Kommt aus der Vermessung und hat die ersten Jahre jede Szene selbst kontrolliert. Entscheidet, welche Aufträge angenommen werden und welche nicht.

Sophie Ehrentraud

Sophie Ehrentraud

Szenenleitung

Baut Umgebungen, Kameras und Lichtsituationen und hält die Asset-Bibliothek in Ordnung. Prüft jede Testrender-Serie gegen die Auftragszeichnungen.

Aleksandr Petrov

Aleksandr Petrov

Maschinelles Lernen

Schaut sich Zwischenergebnisse aus dem Training der Kunden an und sagt früh, welche Klassen sich nie trennen lassen. Prüft auch die Labelqualität.

Marta Fehrmann

Marta Fehrmann

Sprachdaten und Linguistik

Entwickelt Stimmprofile, schreibt Sprechskripte und hört die Stichproben vor jedem Export. Zweite Linguistin im Team teilt sich dieselbe Aufgabe.

Bastian Ohlrogge

Bastian Ohlrogge

Toningenieur

Betreibt Aufnahmekabine und Modellserver. Zuständig für Impulsantworten, Übertragungskanäle und alle Files im WAV-Ordner der Kunden.

Nadja Cieslik

Nadja Cieslik

Kundenbetreuung und Verträge

Hält den Kontakt zu Kunden, schreibt Übergabeprotokolle und sorgt dafür, dass Nutzungsrechte und Lizenzen dokumentiert sind. Antwortet meistens innerhalb eines Werktags.

Wie wir arbeiten

Fünf Regeln, die nie verhandelbar sind.

Diese Regeln gelten bei jedem Auftrag, egal ob es um einen Pilotdatensatz mit 5.000 Szenen oder um 600 Sprechstunden im Monat geht.

R1

Kleine Stichprobe vor dem Batch

Nach etwa 800 Bildern stoppen wir und zeigen die Auswahl. Erst wenn Sie zustimmen, läuft der große Lauf an. Das kostet uns einen Tag und erspart Ihnen einen Fehlschlag von zwei Wochen.

R2

Alles kommt aus dem eigenen Haus

Kein Asset wird zugeliefert, ohne dass die Lizenz dokumentiert ist. Zu jedem Datensatz gibt es eine Asset-Liste mit Herkunft und Lizenz, prüfbar für Ihre Rechtsabteilung.

R3

Linguisten hören zu

Bei Sprachdaten reicht die Synthese nicht. Fünf Prozent jeder Lieferung wird von einem Linguisten durchgehört, Zeitmarken werden korrigiert, Fehlerquoten schriftlich gemeldet.

R4

Feste Seeds und Generatorversion

Jede Szene kommt mit festem Seed. Sie können denselben Datensatz in vier Monaten exakt erneut rendern, falls Ihr Modell andere Größenordnungen braucht und die Labels unverändert bleiben sollen.

R5

Ehrliche Absagen

Wenn ein Fall nicht zu uns passt, sagen wir das im Erstgespräch. Im letzten Jahr haben wir zwölf Anfragen abgelehnt, weil ein echter Drehtag billiger gewesen wäre.

Kundenstimme

Was nach der Zusammenarbeit bleibt.

Wir fragen regelmäßig nach, was das Material im echten Betrieb gebracht hat. Diese Rückmeldung landet nicht in Broschüren, sondern in unserem Edge-Case-Katalog für künftige Aufträge.

Ines Bregenzer

Unser Assistent hat in lauten Küchen kaum etwas verstanden. Nach dem Training auf 900 synthetischen Stunden mit Kochgeräuschen lag die Erkennungsrate dort bei 88 Prozent. Wichtiger als die Zahl: Coresynthetics hat uns erklärt, warum das Material so gebaut wurde.

Ines Bregenzer — Produktleitung Sprachassistent, Haushaltsgerätehersteller
Aus der Werkstatt

Woran wir gerade arbeiten.

Die Beiträge im Blog entstehen aus laufenden Aufträgen und enthalten keine Werbung. Längere Texte, konkrete Zahlen und Fehler, die wir selbst gemacht haben.

Zum Blog
Was wir produzieren

Zwei Leistungen, ein Werkzeugkasten.

Wer keine Lust auf ein langes Erstgespräch hat, kann sich auf der Preisseite die Pakete in Ruhe ansehen. Alle Konditionen stehen dort.

Synthetische Bilddaten für Computer Vision
Bilddaten

Synthetische Bilddaten für Computer Vision

Prozedurale Szenen mit kontrollierter Beleuchtung, Wetterlage und Kameraposition. Bounding-Boxen, Segmentierungsmasken und Tiefenkarten inklusive.

ab 4.900 € Details ansehen
Synthetische Sprachdaten für ASR und TTS
Audiodaten

Synthetische Sprachdaten für ASR und TTS

Stimmprofile mit definiertem Akzent, Alter und Kanaleigenschaften. Transkripte mit Wortzeitstempeln, geprüft von einem Linguisten vor der Lieferung.

ab 3.400 € Details ansehen
Kennenlernen

Wenn Sie Ihr Modell an einem Fall hängen lassen, reden wir darüber.

Schicken Sie drei Beispielbilder oder 20 Sekunden einer schwierigen Aufnahme. Sie bekommen eine schriftliche Einschätzung und, wenn es passt, ein Angebot mit Skizze, wie viele Szenen oder Sprechstunden wir ansetzen würden.

Rechtliche Grundlagen für Aufträge stehen in den Allgemeinen Geschäftsbedingungen. Wie wir mit personenbezogenen Daten umgehen, steht in der Datenschutzerklärung.