Trychroma Trychroma
Vektordatenbank

Jede Quelle in Chroma, bereit für Retrieval.

Dataddo ist die schlüsselfertige Datenschicht für Chroma. Verbinden Sie über 400 Geschäftsquellen und halten Sie Ihren Vektorspeicher kontinuierlich mit sauberen, PII-sicheren, aktuellen Datensätzen versorgt - ohne Pipelines zu bauen oder zu warten - damit Ihre RAG-Pipelines, die semantische Suche und Ihre Agenten immer aktuelle Daten abrufen. Vollständig verwaltet und flexibel im Deployment - kein Vendor-Lock-in.

ARCHITEKTUR

Wo Chroma in Ihre Datenarchitektur passt

Sources

Business / DB / File / Streaming Connectors

450+ available, any direction

Orchestration

Monitoring

Governance & Lineage

IAM & SSO

Dataddo Platform

Speed Security Governance
Control Plane
Data Plane

Destinations

DWH / Data Lake / Lakehouse

Consumption

AI & Agents / Analytics

ETLELTReverse ETLCDCData Streaming
Any direction, any workload
IHRE DATENGRUNDLAGE

Jede Quelle in Chroma, sauber und aktuell

Verbinden Sie über 400 Quellen und halten Sie Chroma kontinuierlich mit sauberen, gesteuerten Datensätzen und Metadaten versorgt - ohne Pipelines zu bauen und ohne dass fehlerhafte oder defekte Daten Ihre Retrieval-Schicht erreichen.

Über 400 verwaltete Konnektoren

Marketing-, Vertriebs-, Finanz-, Produkt- und Werbeplattformen - dazu Datenbanken und Dateien - alle von uns gepflegt und bereit, Ihre KI zu fundieren.

Flexibles Batch-Laden

Laden Sie Chroma per geplantem Batch mit ETL oder ELT aus einer der über 400 Quellen - verknüpft, transformiert und in dem Takt geliefert, den Ihre Retrieval-Schicht braucht.

Geplante Ladevorgänge, die es aktuell halten

Laden Sie Chroma nach dem von Ihnen gewählten Zeitplan, damit es Ihre neuesten Quelldaten widerspiegelt, und aktualisieren Sie es, wenn sich Quellen ändern - ohne manuelle Neuaufbauten.

PII-sicher, bevor es fixiert ist

Die automatische PII-Erkennung maskiert oder hasht sensible Felder, und die Data Quality Firewall stoppt fehlerhafte Datensätze - damit nichts Unwiderrufliches in Chroma geschrieben wird.

Reiche Metadaten für gefiltertes Retrieval

Legen Sie strukturierte Metadaten neben Ihren Datensätzen ab, um semantische Suche und hybride Abfragen in Chroma zu filtern und einzugrenzen.

Proaktives Monitoring

Datenqualitätsprüfungen und Zustellungswarnungen erkennen Lücken, bevor sie Chroma oder die davon fundierten Agenten und Apps erreichen.

MIT VS. OHNE

Wer die Last trägt, wenn sich vorgelagert etwas ändert

Lassen Sie dieselben Quellen weiter in Chroma fließen - und sehen Sie, wer verantwortlich ist, wenn sich eine API, ein Schema oder ein Endpunkt ändert:

Ohne Dataddo Mit Dataddo Ergebnis für Sie
Änderung an API oder Authentifizierung Sie entdecken den Ausfall und müssen ihn in Eile beheben. Wir aktualisieren den Konnektor und stellen die Pipeline wieder her - oft bevor Sie es überhaupt bemerken. Pipelines zu Chroma fließen weiter
Schema-Drift Spalten ändern sich, und Pipelines brechen ab oder verfälschen Daten unbemerkt. Wird automatisch erkannt und nach konfigurierbaren Regeln behandelt. Nur saubere Daten landen in Chroma
Endpunkt eingestellt Sie müssen die Integration neu entwickeln. Wir übernehmen das Update - der Data Contract bleibt bestehen. Ihre Ladevorgänge in Chroma funktionieren weiter
Fehlender Konnektor Sie entwickeln und pflegen eine individuelle Integration. Wir entwickeln und pflegen ihn - mit einer SLA von rund 4 Wochen. Jede Quelle erreicht Chroma
Unbemerkte Verschlechterung Sie merken es erst, wenn ein Report oder ein Modelllauf fehlschlägt. Proaktives Monitoring erkennt Anomalien und Verzögerungen frühzeitig. Probleme werden erkannt, bevor die Retrieval-Qualität sinkt
Debugging Sie durchforsten Logs in verschiedenen, nicht verbundenen Tools. Run-Historien, Payload-Inspektion und durchgängige Lineage an einem Ort. Schnellere Ursachenanalyse, weniger Ausfallzeit
Datenresidenz von Grund auf

Wählen Sie, wo Chroma läuft - Cloud, souverän oder On-Premises

Vektorspeicher liegen oft neben sensiblem, proprietärem Wissen. Mit Dataddo entscheiden Sie pro Workload, wo die Data Plane läuft - vollständig in der Cloud, in einer regionalen oder souveränen Cloud oder On-Premises innerhalb Ihres eigenen Perimeters - egal ob Chroma ein verwalteter Dienst oder selbst gehostet ist. Die Control Plane orchestriert jede Option auf dieselbe Weise, nur über Metadaten.

Standort der Data Plane Typische Datensensibilität Warum dieses Setup

Public Cloud

AWS Microsoft Azure Google Cloud
Niedrig bis moderat - allgemeine Geschäfts-, Marketing- und Produktdaten; Quellen, die bereits cloud-nativ sind. Am schnellsten einsatzbereit und skaliert elastisch. Ideal, wenn für die Daten keine Residenzbeschränkung gilt und sie oft bereits in derselben Public Cloud liegen.

Regionale & europäische souveräne Clouds

EU-souveräne Clouds Regionale Anbieter Private Cloud
Reguliert / residenzgebunden - personenbezogene, Finanz- und Gesundheitsdaten, die der DSGVO oder lokalem Recht unterliegen. Hält die Verarbeitung innerhalb einer bestimmten Rechtsordnung, um Vorgaben zu Datenresidenz und Souveränität zu erfüllen, und läuft dabei weiterhin als verwaltete Infrastruktur.

On-Premises

Kubernetes Red Hat OpenShift VMware Tanzu
Hochsensibel / eingeschränkt - Daten, die vertraglich oder gesetzlich den Unternehmensperimeter nicht verlassen dürfen. Daten verlassen Ihr Netzwerk nie. Erforderlich für Air-Gapped-, klassifizierte oder streng abgeschottete Umgebungen; die Control Plane verwaltet weiterhin ausschließlich über Metadaten.
DATENTYPEN

Jeder Datentyp, transformiert und bereit zum Einbetten in Chroma

Dataddo verknüpft, bereinigt und strukturiert Daten aus über 400 Quellen, bevor sie Chroma erreichen - damit die Datensätze und Texte, die Ihre Embedding-Jobs lesen, konsistent und analysebereit ankommen.

Datentyp Beispiele Anwendungsfall im Vektorspeicher
Strukturiert Datenbanktabellen, CSV, SaaS- und CRM-Datensätze Kataloge, Tickets und CRM-Datensätze für semantische Suche und Empfehlungen einbetten
Semistrukturiert JSON, API-Antworten, NoSQL- und MongoDB-Dokumente Dokument- und Ereignisdaten flach machen und einbetten, um RAG zu fundieren
Unstrukturierter Text Freitextfelder: Bewertungen, Beschreibungen, Notizen, Support-Nachrichten Den Text liefern, den Ihr Embedding-Job in Vektoren für das Retrieval umwandelt

Dataddo liefert Datensätze, Metadaten und Textfelder, die bereit zum Einbetten sind. Es verarbeitet keine Rohdateien wie PDFs, Bilder oder Audio und erzeugt keine Embeddings - das übernimmt Ihr Embedding-Job.

HÄUFIGE FRAGEN

Chroma + Dataddo, beantwortet

Was kann ich in Chroma laden?

Jede der über 400 Quellen von Dataddo - Marketing- und Werbeplattformen, CRMs, Finanztools, Datenbanken und Dateien - plus benutzerdefinierte Quellen auf Anfrage. Die Daten werden verknüpft, bereinigt und PII-maskiert, bevor sie in Chroma landen.

Wie lädt Dataddo Daten in Chroma?

Dataddo schreibt Datensätze und Metadaten per geplantem Batch-Ladevorgang in dem von Ihnen gewählten Takt in Chroma und liefert die sauberen, aktuellen Daten, auf die sich Ihre Embedding- und Retrieval-Jobs stützen. Das Embedding-Modell selbst führt Dataddo nicht aus.

Was schreibt Dataddo in Chroma?

Dataddo hält die Datensätze in Ihren Chroma-Collections aktuell - die ID, den Dokumenttext und die Metadaten jedes Datensatzes aus Ihren verwalteten Quellen. Chroma kann die Dokumente mit seiner konfigurierten Embedding-Funktion einbetten; Dataddo liefert die Dokumente und Metadaten, nicht die Embeddings.

Kann Dataddo Chroma vom Prototyp bis zur Produktion versorgen?

Ja. Dataddo erzeugt keine Embeddings und hostet keine Modelle - es hält die verwalteten Quelldaten hinter Ihren Chroma-Collections frisch, validiert und PII-sicher, während Sie vom lokalen Prototyp zur Produktion skalieren.

Wie hält Dataddo Chroma frisch und governt?

Mit geplanten, inkrementellen Aktualisierungen aus über 400 Quellen sowie Datenqualitätsprüfungen und PII-Kontrollen, sodass die Dokumente und Metadaten hinter Ihren Collections ohne manuelle Pipelines aktuell bleiben.

Muss ich die Pipelines warten?

Nein. Dataddo ist vollständig verwaltet: Wir pflegen die Konnektoren, passen uns an Schemaänderungen der Quellen an und benachrichtigen Sie, wenn etwas Aufmerksamkeit braucht. Betreiben Sie es vollständig in der Cloud ohne eigenen Betrieb, oder hosten Sie die Data Plane selbst als schlanken Agenten - in beiden Fällen gibt es keinen Pipeline-Code, den Sie warten müssen.

Wie werden sensible Daten behandelt?

Dataddo ist SOC 2 Type II und ISO 27001 zertifiziert. Da sich ein Wert nach dem Einbetten nicht zurücknehmen lässt, kann PII maskiert oder gehasht werden, bevor sie Chroma überhaupt erreicht, und mit einer On-Premises-Data-Plane verlassen die Nutzdaten nie Ihr Netzwerk. EU- oder US-Datenresidenz ist verfügbar.

Wie halte ich Chroma aktuell?

Geplante Ladevorgänge aktualisieren Chroma mit Ihren neuesten Quelldaten im gewählten Takt, sodass Ihre RAG- und Suchergebnisse aktuelle Daten widerspiegeln - ohne manuelle Neuaufbauten.

Bin ich an einen Anbieter gebunden?

Nein. Die Daten landen in Ihrer eigenen Chroma-Instanz, und die Pipelines sind zielunabhängig - Sie können Vektorspeicher und andere Ziele hinzufügen oder wechseln, ohne Ihre Quellen neu aufzubauen.