#Data.
Diese Ansicht zeigt nur Tools, deren Metadaten den Tag tragen. Sie ist ein Arbeitsfilter, kein eigenes Ranking.
Airbyte
Airbyte bewegt Geschäftsdaten wiederholbar zwischen Quellen und Zielen. Entscheidend sind Schema-Kontrolle, Ownership und ein sicherer Umgang mit Agentenzugriffen.
Apify
Apify betreibt wiederholbare Webdaten- und Browserabläufe als Actors. Der Nutzen entsteht durch prüfbare Datensätze, Wartung und klare Nutzungsrechte.
Apache Hadoop (selbst gehostet)
Kurzbeschreibung folgt.
Apache Hive
Apache Hive bringt SQL auf verteilte Daten: ein praxisnaher Überblick zu HiveQL, Metastore, Batch-ETL, Partitionen, ORC, Betriebskosten und den Grenzen gegenüber Echtzeit- und OLTP-Systemen.
Cohere
Cohere kombiniert Unternehmensmodelle, Embeddings und Reranking für beleggebundene Suche und kontrollierte KI-Workflows.
Google What-If Tool
Google What-If Tool ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Airtable
Airtable ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
AllenNLP
AllenNLP ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Amazon Comprehend
Amazon Comprehend ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Amazon DynamoDB
Amazon DynamoDB ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Amazon EMR
Verwaltete AWS-Plattform für Spark-, Hadoop- und andere große Datenjobs mit EC2-Clustern, Serverless oder EKS.
Amazon Kinesis Data Analytics
Managed Service für Apache Flink verarbeitet Streaming-Daten fortlaufend, ist aber kein günstiger Ersatz für jede Batch- oder SQL-Analytics-Pipeline.
Amazon MSK
Amazon MSK betreibt Apache-Kafka-Infrastruktur als AWS-Dienst, während Topics, Schemas, Consumer und Datenverträge beim Anwendungsteam bleiben.
Amazon OpenSearch
Verwalteter AWS-Dienst für Volltextsuche, Log- und Sicherheitsanalysen, Observability sowie Vektor- und Hybrid-Retrieval.
Amazon Web Services (AWS) AI
AWS AI bündelt Bedrock, SageMaker AI und spezialisierte Dienste für kontrollierte generative KI- und ML-Workflows in AWS.
Apache Airflow
Kurzbeschreibung folgt.
Apache Beam
Apache Beam bietet ein gemeinsames Programmiermodell für Batch- und Streaming-Pipelines, die auf unterschiedlichen Runnern ausgeführt werden können.
Apache Cassandra
Apache Cassandra ist eine verteilte Open-Source-Datenbank für hochverfügbare, schreibintensive Workloads mit planbaren Zugriffsmustern über viele Knoten oder Regionen.
Apache Drill
Apache Drill ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Apache Druid
Open-Source-Analysedatenbank für schnelle OLAP-Abfragen auf zeitbezogenen Batch- und Streaming-Daten.
Apache HBase
Verteiltes Open-Source-Datenspeicher-System für sehr große Tabellen mit vorhersehbaren Reads und Writes per Row Key.
Apache Impala
Open-Source-SQL-Engine für interaktive Analysen auf Hadoop-nahen Datenplattformen mit verteilten Abfragen und kontrollierbarem Clusterbetrieb.
Apache Kafka
Open-Source-Plattform für Event-Streaming: Apache Kafka verbindet Produzenten, Consumer und Datenpipelines über dauerhaft gespeicherte Topics.
Apache NiFi
Apache NiFi ist ein Daten- und Automatisierungswerkzeug für visuelle Datenfluss-Automatisierung für Ingestion, Routing, Transformation und Systemintegration.
Apache Pinot
Apache Pinot ist eine verteilte Open-Source-OLAP-Datenbank für schnelle Abfragen auf frischen Streaming- und Batch-Daten, nicht für beliebige Transaktionen.
Apache Pulsar
Apache Pulsar ist eine Open-Source-Plattform für Messaging und Event-Streaming mit Tenants, langlebiger Speicherung und optionaler Replikation zwischen Clustern.
Apache Solr
Apache Solr ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Apache Spark SQL
SQL- und DataFrame-Schnittstelle für verteilte Verarbeitung strukturierter Daten, Batch-Pipelines und ausgewählte Streaming-Szenarien mit Apache Spark.
Apache Spark Structured Streaming
Praxisleitfaden für Spark Structured Streaming: DataFrames, Micro-Batches, Watermarks, Checkpoints, Sinks, Kosten und Betriebsgrenzen.
Atlas.ti
Atlas.ti organisiert qualitative Daten, Codes, Memos und Beziehungen für nachvollziehbare Forschung mit menschlicher Interpretation.
AWS Inferentia
AWS Inferentia beschleunigt produktive Machine-Learning-Inferenz über Inf1/Inf2 und AWS Neuron. Diese redaktionelle Einordnung erklärt Modellfit, Kompilierung, Kosten, Betrieb und Alternativen.
AWS Kinesis
AWS Kinesis ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
AWS SageMaker
Verwaltete AWS-Plattform für Datenaufbereitung, ML-Training, Modellversionen und kontrollierte Inferenz mit eigener Betriebsverantwortung.
Azure Machine Learning
Kurzbeschreibung folgt.
Azure Stream Analytics
Azure Stream Analytics ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Bubble
Kurzbeschreibung folgt.
C3.ai
C3.ai unterstützt Unternehmen beim Aufbau daten- und modellgestützter Anwendungen, deren Nutzen von Datenqualität und klaren Betriebsprozessen abhängt.
Clarivate Analytics (Web of Science)
Web of Science bündelt kuratierte Literatur-, Zitations- und Forschungsdaten für nachvollziehbare Recherche und bibliometrische Analysen.
ClickHouse Cloud
ClickHouse Cloud ist ein verwalteter Dienst für schnelle SQL-Analysen großer und laufend eintreffender Datenmengen, nicht für beliebige Transaktionsanwendungen.
Cloudera Data Platform
Cloudera Data Platform ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
CockroachDB
Verteilte SQL-Datenbank für transaktionale Anwendungen, die über mehrere Regionen verfügbar bleiben sollen und dafür bewusstes Daten-, Kosten- und Betriebsdesign benötigen.
Databox MCP
Databox MCP ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Databricks
Databricks verbindet Lakehouse, Datenengineering, SQL-Analytik und Machine Learning auf Cloud-Speicher; Wert und Aufwand hängen stark von Governance und Compute-Steuerung ab.
DataCamp
DataCamp vermittelt Datenanalyse, Python, SQL, R und KI über browserbasierte Übungen, Projekte und Lernpfade; die Plattform ersetzt jedoch keine produktive Datenumgebung.
Datadog
SaaS-Plattform für Infrastruktur-, APM-, Log-, Trace- und Security-Observability mit nutzungsabhängiger Abrechnung und hohem Governance-Bedarf.
DataRobot
Enterprise-Plattform für Predictive und Generative AI, die Modellierung mit Deployment, Monitoring und Governance für produktive Teams verbindet.
Dedoose
Dedoose unterstützt qualitative und Mixed-Methods-Forschung mit Codierung, Analyse, Teamarbeit und Datenvisualisierung.
DeepBrain
DeepBrain ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
DeepMind
Kurzbeschreibung folgt.
Dell Boomi
Dell Boomi ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Domo
Kurzbeschreibung folgt.
Dremio
Dremio ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Elasticsearch
Verteilte Such- und Analyseplattform für Volltext, strukturierte Daten, Logs und hybride Retrieval-Workloads – mit eigenem, gehostetem oder serverlosem Betrieb.
Elicit
Elicit unterstützt Literaturrecherche, Paper-Sichtung und strukturierte Evidenzarbeit für Forschung und Analyse.
Espresso
Espresso ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Glia
Glia ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Glide
Kurzbeschreibung folgt.
Google AI
Google AI ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Google Cloud Firestore
Dokumentenorientierte NoSQL-Datenbank für Web-, Mobil- und Server-Apps mit Echtzeit-Listenern, Offline-Unterstützung und klaren Grenzen bei Abfragen und Kostenkontrolle.
Google Cloud Pub/Sub
Google Cloud Pub/Sub ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Google Cloud Spanner
Verteilte relationale Cloud-Datenbank für transaktionale Systeme mit globaler Verfügbarkeit, klarer Datenplatzierung und bewusstem Kosten- und Betriebsdesign.
Google Colab
Google Colab ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Google Tabellen
Google Tabellen ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Graphcore IPU
Spezialisierter Beschleuniger fuer Machine-Learning-Training und Inferenz mit IPU-Hardware, Poplar SDK und Profiling-Werkzeugen.
H2O AutoML
H2O AutoML ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
IBM Watson Studio
IBM Watson Studio bündelt Daten-, Notebook- und Modellarbeit für Teams, die Experimente reproduzierbar in kontrollierte Abläufe überführen wollen.
Jan
Jan ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Jovian
Praxisorientierte Lernplattform für Python, Datenanalyse, Machine Learning und Jupyter-Workflows.
Kaggle Learn
Kaggle Learn ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
KAI
Kurzbeschreibung folgt.
Kaiber
Kaiber ist ein Video- und Produktionswerkzeug für KI-Video und kreative Motion-Ästhetik für Musik, Social Clips und visuelle Experimente.
Kive
Kive ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
LIME (Local Interpretable Model-agnostic Explanations)
LIME (Local Interpretable Model-agnostic Explanations) ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Litmaps
Litmaps ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Looker
Looker verbindet ein semantisches Datenmodell mit Analysen und Dashboards, damit Teams Kennzahlen kontrolliert und gemeinsam verwenden können.
Looker Studio
Kostenloses Google-Tool für Dashboards, Datenvisualisierung und wiederkehrende Reports.
MAXQDA
MAXQDA ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Microsoft Azure Data Factory
Microsoft Azure Data Factory ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Microsoft Azure Event Hubs
Microsoft Azure Event Hubs ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Microsoft Azure HDInsight
Microsoft Azure HDInsight ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Mistral
Mistral ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
MLJAR
MLJAR ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Modal
Modal ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Mode Analytics
Mode Analytics ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
MongoDB
MongoDB ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Nuance
Nuance ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
NVIDIA DGX Systeme
NVIDIA DGX Systeme ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
NVivo
NVivo ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
OpenAI GPT API
OpenAI GPT API ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Paddle
Paddle ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Paperspace Gradient
Paperspace Gradient ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
PyTorch
PyTorch ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
QDA Miner
Kurzbeschreibung folgt.
Qlik
Qlik ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Qlik Sense
Qlik Sense ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Redash
Redash ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Redpanda
Redpanda ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Research Rabbit
Research Rabbit hilft, wissenschaftliche Literatur über Paper-Netzwerke, Autorenbeziehungen und thematische Sammlungen zu erkunden.
Rev
Rev ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
RunPod
RunPod ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Samza
Samza ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
SAP Analytics Cloud
SAP Analytics Cloud ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
SAS
SAS deckt Datenaufbereitung, Statistik, Modelle und Governance für analytische Prozesse mit hohen Anforderungen an Nachvollziehbarkeit ab.
Scikit-learn
Scikit-learn ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Semantic Scholar
Semantic Scholar ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
SHAP (SHapley Additive exPlanations)
SHAP (SHapley Additive exPlanations) ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Sift
Sift ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Singularity
Singularity ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Skyvern
Skyvern ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Smartsheet
Smartsheet ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Snowflake Snowpipe
Snowflake Snowpipe ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
spaCy
spaCy ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Sphinx
Sphinx ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Splunk Observability
Splunk Observability ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
StreamSets
StreamSets ist eine Data-Integration-Plattform für Datenpipelines, Streaming, ETL/ELT und operative Datenflüsse.
Taguette
Taguette ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Talend Data Fabric
Talend Data Fabric ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
TensorFlow
TensorFlow ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Teradata Vantage
Teradata Vantage ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Trino
Trino führt verteilte SQL-Abfragen über unterschiedliche Datenquellen aus, wenn Kataloge, Rechte und Ressourcen bewusst kontrolliert werden.
Udacity
Udacity ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
UiPath
UiPath ist eine Enterprise-Plattform für Robotic Process Automation, Prozessautomatisierung und KI-gestützte Business-Workflows.
Veed
Veed ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Visier
Visier ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Xero
Xero ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.
Zeplin
Zeplin ist ein Werkzeug für den beschriebenen Arbeitsablauf. Prüfe vor dem Einsatz Daten, Zuständigkeiten, Kosten und die offiziellen Produktangaben.