Dienstleistungen
Kontaktieren

Künstliche Intelligenz

Entdecken Sie praxisnahe Einblicke, Forschungsergebnisse und Benchmarks im Bereich der künstlichen Intelligenz, darunter generative KI, große Sprachmodelle, RAG, Governance-Frameworks, MLOps-Praktiken und KI-Hardware. Verschaffen Sie sich ein Verständnis für wichtige Werkzeuge, Implementierungsstrategien und Anwendungsfälle in Unternehmen, die KI-Landschaft prägen.

Künstliche Intelligenz erkunden

Time Series Classification Benchmark: Foundation Models vs Classical Methods

KI-Modelle
7. Aug

We benchmarked 13 time series classification methods, from pretrained time series foundation models to a 22-feature baseline from 2019, on 33 UCR/UEA datasets under one frozen protocol. That is 14,638 recorded method-dataset-resample cells, 11,874 of them scored. The chart shows the benchmark’s main comparison: 12 methods on the 15 univariate datasets where every one of…

Mehr lesen
KI-Ethik
Einblick
6. Aug

Bias in der KI: Beispiele und 6 Wege, ihn zu beheben

Das Interesse an KI nimmt zu, da Unternehmen ihre Vorteile in KI-Anwendungsfällen erkennen. Es gibt jedoch berechtigte Bedenken hinsichtlich der KI-Technologie: Um zu sehen, ob es Verzerrungen geben würde, die sich aus dem Frageformat ergeben könnten, haben wir dieselben Fragen sowohl in offenen als auch in Multiple-Choice-Formaten getestet. Wir stellten fest, dass die Modelle bei…

KI-Modelle
Open-World-Bewertung
6. Aug

Beste Pauschalpreis-LLM API Anbieter

Pauschalpreis-LLM-Anbieter verkaufen unbegrenzte Modellnutzung zu einem festen Monatspreis statt pro Token abzurechnen. Dieses Modell verbreitete sich, weil agentische Kodierungssitzungen zig Millionen Token verbrauchen können, sodass eine tokenbasierte Rechnung schwer vorhersehbar ist. Nur sehr wenige Anbieter bieten eine echte Pauschalgebühr; die meisten als Pauschal vermarkteten Pläne enthalten eine Nutzungsquote. Im Folgenden vergleichen wir die Anbieter, die…

LLM
Benchmark
6. Aug

LLM-Latenz-Benchmark nach Anwendungsfällen

Wir haben 11 führende große Sprachmodelle mit insgesamt 1.320 Anfragen einem Benchmark unterzogen, wobei wir zwischen Reasoning- und Nicht-Reasoning-Modellen unterschieden und die Time to First Token, die Latenz pro Token sowie die gesamte Antwortzeit gemessen haben. Details zur Messung der Latenz finden Sie hier. Wir berichten über Reasoning- und Nicht-Reasoning-Modelle getrennt. Reasoning-Modelle verbringen mehrere Sekunden…

KI-Governance
Open-World-Bewertung
6. Aug

Top 12 KI Control Plane Tools for Regulated Deployments

An KI control plane provides a shared layer for operating KI agents and agent-based applications. We compared the top 12 KI control plane tools for enterprise architects, security teams, and KI governance owners planning KI adoption at enterprise scale. Read the methodology to see how we scored these products. Vendor selection criteria: We included vendors…

KI im Gesundheitswesen
Einblick
6. Aug

25 Anwendungsfälle von KI im Gesundheitswesen mit Beispielen

Eine aktuelle Studie zeigt, dass hybride Teams aus menschlichen Ärzten und KI-Systemen genauere medizinische Diagnosen stellen, vor allem weil sie unterschiedliche, sich ergänzende Fehler machen und so einander korrigieren können. Diese Ergebnisse deuten auf ein starkes Potenzial von KI zur Verbesserung der Patientensicherheit und zur Förderung einer gerechteren Gesundheitsversorgung hin.1 Diese Studie vergleicht zwei spezialisierte…

GenAI-Anwendungen
Einblick
6. Aug

Top 125 Generative KI-Anwendungen

Basierend auf unserer Analyse von 30+ Fallstudien und 10 Benchmarks, bei denen wir über 40 Produkte getestet und verglichen haben, haben wir 125 generative KI-Anwendungsfälle in den folgenden Kategorien identifiziert: Für andere Anwendungen von KI für Anfragen, bei denen es eine einzige richtige Antwort gibt (z. B. Vorhersage oder Klassifizierung), lesen Sie KI-Anwendungen. Sie können…

Grundlagen der KI
Einblick
6. Aug

Vergleich der KI-Einnahmen über den gesamten Stack hinweg

Der KI-Markt ist in allen vier Schichten (Daten, Rechenleistung, Modelle und Anwendungen) rasant gewachsen. Beispielsweise stieg der Rechenzentrumsumsatz von NVIDIA von $47.5B auf $115.2B in einem einzigen Jahr; OpenAI erreichte einen Jahresumsatz von etwa $13B; und Anthropic näherte sich $7B an jährlich wiederkehrenden Umsätzen (ARR). Wir haben Umsatzdaten von über 100 KI-Unternehmen verfolgt. Erfahren Sie,…

LLM
Open-World-Bewertung
6. Aug

LLM-Orchestrierung: 22 Frameworks und Gateways

Die Optimierung der LLM-Orchestrierung ist entscheidend, um die Leistung zu verbessern und gleichzeitig den Ressourcenverbrauch zu kontrollieren. Um zu bewerten, wie unterschiedliche Orchestrierungsansätze in der Praxis abschneiden, haben wir folgende Benchmarks durchgeführt: Entdecken Sie ausgewählte LLM-Orchestrierungs-Tools, einschließlich Entwickler-Frameworks und Enterprise-Gateways: Die LLM-Orchestrierung umfasst die Verwaltung und Integration mehrerer Large Language Models (LLMs), um komplexe Aufgaben…

LLM
Benchmark
4. Aug

HALC-Bench: LLM Halluzination bei Langkontext-Retrieval-Benchmark

HALC-Bench (LLM Halluzination bei Langkontext-Retrieval-Benchmark) misst die Beständigkeit eines großen Sprachmodells gegenüber der Erfindung von Belegen für eine Metrik, die im Zieldokument nicht existiert, indem 3 Heuhaufen am Anfang, in der Mitte und am Ende des Kontextfensters des Modells platziert werden, mit 204 Fragen. claude-fable-5 beantwortete alle 204 Fallen an jeder Heuhaufenposition korrekt. Unter den…

Dokumentenautomatisierung
Benchmark
4. Aug

Rechnungs OCR Benchmark: Extraktionsgenauigkeit von LLMs vs OCRs

Die Rechnungsverarbeitung ist ein kritischer, aber arbeitsintensiver Geschäftsprozess, der traditionell eine manuelle Datenextraktion und -eingabe in Buchhaltungssysteme erfordert. Dieser manuelle Ansatz ist zeitaufwendig und anfällig für menschliche Fehler. Um automatisierte Alternativen zu bewerten, haben wir eine vergleichende Analyse führender Lösungen zur Dokumentenverarbeitung und LLMs durchgeführt: Unsere Studie bewertete die Fähigkeiten dieser Tools, Daten aus verschiedenen…