Premium
Dienstleistungen
Premium

Künstliche Intelligenz

Entdecken Sie praxisnahe Einblicke, Forschungsergebnisse und Benchmarks im Bereich der künstlichen Intelligenz, darunter generative KI, große Sprachmodelle, RAG, Governance-Frameworks, MLOps-Praktiken und KI-Hardware. Verschaffen Sie sich ein Verständnis für wichtige Werkzeuge, Implementierungsstrategien und Anwendungsfälle in Unternehmen, die KI-Landschaft prägen.

Künstliche Intelligenz erkunden

Bias in KI: Beispiele und 6 Wege zur Behebung

KI-Ethik
Benchmark
28. Sep

Das Interesse an KI nimmt zu, da Unternehmen ihre Vorteile in KI-Anwendungsfällen erleben. Es gibt jedoch berechtigte Bedenken hinsichtlich der KI-Technologie: Um festzustellen, ob durch das Fragenformat Verzerrungen entstehen könnten, haben wir dieselben Fragen sowohl in offenen als auch in Multiple-Choice-Formaten getestet. Über 64 Fragen hinweg stellt jede Frage zwei Kandidaten gegenüber, die bis auf…

Mehr lesen
KI-Produktivität
Benchmark
28. Sep

Vergleichen Sie die Top 6 der KI-Präsentations-Tools

Wir haben die Top-6-KI-Präsentations-Tools über 9 Dimensionen mit 4 verschiedenen Prompts bewertet, um ihre Kontext- und Prompt-Verständnis-Fähigkeiten, die visuelle KI-Integration sowie die Anpassungsfähigkeiten an Stimme und Markenstil zu beurteilen: Siehe die Methodik und die Bewertungskriterien, um zu verstehen, wie wir diese Ergebnisse berechnet haben. Die Punktzahlunterschiede zwischen Gamma, Google Slides mit Gemini, SketchBubble, Canva und…

Chatbots
Open-World-Bewertung
28. Sep

Banking-Chatbots: 8 Tools, 5 Anwendungsfälle & Praktiken

Branchen, in denen der Kundenservice oberste Priorität hat, sehen sich aufgrund der Nachfrage nach exzellentem Kundenservice steigenden Kosten gegenüber. Banking-Chatbots ermöglichen es Kunden, Transaktionen per Sprache oder Text abzuschließen, was Betriebskosten senkt und die Kundenzufriedenheit erhöht. Im Jahr 2026 verarbeitet die virtuelle Assistentin Erica von Bank of America täglich 2 Millionen Kundeninteraktionen und spart der…

Chatbots
Open-World-Bewertung
28. Sep

20 Chatbot-Unternehmen für den Einsatz

Bei über 200 Chatbot-Plattformen auf dem Markt ist die Wahl nicht offensichtlich. Der richtige Anbieter hängt von drei Dingen ab: Wie Ihr Team bauen möchte (Drag-and-Drop vs. Code), welche Systeme Sie verbinden müssen und wie viel Gesprächsvolumen Sie tatsächlich bewältigen. Wir haben die 20 am weitesten verbreiteten Chatbot-Plattformen für den Aufbau von Produktionsanwendungen verglichen. Tabelle…

GenAI-Anwendungen
Einblick
28. Sep

Generative KI und Urheberrecht: Recht & Rechtsstreitigkeiten

Wir haben Gerichtsentscheidungen, regulatorische Maßnahmen und Lizenzvereinbarungen geprüft, um drei zentrale Fragen zu generativer KI und Urheberrecht zu beantworten. Im August 2026 sah sich Anthropic weiterer Urheberrechtsklagen großer Musikverlage ausgesetzt. Sony Music Publishing und Warner Chappell reichten am 28. August Klage ein, nachdem Round Hill Music bereits im August aktiv geworden war.1 Im Januar 2026…

LLM
Benchmark
28. Sep

Benchmark von 40+ LLMs im Finanzwesen: Claude Fable 5 & GPT-5.6 Sol

Wir haben LLMs anhand von 238 schwierigen Fragen aus dem FinanceReasoning-Benchmark (Tang et al.) evaluiert.1 Diese Teilmenge zielt auf die anspruchsvollsten Aufgaben zum finanziellen Denken ab und bewertet komplexe, mehrstufige quantitative Schlussfolgerungen mit Finanzkonzepten und -formeln. Unsere Evaluierung verwendete ein eigenes Prompt-Design und Bewertungskriterien für Genauigkeit und Token-Verbrauch. Eine detaillierte Erklärung, wie diese Metriken berechnet…

Grundlagen der KI
Open-World-Bewertung
28. Sep

Top 5 KI-Leitplanken: Xnode Cortx & Weights and Biases

KI-Sicherheitsfehler sind teuer und treten immer häufiger auf. Viele Vorfälle sind auf eine schwache Governance zurückzuführen, insbesondere auf Lücken bei der Zugriffskontrolle, den Datenberechtigungen und der Überwachung der Model-Nutzung. KI-Leitplanken reduzieren dieses Risiko, indem sie durchsetzbare Grenzen dafür festlegen, wie KI-Systeme auf Daten zugreifen, Ausgaben generieren und mit Nutzern oder Geschäftsabläufen interagieren. Erfahren Sie, wie…

Embeddings
Benchmark
27. Sep

Open-Source-Embedding-Models-Benchmark für RAG

NVIDIA Llama-Embed-Nemotron-8B führt bei der Genauigkeit. Bei den Kosten läuft Googles EmbeddingGemma-300m etwa 4x günstiger als Nemotron, bei einem kleinen Verlust an Genauigkeit. nDCG@3: Normalisierter diskontierter kumulativer Gewinn bei Cutoff 3. Bei einem relevanten Dokument pro Anfrage beträgt er 1 / log2(Rang + 1), wenn das Gold-Dokument in den Top 3 landet, andernfalls 0. Rang…

Embeddings
Benchmark
27. Sep

Embedding-Models: OpenAI vs. Gemini vs. Voyage

Wir benchmarkten 15 englische Text-Embedding-Models und eine BM25-Baseline an über 500 manuell kuratierten Queries über drei Retrieval-Domänen: Rechtsverträge (CUAD), Kundensupport (IBM TechQA) und Gesundheitswesen (MedRAG PubMed). Voyage-3.5 belegt insgesamt den ersten Platz. Perplexity Embed V1 0.6b erreicht die obere Mittelklasse zum niedrigsten Preispunkt in unserem Benchmark. nDCG@3: Normalisierter diskontierter kumulativer Gewinn bei Cutoff 3. Mit…

Grundlagen der KI
Benchmark
25. Sep

Top 20 KI-Textdetektoren im Vergleich

Wir haben einen Benchmark der 10 am häufigsten verwendeten KI-Textdetektoren durchgeführt. Hier eine kurze Zusammenfassung unserer Ergebnisse: Entdecken Sie den detaillierten Funktions- und Preisvergleich der Top 20 KI-Content-Detektoren, zusammen mit Benchmark-Ergebnissen und den KI-Erkennungsmodellen, die diese Tools antreiben: Details zum Benchmark finden Sie unter Methodik des Benchmarks für KI-Textdetektor-Tools. Unten finden Sie eine einfache Aufschlüsselung…

RAG
Benchmark
25. Sep

Agentic RAG-Benchmark: Routing über 11 SQL-Datenbanken

Routing-Genauigkeit ist der Prozentsatz der bewerteten Fragen, bei denen das Modell in seiner endgültigen Antwort explizit die richtige Datenbank nennt. Die Hauptkennzahl verwendet die 184 Fragen, die sowohl von unserem Ähnlichkeitstest als auch von einer Jury aus drei LLMs als schwierig markiert wurden. Fehlende explizite Deklarationen werden nicht gewertet. Qwen3.8-max beantwortete 153 von 184 schweren…