#17 Multimodale KI: Wenn der Chatbot auch Bilder und Tabellen liest

Impossible d'ajouter des articles

Désolé, nous ne sommes pas en mesure d'ajouter l'article car votre panier est déjà plein.

Veuillez réessayer plus tard

Échec de l’élimination de la liste d'envies.

Veuillez réessayer plus tard

Impossible de suivre le podcast

Impossible de ne plus suivre le podcast

#17 Multimodale KI: Wenn der Chatbot auch Bilder und Tabellen liest

Écouter gratuitement

Voir les détails

À propos de ce contenu audio

Firmen-Chatbots sollen auf Knopfdruck das gesamte Unternehmenswissen zugänglich machen. Doch die meisten sind blind für alles, was kein reiner Text ist: Prozessdiagramme, Bilder und Tabellen werden ignoriert. Die Folge: unvollständige oder nutzlose Antworten.
In dieser Folge sprechen wir mit Richard Zimmermann, der sich in seiner Bachelorarbeit genau dieser Herausforderung gestellt hat. Er erklärt, wie man mit dem Ansatz der "Retrieval-Augmented Generation" (RAG) einem Sprachmodell beibringt, auch multimodale Daten zu verstehen und zu nutzen.
Wir tauchen tief in die Technik ein und klären, warum es nicht nur darum geht, der KI Daten zu geben, sondern auch darum, ihr die richtigen Informationen in der richtigen Menge zu präsentieren, um das "Lost in the Middle"-Problem zu vermeiden.

Les membres Amazon Prime bénéficient automatiquement de 2 livres audio offerts chez Audible.

Vous êtes membre Amazon Prime ?

Bénéficiez automatiquement de 2 livres audio offerts.
Bonne écoute !

Aucun commentaire pour le moment

SÉLECTION

#17 Multimodale KI: Wenn der Chatbot auch Bilder und Tabellen liest

Impossible d'ajouter des articles

Échec de l’élimination de la liste d'envies.

Impossible de suivre le podcast

Impossible de ne plus suivre le podcast

#17 Multimodale KI: Wenn der Chatbot auch Bilder und Tabellen liest

À propos de ce contenu audio

Vous êtes membre Amazon Prime ?

Les Top 10

Prix littéraires

Écoutez en illimité