Ein Unternehmen entwickelt eine KI, die automatisch Kundengespräche analysieren soll, um die wichtigsten Anliegen zu erkennen und Prioritäten für den Support zu setzen.
Die KI wird darauf trainiert, aus langen Gesprächsverläufen die relevantesten Informationen zu extrahieren.
Nach dem Einsatz fällt auf, dass die KI fast ausschließlich auf die letzten Aussagen im Gespräch reagiert und frühere wichtige Hinweise oft ignoriert.
Das Support-Team wundert sich: Warum konzentriert sich die KI so stark auf den Gesprächsabschluss und vernachlässigt die vorherigen, teils kritischen Informationen?
Frage: Warum neigt eine KI, die Gesprächsverläufe analysiert, dazu, hauptsächlich den letzten Teil der Konversation zu gewichten und frühere wichtige Inhalte zu übersehen?
Lösung folgt morgen.
Lösung
Viele KI-Modelle für Textanalysen, insbesondere solche mit Sequenzmodellen wie RNNs oder einfache Transformer-Architekturen, neigen dazu, Informationen am Ende einer Sequenz stärker zu gewichten.
Das liegt daran, dass spätere Tokens oft einen größeren Einfluss auf die finale Repräsentation haben, da frühere Informationen mit jeder weiteren Verarbeitungsschicht „verblassen“ oder überschrieben werden.
Ohne spezielle Mechanismen wie Attention-Modelle mit Langzeitgedächtnis oder kontextsensitive Gewichtungen verlieren wichtige frühere Gesprächsteile an Bedeutung.
Dadurch fokussiert die KI unbewusst vor allem auf den letzten Ausschnitt, der oft als besonders relevant angenommen wird, und übersieht kritische Hinweise aus dem Anfang oder Mittelteil.
Ergebnis: Eine KI, die Gespräche analysiert, muss so gestaltet sein, dass sie Kontext über die gesamte Länge berücksichtigt und nicht nur den Schluss fokussiert. Speziell trainierte Modelle und Architekturen mit effektiver Kontextintegration sind notwendig, damit auch frühere wichtige Informationen angemessen erkannt und gewichtet werden.