Referenzen

HealthTech · Events und Dialog-KI

Ein Avatar für die Besucherfragen, mit denen kein Infostand mitkommt

Auf der XPOMET Medicinale 2024 in Leipzig haben wir Paula eingesetzt, einen sprachgesteuerten KI-Avatar, der Besucherfragen, Wegbeschreibungen und Ausstellerempfehlungen in Echtzeit beantwortete. Entstanden mit der Johannesstift Diakonie, übernahm Paula, wofür sonst eigenes Infopersonal nötig wäre, in einer lauten, stark besuchten Konferenzumgebung.

Ergebnisse

2 Sprachen
Englisch und Deutsch automatisch erkannt, Wechsel mitten im Gespräch
Live
Sprachdialog in Echtzeit in einer lauten Konferenzhalle
Lokal
Wake-Word-Erkennung auf dem Gerät, nichts geht in die Cloud
Web + DB
Live-Websuche neben der Veranstaltungsdatenbank

Kunde: Johannesstift Diakonie
Johannesstift Diakonie Services GmbH, auf der XPOMET Medicinale 2024 in Leipzig, einer der führenden europäischen Konferenzen für Healthcare-Innovation.

Johannesstift Diakonie
Branche
HealthTech und Events
Anwendungsfall
KI-Avatar für die Besucherbetreuung
KI-Ansatz
LLM mit Sprache und Function Calling
Sprachen
Englisch und Deutsch, automatisch erkannt
Umgebung
Live-Konferenz, hoher Geräuschpegel
Partner
Johannesstift Diakonie

Kurz gefasst

Was ein Infostand in der Stoßzeit nicht leisten kann

  • Die XPOMET Medicinale bringt Dutzende Aussteller, ein dichtes Vortragsprogramm und ein internationales Publikum in eine volle, laute Halle.
  • Einen Stand finden, eine Sessionzeit prüfen, nach einem Unternehmen fragen: Das bedeutet klassisch einen besetzten Infostand, teuer, schwankend in der Qualität und überfordert, wenn alle gleichzeitig kommen.
  • Paula nimmt die Frage gesprochen entgegen, auf Englisch oder Deutsch, und antwortet aus der kompletten Veranstaltungsdatenbank mit Ausstellern, Programm und Standorten.
  • Sie startet auf „Hallo Paula“, die Wake-Word-Erkennung läuft auf dem Gerät, sie zeigt passende Ausstellerlogos auf dem Bildschirm und sucht im Web für alles außerhalb des Programms.

Die Ausgangslage

Die Aufgabe

Einen interaktiven Assistenten bauen, der Besucherfragen in Echtzeit und in mehreren Sprachen auf einer Live-Konferenz beantwortet und damit die manuelle Besetzung des Infostands überflüssig macht.

Die XPOMET Medicinale ist eine große Konferenz für Healthcare-Innovation mit Dutzenden Ausstellern, einem dichten Vortragsprogramm und einem vielfältigen internationalen Publikum. Die Teilnehmenden müssen Stände finden, Zeitpläne prüfen und sich über Unternehmen und Sessions informieren, und das in einem lauten, vollen Raum.

Klassisch braucht es dafür Personal an Infoständen, das Programm, Aussteller und Hallenplan kennt. Diese Besetzung ist teuer, schwankend in der Qualität und skaliert nicht für Stoßzeiten, wenn alle gleichzeitig kommen oder sich Sessions ändern.

Die Aufgabe war, das durch etwas zu ersetzen, das man einfach ansprechen kann.

Der Bau

Was wir gebaut haben

Wir haben Paula gebaut und eingesetzt, einen sprachgesteuerten KI-Avatar in der Pauls Health Area. Kein Chatbot auf einem Bildschirm, sondern ein System, das ein echtes gesprochenes Gespräch führt.

01

Sie erkennt, welche Sprache gesprochen wird

Paula erkennt, ob jemand Englisch oder Deutsch spricht, und antwortet in dieser Sprache, ohne dass jemand eine Sprache auswählen muss. Wechselt ein Besucher mitten im Gespräch die Sprache, zieht sie mit.

02

Aktivierung auf dem Gerät

Ein Gespräch beginnt mit „Hallo Paula“. Das Wake-Word-Modell läuft lokal auf dem Gerät, für die Aktivierung geht also kein Ton in die Cloud. Paula merkt auch, wann ein Gespräch zu Ende ist, und schaltet sich selbst ab.

03

Die Veranstaltungsdatenbank, erreichbar per Frage

Paula hat Zugriff auf die komplette Veranstaltungsdatenbank: Ausstellerdetails, Konferenzprogramm, Sessionzeiten und Standorte. Über LLM-Function-Calling beantwortet sie konkrete Fragen wie „Welche Unternehmen präsentieren zur digitalen Pathologie?“ und empfiehlt Sessions nach den Interessen, die ein Besucher nennt.

04

Der Bildschirm folgt dem Gespräch

Während sie spricht, erkennt Paula, was der Besucher will, und zeigt die passenden Ausstellerlogos und Details auf dem Bildschirm. So wird aus einem Sprachdialog eine Orientierung, und genau die braucht jemand, der in einer Halle steht.

05

Live-Websuche für alles andere

Über die Veranstaltung hinaus beantwortet Paula allgemeine Fragen per Live-Websuche, vom Wetter vor Ort bis zu Sachfragen, und ist damit auch jenseits der Konferenzlogistik nützlich.

Ein Avatar für die Besucherfragen, mit denen kein Infostand mitkommt

Was sich geändert hat

Das Ergebnis

Vorher

Besucherbetreuung durch Personal am Infostand. Wenig Kapazität in Stoßzeiten, jeweils nur eine Sprache und keine persönlichen Empfehlungen.

Nachher

Ein Avatar, der Besucherfragen in zwei Sprachen ohne Warteschlange beantwortet, persönliche Ausstellerempfehlungen gibt, auf dem Bildschirm den Weg zeigt und nicht von der Personaldecke abhängt.

Paula betreute die Besucher während der ganzen Veranstaltung und gab gleichbleibend genaue Auskunft, egal wie voll es war. Niemand stand an oder suchte im gedruckten Programm.

Die Mehrsprachigkeit kam beim internationalen Publikum besonders gut an, und genau das kann ein einsprachiger Infostand nicht abdecken.

Für Aussteller wurde sie zu einem zusätzlichen Weg, gefunden zu werden: Sie schickte Besucher gezielt zu passenden Ständen und Sessions, je nachdem, wonach sie gefragt hatten.

Der Einsatz zeigte auch, dass ein Gesprächsavatar unter echten Bedingungen hält statt nur im stillen Demo-Raum: Lärm, Gedränge und unvorhersehbares Verhalten.

Fragen zu diesem Projekt

KI-Avatar für die Besucherbetreuung. Einen interaktiven Assistenten bauen, der Besucherfragen in Echtzeit und in mehreren Sprachen auf einer Live-Konferenz beantwortet und damit die manuelle Besetzung des Infostands überflüssig macht.

Englisch und Deutsch automatisch erkannt, Wechsel mitten im Gespräch: 2 Sprachen. Sprachdialog in Echtzeit in einer lauten Konferenzhalle: Live. Wake-Word-Erkennung auf dem Gerät, nichts geht in die Cloud: Lokal. Live-Websuche neben der Veranstaltungsdatenbank: Web + DB.

LLM mit Sprache und Function Calling. Eingesetzte Technik: Large Language Models, Speech-to-Text, Text-to-Speech, Function Calling, Lokale Wake-Word-Erkennung, Automatische Erkennung der Sprache, Echtzeit-Websuche, KI-Avatar.

Eingesetzte Technik

Large Language Models Speech-to-Text Text-to-Speech Function Calling Lokale Wake-Word-Erkennung Automatische Erkennung der Sprache Echtzeit-Websuche KI-Avatar

Sprechen Sie mit dem Team dahinter

theBlue.ai meldet sich innerhalb eines Werktags.

Kontakt aufnehmen