interactive ai agents for events
Ein Gesprächspartner.
Kein Chatfenster.
Aura51 setzt eine KI-Figur sichtbar auf Ihr Podium statt an den Rand: Sie hört die ganze Diskussion mit, nimmt Stellung und spricht, wenn die Moderation sie beim Namen ruft. Vier Charaktere — Sie entscheiden, wer Platz nimmt. Albert ist live erprobt; Vera, Tina und Ken sind Rollenentwürfe.
Scrollen
01Die Besetzung
Vier Haltungen. Ein System.
Alle laufen auf derselben Technik und können dasselbe. Was sie unterscheidet, ist Gesicht, Stimme und Haltung — und die legen Sie pro Veranstaltung fest. Albert ist live erprobt; Vera, Tina und Ken sind Rollenentwürfe.
02Was alle teilen
Dieselbe Technik, vier Figuren.
Die Technik ist bei allen vier Figuren dieselbe. Die Messwerte stammen aus den Tests mit Albert — er ist bisher die einzige Figur, die auf einer Bühne stand.
- Sie hören die ganze Diskussion mit.
- Sie sprechen, wenn die Moderation sie beim Namen ruft — und zwölf Sekunden danach auch auf ein blosses «Und warum?».
- Sie verstehen und sprechen Hochdeutsch und Englisch — keine Mundart.
- Sie lassen sich in unter einer halben Sekunde stoppen.
- Sie erfinden keine Zahlen und benennen ihr Nichtwissen.
Was Sie festlegen
- Den Namen — phonetisch eindeutig, kein Teilnehmername.
- Gesicht und Stimme.
- Die Haltung: widersprechend, prüfend, erklärend.
- Das Briefing: Thema, Teilnehmende, Rolle.
03Wo sie auftreten
Die Rolle, die auf Ihrem Podium fehlt.
Vier Anlässe, dieselbe Figur — was sich ändert, ist die Haltung, die Sie ihr geben.
Konferenz-Panel
Ein KI-Teilnehmer, der die Diskussion herausfordert — sichtbar auf der Leinwand, nicht als Chatfenster am Rand.
Kundenevent
Albert vertritt die Position des Produkts. Oder eben die des Kritikers — die Rolle wird pro Veranstaltung konfiguriert.
Interne Townhall
Der Advocatus Diaboli, den sich sonst niemand zu spielen traut.
Bildungs- und Hochschulformate
KI als sichtbarer Gesprächspartner auf dem Podium, nicht als Werkzeug hinter der Bühne.
04Auf der Bühne
Acht Dinge, die live gemessen sind.
Gemessen heisst: in den Live-Tests dieser Woche vorgekommen, mit Personen im Raum und natürlicher Sprache.
Zuhören
Albert kennt jede Aussage der letzten Minuten wörtlich und den Rest der Diskussion als fortlaufende Zusammenfassung.
gemessen · liveAuf Namensaufruf antworten
«Albert, wie siehst du das?» — er reagiert. Erwähnt ihn jemand nur («Albert hat vorhin gesagt …»), bleibt er still.
gemessen · liveIm Gespräch bleiben
Nach einer Antwort hört er zwölf Sekunden lang auf Nachfragen, auch ohne seinen Namen: «Und warum?» genügt. Ein «Danke» oder «Okay» beantwortet er nicht; wird jemand anderes aufgerufen, ist das Gespräch beendet.
gemessen · liveMit Bezug und Position
Er nennt Personen beim Namen, widerspricht, nimmt Stellung — so lang, wie die Frage es verlangt, nicht wie in einem Chat.
gemessen · liveDen Umfang selbst wählen
«Kurz», «in einem Satz» oder «ja oder nein» ergibt einen Satz; «erklär uns» oder «ein Beispiel» eine kurze Erklärung; alles andere zwei bis drei Sätze. Kein Knopf nötig, die Moderation hat die Hände frei.
gemessen · liveNatürlich einsteigen
Er beginnt mit einem neutralen «Also.», «Hm.» oder «Nun.» und formuliert die Antwort im Wissen um diesen Einstieg. Ein «Ja.» mit anschliessendem «Nein» kommt nicht mehr vor.
gemessen · liveZweigeteilte Aufrufe verstehen
«Ich frage jetzt Albert. Albert, was hältst du von …?» ergibt eine Antwort auf die ganze Frage. Redet die Moderation weiter, wartet er.
gemessen · liveSich stoppen lassen
Ein Tipp auf STOPP, und er verstummt in unter einer halben Sekunde.
gemessen · live
05Noch nicht auf einer Bühne
Drei, die wir noch nicht behaupten.
Sie sind gebaut und im Labor oder im Test geprüft — aber sie standen noch nicht vor einem Publikum. Deshalb stehen sie hier und nicht oben.
Auf Zwischenrufe reagieren
Ruft jemand in seine Antwort hinein, sagt er «Moment — den Gedanken führe ich noch kurz zu Ende» und setzt genau dort fort, wo er unterbrochen wurde.
gemessen · LaborPer Stimme stoppen
«Danke, Albert» beendet seine Antwort wie der STOPP-Knopf. Dasselbe «Danke, Albert» im normalen Gespräch ruft ihn nicht auf.
geprüft im Test · live noch nichtDie Teilnehmenden kennen
Namen von Moderation und Gästen werden vor dem Panel auf dem Tablet eingetragen; er spricht sie richtig an und erkennt sie im Transkript.
geprüft im Test · live noch nicht
06Die Brücke
Alles läuft über einen Punkt.
Jede Antwort erscheint als Text auf dem Tablet, bevor der Saal sie hört — rund 1,0 Sekunden vor dem Ton. Gestoppt wird gegen den Inhalt, nicht gegen eine Vermutung — und ohne Aufruf oder Knopfdruck sagt keine Figur etwas.
Antwortvorschau
Jede Antwort erscheint als Text auf dem Tablet, bevor der Saal sie hört — der Text läuft dem Ton etwa eine Sekunde voraus. Die Moderation kann gegen den Inhalt stoppen, nicht gegen eine Vermutung.
Stoppen, antworten, tippen
Abbrechen — auf dem Tablet oder mit «Danke, Albert» —, den letzten Satz einer Person als Frage geben, oder eine Frage tippen.
Kein autonomes Reden
Ohne Aufruf, Knopfdruck oder ein laufendes Gespräch sagt Albert nichts. Das Gespräch endet zwölf Sekunden nach seiner Antwort, spätestens wenn jemand anderes aufgerufen wird.
Live-Transkript
Mit Sprechernamen, Verbindungsampel und Latenzanzeige.
07Vermessen
Jede Zahl mit ihren Bedingungen.
- 1,8–1,9sbis zum ersten Tonmit Personen im Raum, Median der Live-Tests 5 und 6 · im Labor 1,5–1,9 s
- 334msbis er verstummtSTOPP auf dem Tablet · gemessen 334 und 374 ms
- 12sGespräch ohne Namensaufrufnach jeder Antwort · danach braucht es wieder seinen Namen
- 1,3sbis zum «Moment»-Satznach einem Zwischenruf · echte Stimme
08Der Signalweg
Vom Mikrofon bis zur Leinwand.
- 01
Vom Pult in den Laptop
Die Mikrofone des Podiums gehen vom Mischpult über einen Aux-Send in einen Laptop.
- 02
Mitschreiben
Ein Spracherkennungsdienst schreibt live mit, Sprecher inklusive (Deepgram Nova-3, Namen per Keyword-Boosting).
- 03
Erkennen und formulieren
Das «Brain» erkennt den Aufruf, prüft, ob Albert wirklich gemeint ist, und formuliert die Antwort — bereits während die Moderation noch ausspricht.
- 04
Sprechen
Ein fotorealistischer Avatar spricht die Antwort mit natürlicher deutscher Stimme auf der Leinwand.
09Die flache Linie
Was nicht geht.
Eine Figur, deren wichtigste Regel «erfinde nichts» lautet, fängt bei sich selbst an. Deshalb steht hier, was sie nicht kann — bevor Sie danach fragen müssen.
Was sie nicht tut — weil wir sie so gebaut haben
- Von sich aus reden — ohne Aufruf oder Knopfdruck sagt sie nichts.
- Zahlen oder Studien erfinden. Weiss sie etwas nicht, sagt sie das.
- Publikumsstimmen aufzeichnen.
Was sie nicht kann — weil die Technik es nicht hergibt
- Schneller als rund 1,6 Sekunden antworten — so lange brauchen Pausenerkennung und Sprachsynthese zusammen.
- Mundart. Hochdeutsch und Englisch versteht und spricht sie, Schweizerdeutsch nicht.
- Weiterreden, wenn niemand sie ruft: Zwölf Sekunden nach einer Antwort braucht es wieder ihren Namen.
- Ohne Internet arbeiten.
10Nachgefragt
Was Veranstalter zuerst wissen wollen.
Redet er einfach drauflos?
Nein. Nur auf Namensaufruf oder Knopfdruck — und in den zwölf Sekunden nach einer Antwort auf Nachfragen. Danach braucht es wieder seinen Namen.
Was, wenn er Unsinn sagt?
Die Moderation liest jede Antwort, bevor der Saal sie hört, und stoppt ihn auf dem Tablet in unter einer halben Sekunde. Der Stopp per «Danke, Albert» ist im Test geprüft, auf einer Bühne noch nicht.
Versteht er, wer spricht?
Ja — im Test geprüft, auf einer Bühne noch nicht. Die Moderation hat ein eigenes Mikrofon, die übrigen Sprecher werden vor dem Panel einmal zugeordnet.
Kann man ihn unterbrechen?
Ja — im Labor gemessen, auf einer Bühne noch nicht. Er reagiert darauf, bittet kurz um Geduld und führt den Gedanken zu Ende.
Wie schnell ist er?
Rund zwei Sekunden bis zum ersten Ton, auch mit Personen im Raum — ähnlich einem Menschen, der kurz nachdenkt.
Wie lang sind seine Antworten?
So lang, wie die Frage es verlangt. «Kurz» oder «ja oder nein» ergibt einen Satz, «erklär uns» eine kurze Erklärung, alles andere zwei bis drei Sätze. Niemand muss dafür einen Knopf drücken.
Welche Sprachen sprechen die Figuren?
Alle vier verstehen und sprechen Hochdeutsch und Englisch. Schweizerdeutsch nicht — weder verstehen noch sprechen.
Was passiert, wenn das Internet wegbricht?
Ohne Internet arbeitet keine der Figuren; das steht so unter «Was nicht geht». Für den Fall der Fälle gibt es einen geübten Satz der Moderation, und die Diskussion läuft ohne sie weiter.
11Ankunft
Wen setzen wir auf Ihr Podium?
Sie bringen Thema, Teilnehmende und die gewünschte Haltung. Wir bringen die Figur, eine Probeaufnahme für die Namenserkennung und eine Generalprobe.
- Mischpult mit einem Aux-Send für die Mikrofone (pre-fader, ohne den Avatar-Return) und ein Audio-Interface.
- Laptop (Mac) mit Internet — die drei Dienste laufen in der Cloud, das Transkript bleibt lokal.
- Leinwand oder Monitor für den Avatar, Lautsprecherweg zurück ins Pult.
- Tablet für die Moderation im eigenen Netz (Hotspot oder Kabel), nicht im Kongress-WLAN.
- Thema, Teilnehmende und Rolle als Briefing; eine kurze Probeaufnahme für die Namenserkennung; eine Generalprobe.
Aura51.ai · Beta, Stand 20. September 2026. Beta heisst hier nichts Vages: Die Figuren sind gebaut und in Live-Tests gemessen, standen aber noch nicht vor einem Publikum. Alle Messwerte aus Labor- und Live-Tests mit «Albert»; der Prüfstand steht bei jeder Aussage dabei.
Developed with love in Horgen, Switzerland