Tavus hat Griffin AI vorgestellt, ein Modell, das Videogespräche mit künstlicher Intelligenz stärker wie Gespräche mit einer anderen Person wirken lassen soll. Die Demonstrationen des Unternehmens zeigen einen Assistenten, der lacht, überrascht reagiert und andere unterbricht, anstatt einfach auf jede Frage zu warten.

Das Unternehmen beschreibt Griffin als ein Modell für menschliche Interaktion, kurz HIM. Nach eigenen Angaben glaubten 48 % der Teilnehmer an seinem Video-Turing-Test, mit einer echten Person zu sprechen.

Dieses Ergebnis stammt jedoch aus einer vom Unternehmen selbst veröffentlichten Untersuchung. Die vorliegende Ankündigung enthält nicht genügend methodische Details, um die Bedeutung des Ergebnisses unabhängig beurteilen zu können.

Gespräche gehen über Frage-und-Antwort-Austausch hinaus

Griffins Demonstrationen konzentrieren sich auf die kleinen Verhaltensweisen, die alltägliche Gespräche prägen.

Neben gesprochenen Antworten erzeugt das Modell Gesichtsausdrücke und Gesten, die auf den Gesprächsverlauf reagieren. So kann es beispielsweise lachen oder überrascht wirken, während es mit jemandem in einem Videoanruf interagiert.

Tavus demonstrierte außerdem, wie der Assistent einen Sprecher unterbricht und reagiert, wenn er selbst unterbrochen wird. Diese Interaktionen sollen das überlappende Sprechen und das wechselnde Tempo menschlicher Gespräche nachbilden.

Das Zeigen eines emotionalen Gesichtsausdrucks belegt jedoch nicht, dass ein Modell die entsprechende Emotion tatsächlich empfindet.

Gesten erhöhen den visuellen Realismus

Die Demonstrationen zeigen Griffin außerdem beim Winken, beim Berühren des eigenen Gesichts und dabei, wie es Haare hinter ein Ohr streicht.

Laut der Präsentation bleibt das Erscheinungsbild während dieser Bewegungen visuell konsistent. Das ist wichtig, da unnatürliche Handbewegungen oder verzerrte Gesichtszüge generierte Videos weniger überzeugend wirken lassen können.

Anstatt sich ausschließlich auf ein realistisches Gesicht zu verlassen, kombiniert Griffin Sprache, Bewegungen und Gesprächs-Timing. Zusammen erzeugen diese Elemente den Eindruck eines reaktionsfähigen Gesprächspartners in einem Videoanruf.

Ausgewählte Demonstrationen können jedoch nicht zeigen, wie zuverlässig das Modell über längere Gespräche oder in unbekannten Situationen hinweg funktioniert.

Tavus schlägt Nachhilfe und praktische Unterstützung vor

Neben lockeren Gesprächen zeigte Tavus, wie Griffin bei Aktivitäten wie dem Lösen eines Rubik’s Cube hilft und als Übungspartner fungiert.

Andere Beispiele zeigten, wie das Modell bei einem Projekt zeitliche Abläufe und Anweisungen befolgt. Das Unternehmen sieht daher mögliche Einsatzbereiche in der Nachhilfe, bei gemeinschaftlichen Aufgaben und bei kontinuierlicher Unterstützung durch Gespräche.

Diese Beispiele veranschaulichen die Rollen, die Tavus für die Technologie vorsieht. Sie belegen jedoch nicht deren Zuverlässigkeit bei jeder Bildungs- oder praktischen Aufgabe.

Derzeit ist Griffin-Lite als Forschungsvorschau für eine ausgewählte Gruppe von Testern verfügbar. Tavus plant unterdessen, künftig eine leistungsfähigere Version einem breiteren Nutzerkreis anzubieten.

Die vorliegende Ankündigung nennt keinen Termin für diese breitere Veröffentlichung.

Menschenähnliche Videos werfen Fragen zur Transparenz auf

Tavus beschreibt Griffin als die erste KI, die einen Video-Turing-Test bestanden hat. Das gemeldete Ergebnis von 48 % benötigt jedoch zusätzlichen Kontext zur Auswahl der Teilnehmer, zur Dauer der Gespräche und zu den Testbedingungen.

Ohne diese Details kann die Zahl allein nicht belegen, dass das Modell allgemein nicht von einem Menschen zu unterscheiden ist.

Die Demonstrationen lösten außerdem Bedenken hinsichtlich Identitätsmissbrauch und Transparenz aus. Einige Nutzer in sozialen Medien fragten, ob ähnliche Systeme bei Vorstellungsgesprächen aus der Ferne anstelle echter Bewerber auftreten könnten.

Andere erklärten, dass sie den Gesprächspartner weiterhin als künstlich erkennen konnten. Dennoch verdeutlichte die Diskussion ein praktisches Problem: Zuschauer benötigen möglicherweise einen klaren Hinweis, wenn ein realistisch wirkender Teilnehmer an einem Videogespräch KI-generiert ist.

Wenn Griffin AI über die begrenzte Testphase hinausgeht, wird sein Gesprächsrealismus nur ein Teil der Bewertung sein. Auch Konsistenz, Nutzen und Transparenz werden beeinflussen, wie Menschen auf die Technologie reagieren.


0 Kommentare zu „Griffin AI bringt Unterbrechungen und lebensechte Reaktionen in Videochats“