Hilfecenter

Echtzeit-Sprache

Echtzeit-Stimme

Was ist Echtzeit-Stimme?

Echtzeit-Stimme ist der sprachorientierte KI-Assistent von Genspark, mit dem Sie direkt und in natürlicher Sprache mit Super Agent sprechen. Dank bidirektionalem Echtzeit-Audio ermöglicht er freihändige Interaktion für Recherche, Content-Erstellung, Aufgabenübergabe und mehr — alles im Gespräch.

  • Sprechen statt tippen — Sprechen Sie natürlich mit Super Agent und hören Sie sofortige Sprachantworten, wie bei einem Telefonat
  • Multitasking per Stimme — Fordern Sie komplexe Aufgaben (Folien, Dokumente, Bilder, Deep Research) an, während Sie das Gespräch fortsetzen — Aufgaben laufen im Hintergrund, ohne Ihren Ablauf zu unterbrechen
  • Aufgabenverfolgung — Sehen und verwalten Sie alle Hintergrundaufgaben in einem eigenen Panel mit Echtzeit-Fortschritt und Ein-Tap-Zugriff auf Ergebnisse
  • Nahtloser Moduswechsel — Wechseln Sie jederzeit während einer Sitzung zwischen Sprache und Texteingabe

Schnellstart

So starten Sie in drei einfachen Schritten:

  1. Super Agent-Sitzung starten

    Öffnen Sie die Genspark-Startseite und starten Sie eine neue Super Agent-Sitzung. Im Chat-Eingabefeld sehen Sie rechts eine Sprachtaste (schwarzes Kreissymbol) — klicken Sie darauf, um in den Modus Echtzeit-Stimme zu wechseln.

  2. Mikrofonzugriff erlauben

    Erlauben Sie den Mikrofonzugriff im Browser, wenn Sie dazu aufgefordert werden. Die Verbindung wird automatisch hergestellt.

  3. Sprechen Sie los

    Sprechen Sie Ihre Anfrage natürlich aus. Die KI antwortet in Echtzeit mit Sprache und Text. Sie können jederzeit über die Tastaturtaste zur Texteingabe wechseln.

Funktionsübersicht

Hintergrundaufgaben

Eine der leistungsstärksten Funktionen von Echtzeit-Stimme ist, Hintergrundaufgaben zu starten, während Sie Ihr Gespräch fortsetzen. Beschreiben Sie einfach, was Sie brauchen — Super Agent delegiert die Arbeit automatisch an einen spezialisierten Agenten.

Unterstützte Aufgabentypen:

  • Folien — „Erstelle eine Präsentation über …“
  • Dokumente — „Schreibe einen Bericht über …“
  • Bilder — „Generiere ein Bild von …“
  • Deep Research — „Führe Deep Research zu … durch“
  • Websites — „Erstelle eine Landingpage für …“
  • Tabellen — „Erstelle eine Tabelle, die … analysiert“

Sie können mehrere Aufgaben gleichzeitig starten — jede läuft unabhängig im Hintergrund.

Background Tasks-Panel

Während einer Sprachsitzung erscheint eine Aufgaben-Schaltfläche in der Sprachsteuerungsleiste am unteren Bildschirmrand. Wenn Aufgaben laufen, zeigt ein Badge auf der Schaltfläche die Anzahl aktiver Aufgaben.

Klicken Sie auf die Aufgaben-Schaltfläche, um das Background Tasks-Panel zu öffnen:

  • Auf dem Desktop schiebt es von rechts ein
  • Auf Mobilgeräten erscheint es als unteres Sheet

Das Panel zeigt alle Ihre Hintergrundaufgaben mit aktuellem Status — laufend, abgeschlossen oder fehlgeschlagen. Klicken Sie auf eine Aufgabe, um direkt zu den Ergebnissen zu springen.

Wechsel zwischen Sprache und Text

Sie können jederzeit während einer Sitzung zwischen Sprache und Texteingabe wechseln:

  • Sprache zu Text — Klicken Sie auf das Tastatursymbol, um Ihre Nachricht zu tippen
  • Text zu Sprache — Klicken Sie auf das Mikrofonsymbol, um zurück in den Sprachmodus zu wechseln

Ihr Gesprächsverlauf bleibt unabhängig vom Eingabemodus erhalten.

FAQ

F: Verbraucht Echtzeit-Stimme Credits?

Ja, Echtzeit-Stimme-Sitzungen verbrauchen Credits je nach Nutzungsdauer. Details zu den Preisen finden Sie im Credits Guide.

F: Kann ich Echtzeit-Stimme auf dem Smartphone nutzen?

Ja, Echtzeit-Stimme funktioniert in mobilen Browsern. Tippen Sie im Chat-Eingabefeld auf die Sprachtaste, um eine Sitzung zu starten.