Friskription → Blog → VTuber
Japanische VTuber-Streams auf Englisch sehen
Übersetzung im Chat hängt davon ab, dass jemand wach ist, im richtigen Stream sitzt und Lust hat. Eigene Untertitel sind jedes Mal da, auf jedem Kanal, auch auf den kleinen, die niemand clippt.
Die kurze Antwort
- VTuber-Streams auf YouTube und Twitch tragen so gut wie nie eine englische Untertitelspur, ein Untertitelübersetzer hat dort also nichts zu lesen.
- Live-Übersetzer im Chat sind Freiwillige. Sie decken die großen Streams ab, zu den beliebten Zeiten, wenn gerade jemand Zeit hat.
- Eigene Untertitel hängen von nichts davon ab. Friskription transkribiert den Ton des Streams und zeichnet eine englische Übersetzung über das Video.
- Trag den Namen der Talent, den Namen des Fandoms und die wiederkehrenden Running Gags einmal ins Glossar ein, und sie bleiben den ganzen Stream über richtig geschrieben.
- Dreißig Minuten pro Woche sind kostenlos. Sprecherkennzeichnung hält eine Collab lesbar, wenn vier Leute gleichzeitig reden.
Warum dich Chat-Übersetzung immer wieder hängen lässt
Freiwillige Live-Übersetzer leisten Bemerkenswertes, und es sind schlicht zu wenige. Sie sammeln sich um die größten Kanäle, zu den Stunden, in denen der Großteil ihres Publikums wach ist. Eine mittelgroße Streamerin um vier Uhr morgens deiner Zeit, ein plötzliches unarchiviertes Karaoke, ein kleiner Indie-Kanal mit dreihundert Zuschauern — das sind die Streams, die nie ein TL bekommen, und meist genau die, wo man eines gewollt hätte.
Selbst auf einem gut abgedeckten Stream ist Chat-Übersetzung eine Zusammenfassung. Jemand liest eine Zeile, entscheidet, ob sie weitergegeben werden sollte, tippt eine gekürzte Fassung, und die landet in einem Chatfenster, durch das auch vierhundert Emotes laufen. Das ist unendlich viel besser als nichts, und es ist nicht dasselbe wie zu lesen, was gesagt wurde.
Und die Plattform hilft nicht. YouTubes Auto-Übersetzung braucht eine Untertitelspur zum Übersetzen; auf einem japanischen Live gibt es die meist nicht, und auf Twitch gibt es sie nie. Der Ton ist die einzige verfügbare Textquelle.
Eigene Untertitel einrichten
-
Erweiterung installieren und anmelden
Füge Friskription zu Chrome hinzu und melde dich mit Google an. Es startet mit dreißig Freiminuten Live-Untertiteln pro Woche, jeden Montag aufgefüllt, ohne Karte und ohne Konten bei einem KI-Anbieter.
-
Zielsprache auf Englisch stellen
Oder auf eine der anderen vierzehn — Chinesisch, Koreanisch, Spanisch, Portugiesisch und Indonesisch sind im VTuber-Publikum gut vertreten. Japanisch muss nicht als Ausgangssprache gewählt werden; die gesprochene Sprache wird erkannt, was auch heißt, dass ein Stream, der für eine Sponsorenlesung ins Englische wechselt, ohne Einstellungswechsel behandelt wird.
-
Stream öffnen und Start drücken
Die Untertitel erscheinen nach wenigen Sekunden über dem Video. Zieh den Kasten unter das Model, damit er das Gesicht nicht verdeckt, und stell die Größe einmal ein — sie wird für diese Seite gemerkt.
-
Das Glossar vor dem guten Teil füllen
Das ist der Schritt, der den Unterschied macht, und der nächste Abschnitt handelt von nichts anderem.
Das Glossar ist das ganze Spiel
Spracherkennung ist genau dort am schwächsten, wo VTuber-Streams am dichtesten sind: bei Eigennamen. Der Name der Talent, der Name des Fandoms, die Begrüßung, der Catchphrase, der Name einer Spielfigur. Das sind die Wörter, für die das Modell am wenigsten Kontext hat, also rät es — und rät jedes Mal anders.
Das Glossar legt eine Schreibweise für die Sitzung fest. Trag die Einträge einmal für einen Kanal ein, den du schaust, und der Stream hört auf, alle zehn Minuten alle umzubenennen.
Lohnt sich für jeden Kanal, den du mehr als einmal schaust:
- Der Name der Talent und der Spitzname, den die Fans tatsächlich benutzen — oft nicht dasselbe.
- Der Name des Fandoms und die Begrüßung, mit der der Stream öffnet.
- Die Namen häufiger Collab-Partner — sie kommen ständig vor und sind genau die Wörter, die eine Transkription zerlegt.
- Spielspezifische Begriffe, vor allem Charakter- und Gegenstandsnamen in einer anderen Sprache als der gesprochenen.
- Running Gags, die aus einem einzigen erfundenen Wort bestehen. Davon gibt es immer mehrere.
Collabs, Karaoke und die anderen unangenehmen Fälle
Collabs: Sprecherkennzeichnung einschalten
Vier Leute in einem Call, die sich gegenseitig ins Wort fallen, sind der schnellste Weg, Untertitel nutzlos zu machen — du bekommst einen ununterbrochenen Strom von Sätzen, ohne zu wissen, wer sie sagt. Die Sprecherkennzeichnung unterscheidet bis zu fünf Stimmen und markiert jede Zeile, und das ist meist der Unterschied zwischen einer Collab folgen und sie ausmachen.
Karaoke: erwarte weniger, und das ist in Ordnung
Singen ist für Spracherkennung auf eine Art schwierig, wie Sprechen es nicht ist: Vokale werden gehalten, der Rhythmus ist der der Musik und nicht der der Sprache, und ein Playback konkurriert mit der Stimme. Die Redepassagen zwischen den Liedern werden normal transkribiert. Bei den Liedern selbst nimm einen übersetzten Text als Bonus und nicht als etwas, worauf du zählen kannst.
Lange Streams: das Guthaben im Blick behalten
Ein sechsstündiger Endurance-Stream überlebt dreißig Freiminuten nicht. Abgerechnet wird nur Sprache, also kosten Wartebildschirm und lange Stillen nichts, und das Bedienfeld zeigt eine Schätzung des Rests. Wenn du weißt, dass es lang wird: Ein Minutenpaket ist ein einmaliger Kauf und kein Abo — die Minuten liegen dort, bis du sie brauchst.
Unarchivierte Streams: es gibt keine zweite Chance
Wird ein Stream nicht archiviert, lohnt sich der Transkript-Export: Er speichert die Zeilen der Sitzung während des Laufs in eine Datei, sodass ein unarchiviertes Karaoke oder ein Members-Stream dir hinterher doch etwas hinterlässt.
Wie gut ist die Übersetzung, ehrlich gesagt
Gut genug, um einem Stream bequem zu folgen, und kein Ersatz für jemanden, der die Sprache beherrscht. Zwei Dinge bestimmen das. Das Transkript kommt von einem Produktions-Spracherkennungsmodell — ElevenLabs Scribe v2, das eine Wortfehlerrate von 3,3 % auf englischen Benchmarks veröffentlicht — und alles danach ist dadurch gedeckelt, wie gut die Wörter überhaupt gehört wurden. Übersetzt wird anschließend von einem Sprachmodell, das jede Zeile gegen die vorherigen liest; deshalb kommt es mit einem Satz, der den vorherigen fortsetzt, besser zurecht als ein Phrase-für-Phrase-Übersetzer.
Am schwächsten ist es genau dort, wo ein menschliches TL glänzt: ein Witz, der an einem Wortspiel hängt, eine Anspielung auf etwas von vor drei Streams, ein Slangwort, das die Community letzte Woche erfunden hat. Für solche Momente ist der Chat da. Was du bekommst, sind die anderen neunzig Prozent — der tatsächliche Inhalt des Streams, während er passiert, in einer Sprache, die du liest.
Fragen
Kann ich Hololive- und Nijisanji-Streams mit englischen Untertiteln sehen?
Ja. Die Untertitel entstehen auf deiner Seite aus dem Ton des Streams, sie funktionieren also auf jedem Kanal auf YouTube oder Twitch — unabhängig von Agentur, Größe oder davon, ob gerade jemand im Chat übersetzt.
Funktioniert es bei unarchivierten und Members-only-Streams?
Ja — wenn der Tab Ton abspielt, kann er untertitelt werden, und ein Members-Stream, bei dem du angemeldet bist, ist genau das: ein Tab, der Ton abspielt. Der Transkript-Export lohnt sich bei unarchivierten Streams besonders, weil es später kein VOD zum Nachsehen gibt.
Wie verhindere ich, dass der Name einer Talent falsch geschrieben wird?
Trag ihn ins Glossar ein. Das legt die Schreibweise für die Sitzung fest, sodass der Name nicht bei jeder Nennung neu geraten wird. Trag Collab-Partner und den Fandom-Namen gleich mit ein — die anderen Wörter, die es am häufigsten zerlegt.
Kommt es bei jemandem mit, der sehr schnell redet?
Ja. Stell die Tempo-Voreinstellung auf Quick, die kurze, pünktlich landende Zeilen vollständigen Sätzen vorzieht, die einen Takt später kommen. Der Sync-Modus geht weiter: Er hält die Wiedergabe um einige Sekunden zurück, damit die Zeile mit den Worten statt danach ankommt.
Kann es die Lieder in einem Karaoke-Stream übersetzen?
Teilweise. Singen ist deutlich schwerer zu transkribieren als Sprechen — gehaltene Vokale, ein Playback und ein Rhythmus, der der Musik gehört und nicht der Sprache. Redepassagen werden normal transkribiert; nimm übersetzte Liedtexte als Bonus.
Merkt die Streamerin, dass ich es benutze?
Nein. Alles passiert in deinem eigenen Browser, aus dem Ton, den der Tab ohnehin abspielt. An den Kanal wird nichts gesendet, und im Chat erscheint nichts.
Was kostet ein langer Stream?
Dreißig Minuten pro Woche sind kostenlos und werden jeden Montag aufgefüllt. Abgerechnet wird nur Sprache, also kosten Wartebildschirme und Stillen nichts. Darüber hinaus bringt ein einmaliges Starterpaket für 1,99 $ 90 Minuten, und die Pakete gehen bis 24,99 $ für 1.440 Minuten — einmalige Käufe, nie ein Abo, und die Minuten verfallen nicht.
Sieh dir den nächsten Stream auf Englisch an
Dreißig Freiminuten jede Woche. Keine Karte, keine KI-Konten.
Zu Chrome hinzufügen