Audioproduktion und Integration
Aktiver Stand und neuer Stimmvergleich · 13. September 2026
Die aktuelle Produktion der verifizierten v28.1-Basis verwendet 80 Qwen-Bordcomputeraufnahmen und 44 getrennte Crew-/Funkaufnahmen. Die drei Statuszuordnungen zeigen auf VoiceQwen/qwen-profiles.wav, qwen-launch.wav und qwen-results.wav. Herkunft, bewusste Stimmenwahl und spätere Ergänzungen stehen in Qwen-Integration und Audio v28. Die Originaldateien bleiben erhalten; die folgende Drei-Clip-Zuordnung beschreibt die historische Phase vor dieser Integration.
Zur erneuten Rückmeldung des Nutzers liegt ein abspielbarer Vergleich der Originale und der heutigen Computerstimme vor. Er enthält vorhandene Dateien, keine neue Sprachproduktion. Der Nutzer hat am 13. September ausdrücklich entschieden, die vorhandenen Stimmen vorerst beizubehalten und den Vergleich später zu beurteilen.
Historische Sprachrichtung vor der Qwen-Integration
Der Nutzer hat die Piper-Stimme ausdrücklich abgelehnt, einschließlich der lebendigeren Thorsten-Variante. Auch die Häufigkeit der Sprachausgabe und das Vorlesen jeder Schaltfläche wurden abgelehnt. Gewünscht ist wieder der gut klingende weibliche Schiffscomputer aus den vorhandenen ElevenLabs-Aufnahmen des Prototyps, mit gezieltem Einsatz statt permanenter Kommentierung.
Die damalige VoiceBank verwendete genau drei vorhandene Originalclips:
| Anlass / Kennung | Originaldatei |
|---|---|
Begrüßung / profiles |
Assets/Resources/AudioFiles/ShipAI/Greetings/ship.de.HelloCommander.mp3 |
Missionszuweisung / launch |
Assets/Resources/AudioFiles/ShipAI/Missions/ship.de.MissionAssigned.mp3 |
Einsatz abgeschlossen / results |
Assets/Resources/AudioFiles/ShipAI/Missions/ship.de.MissionComplete.mp3 |
Menüs, Maus-Hover, Controller-Fokus und das Flughandbuch blieben stumm. Zwischen regulären Meldungen hielt GameAudio über die jeweilige Clipdauer hinaus zwei Sekunden Abstand. Zusätzlich beschränkte die Wiedergabe diesen Sprachweg auf die drei zugelassenen Originalclips, damit auch eine alte Inhaltsreferenz keine abgelehnte Piper-Stimme abspielen konnte. Die heutige Statusfreigabeliste umfasst außerdem die drei ausdrücklich zugeordneten Qwen-Aufnahmen.
Diese damalige Rückkehr zur gewünschten Stimme war noch keine vollständige Neuvertonung: Die neue Story, weitere Missionsbesprechungen und das Finale lagen zunächst als sichtbare Texte vor. Die spätere Qwen-Produktion ergänzte sie. Die drei Originalclips allein waren kein Ersatznachweis für die endgültige deutsche Story- und Missionsvertonung. Fehlende Aufnahmen wurden weder durch unpassende alte Missionsinhalte noch durch die abgelehnte Stimme aufgefüllt.
OpenAI-Sprachproduktion wurde damals vom Nutzer nicht gewählt. Eine fehlgeschlagene Zahlung schloss damals neue ElevenLabs-Aufnahmen aus; dies ist kein neu geprüfter Dienst- oder Kontostatus. Die bereits lokal vorhandenen Clips benötigen beim Spielen keinen Zugang. Die spätere Produktion erfolgte lokal mit Qwen. Diese Historie autorisiert keine Kontozahlung oder neue kostenpflichtige Nutzung.
Historie der abgelehnten Arbeitsfassung
Assets/SpaceHero/Audio/Dialogue-de.json und die 90 Piper-Dateien dokumentieren die bisherige Produktion. Der Katalog wurde von 56 auf 82 und zuletzt durch acht Texte der Steuerungshilfe auf 90 erweitert. Er enthielt auch Menütexte und Hinweise zur inzwischen entfernten Feuer-/Scannerautomatik. Diese alten Inhalte und Dateien bleiben zur Nachvollziehbarkeit erhalten, sind aber keine aktuelle Produktionsvorgabe und keine aktive Vertonung.
Verwendet wurden Piper 1.8.0, de_DE-thorsten_emotional-medium, Sprecher 0 (amused), Längefaktor 1.02. Die erste neutrale Probe wurde als zu nüchtern bewertet; nach dem Spieltest wurde auch die emotionale Fassung abgelehnt. Tools/Generate-Speech.py und Docs/Audio/speech-manifest.json halten Texte, Modell-/Datei-Hashes und Clipdauern fest. --reuse übernimmt nur unveränderte und hashgeprüfte Dateien. Das Werkzeug bleibt historische Entwicklungsinfrastruktur und wird nicht als Sprachdienst im Spiel benötigt.
Dokumentierte Modellquellen: Thorsten-Voice, Model Card. Die frühere Herkunftsprüfung wird dadurch bewahrt; sie ist keine Qualitätsfreigabe durch den Nutzer.
Nachbrenner und Fluggeräusche
Der Nachbrenner verwendet jetzt einen eigenen kontinuierlichen Triebwerksklang. GameAudio.CreateBoostLoop() erzeugt lokal eine zwei Sekunden lange Schleife mit gefiltertem Rauschen und tiefen Motoranteilen, 22.050 Hz, mono. Eine Angleichung an der Naht verhindert einen abrupten Sprung beim Wiederholen. Die Lautstärke steigt über 0,12 Sekunden an und fällt nach Loslassen über 0,20 Sekunden ab. Das frühere kurze boost.wav wird für die Boost-Aktion nicht mehr abgespielt; die Originaldatei bleibt erhalten.
FlightDirector liefert den tatsächlichen Zustand des Nachbrenners: Nur eine gehaltene Taste mit verfügbarem Tankinhalt startet die Schleife und die sichtbaren Triebwerksflammen. Bei leerem Tank muss die Taste vor einer neuen Zündung losgelassen werden. Das verhindert wiederholtes An- und Ausschalten während minimaler Nachladung. Pause stoppt die Schleife sofort; Rettung, Missionsende und Verlassen des Flugs beenden ebenfalls die Aktion. Der Kanal beachtet Gesamt- und Effektlautstärke.
Die neue Schleife ist eine technische und gestalterische Überarbeitung des beanstandeten Tons. Ob sie im Spiel angenehm klingt und mit Triebwerksgrafik, Musik und übrigen Effekten zusammenpasst, ist erneut zu hören.
Seit v17 werden auch angehaltene Flug-One-Shots bei Missionsabbruch, Rettung und erfolgreichem Missionsende ausdrücklich beendet. Normales Pause/Fortsetzen erhält sie. Am Konvoitor erzeugen die drei Helfer weiterhin drei sichtbare Ausbrüche, aber gemeinsam nur einen Ankunftsklang. Wiedergabezustände und ihre Regression sind geprüft; die versuchte PCM-Aufnahme lieferte keine belastbare Audioausgabe. Details und offene Hörprüfung: QA-Audio-Finale-2026-09-08.md.
Musik und vorhandene Effekte
Unter Assets/SpaceHero/Audio/Generated liegen die bisherigen 15 erzeugten Dateien, reproduzierbar mit Tools/Generate-Audio.py (Python + numpy): sechs eigenständige Themen und neun kurze Effekte einschließlich des inzwischen abgelösten Boost-Tons. Keine Musikaufnahme oder fremde Melodie wurde kopiert. Die früheren acht Takte wurden durch 32 Takte mit Thema, Antwort, ruhiger Brücke und Rückkehr ersetzt. Eigene Noten-/Akkordfolgen stehen direkt im Generator; die Synthese verwendet weiche Klavier-, Zupf-, Glocken-, Holzbläser- und Flächenklänge. Jeder Boss hat eine eigene Begleitung.
| Einsatz | Thema | Tempo | Dauer |
|---|---|---|---|
| Erdorbit | Kleine Helden im Erdorbit | 96 BPM | 80,00 s |
| Kristallnebel | Lichter im Kristallnebel | 84 BPM | 91,43 s |
| Sternenwerft | Die Werkstatt erwacht | 108 BPM | 71,11 s |
| K.R.A.B.B.E. | K.R.A.B.B.E.s Greifertanz | 112 BPM | 68,57 s |
| Magnetwal | Der große Magnetwal | 92 BPM | 83,48 s |
| Netzherz | Das Sternennetz leuchtet | 116 BPM | 66,21 s |
PCM 44.100 Hz Stereo, Spitzen unter 0,65, RMS 0,09–0,105. Ausklingende Noten und Raumreflexionen laufen über die Schleifengrenze; ein kurzer Übergang gleicht die unmittelbare PCM-Naht an. Tools/Verify-Audio.py liest die tatsächlichen WAVs und prüft Format, Länge, Pegel, Stereobreite, fehlende Stille und die Naht. Bei der bisherigen Musikprüfung bestanden alle sechs; die neun Effektdateien blieben damals bytegleich zum vorigen Stand. FFmpeg-EBU-R128-Messung: −18,6 bis −17,3 LUFS, vor der Spiellautstärke und Sprachabsenkung. Diese gespeicherten Befunde sind technische Pegelprüfungen und keine Hörabnahme der überarbeiteten Gesamtmischung. Berichte unter Artifacts/Audio/, Produktionsmanifest unter Docs/Audio/music-manifest.json.
Nur Musik neu erzeugen: Artifacts/Speech/.venv/Scripts/python.exe Tools/Generate-Audio.py --music-only. Prüfen und eine Folge kurzer Ausschnitte erstellen: Artifacts/Speech/.venv/Scripts/python.exe Tools/Verify-Audio.py --preview. Die Hörprobe liegt in Artifacts/Audio/Musik-Hoerprobe.wav: je zehn Sekunden Erdorbit, Kristallnebel, Werft, K.R.A.B.B.E., Magnetwal, Netzherz, durch kurze Pausen getrennt. Sie enthält die Musik allein; die Mischung im Spiel ist gesondert zu hören.
Unity importiert alle sechs Musikthemen als Vorbis-Stream und kurze dateibasierte Effekte/Sprache als vorgeladenes Vorbis. Die neue Nachbrennerschleife wird direkt im Speicher erzeugt. Musik wechselt mit 0,8 Sekunden Überblendung. Sprache senkt Musik innerhalb etwa 0,1 Sekunden auf 27 Prozent; danach kehrt sie über etwa 0,6 Sekunden zurück. Stumm geschaltete Sprache löst keine Absenkung aus. Die Pause hat einen eigenen Musikpegel. Fluggeräusche pausieren; kurze Menüeffekte bleiben separat. Alle Kanäle beachten die gespeicherten Lautstärkeregler.
Die Importentscheidung verwendet die zugewiesenen Musikassets. Die frühere Erkennung anhand von -flight im Dateinamen hatte auch menu-leave-flight.wav als Stream behandelt. Diese Fehlzuordnung wurde behoben; der betreffende Piper-Clip gehört heute außerdem zur inaktiven Produktionshistorie.
Untertitel der aktiven Sprachclips haben eine vom Audiogerät unabhängige Laufzeit und bleiben während einer Pause stehen. Visuelle Warnungen, Scannerverbindungen und kurze Rettungs-/Upgrade-Signale vermitteln Rückmeldung, ohne jeden Bedienungsschritt zu kommentieren. Die bestehenden Prioritätskanäle bleiben technisch verfügbar; daraus folgt keine Freigabe für erneute flächendeckende Sprachausgabe.
Offene Arbeit und Abnahme: passende neue Story- und Missionsaufnahmen in der gewünschten Stimmrichtung, tatsächlicher Hörtest von Häufigkeit und Gesamtmix einschließlich Nachbrenner, Verständlichkeit und Bedienbarkeit bei den Kindern. Die Ablehnung von Piper ist entschieden und wird nicht erneut als offene Auswahl geführt. Technische Format- und Prioritätstests ersetzen die erneute Klangabnahme nicht.