Skip to main content

Basale spraaksynthese

Het onderstaande talk.php is een voorbeeld dat spraak synthetiseert uit tekst en wegschrijft naar een WAV-bestand.
PHP FFI is in webserveromgevingen (zoals FPM) doorgaans uitgeschakeld. Voer dit script uit vanuit de CLI, bijvoorbeeld met php talk.php.
Uitvoeren:

Spraaksynthese in één stap (de tts-methode)

Als je de twee stappen createAudioQuery + synthesis wilt overslaan, kun je de tts()-methode gebruiken:

Spraaksynthese met katakana-notatie

Je kunt ook synthetiseren vanuit katakana-notatie in AquesTalk-stijl:

Een gebruikerswoordenboek gebruiken

Gebruik UserDict om de uitspraak van eigen woorden te registreren:

De AudioQuery aanpassen

Door de JSON die je met createAudioQuery hebt opgehaald aan te passen vóór de synthese, kun je intonatie, tempo en dergelijke nauwkeurig regelen:

Accentfrases ophalen

Je kunt de accentfrase-informatie van tekst ophalen om te bekijken en te bewerken:

De GPU-modus gebruiken

In een omgeving met een beschikbare GPU kun je versnellen door AccelerationMode::Gpu op te geven:

Meerdere spraakmodellen gebruiken

Door meerdere .vvm-bestanden te laden en te wisselen van stijl-ID kun je meerdere karakterstemmen naast elkaar gebruiken:
Laatst gewijzigd op 6 september 2026