Prijeđi na sadržaj
Yappy Preuzmi
Jezik: hr

dio koji nitko drugi ne pokazuje

Od napisanog do izgovorenog.

Čitati naglas nije slovo po slovo: to je interpretacija. „1492“ se čita „tisuću četiristo devedeset dva“; „Henrik VIII“ se čita „Henrik Osmi“; „Louis XIV“ se na francuskom izgovara „Louis quatorze“; „EL CID“ nije rimski broj; FBI se izgovara slovo po slovo, a NASA ne. Prije nego što sintetizira ijedan slog, Yappy pretvara tekst u scenarij čitanja: partituru onoga što će glas doista reći.

Scenarist

Isprobaj ovdje: to je isti Rust iz aplikacije, kompajliran za tvoj preglednik.

Scenarij će se pojaviti ovdje, s podcrtanim pretvorbama.

Dvanaest zanata u jednom prolazu.

Datumi

„24. 5. 1533.” izgovara se u cijelosti, s redoslijedom i rodom svakoga jezika.

Vrijeme

„14:05” izgovara se kako bi to rekao čovjek, ne kako bi ga pročitao sat.

Valute

„3,50 €” izgovara se „tri eura i pedeset”, s množinom kakva treba.

Postoci

„7 %“ se čita „sedam posto“, a „0,5 %“ se ne pretvara u „nula zarez pet“.

Unidades

„230 °C“ se čita „dvjesto trideset stupnjeva po Celziju“.

Ordinales

„3.“ se čita „treća“, s rodom i padežom gdje ih ima.

Rimski brojevi s glavom

„XX. stoljeće“ čita se „dvadeseto stoljeće“, „Elizabeta II.“ glasi „Elizabeta Druga“, a „XL“ na etiketi nije broj.

Krative po fonotaktici

FBI se čita slovo po slovo, NASA kao riječ. Pravilo određuje kako zvuči, a ne popis.

Abreviaturas

„itd.“, „str.“, „19. st.“: svaki jezik ima svoju tablicu.

Números grandes

S RBNF-gramatikama iz Unicode CLDR-a, uključujući rod i padeže.

31 idiomas

Ista pravila, s gramatikom svakog jezika. Bez ručno pisanih popisa.

El ritmo

Naslovi odahnu nakon što se izgovore; popisi drže svoj takt. Pauze su dio scenarija, a ne slučajnosti.

Najčešća pitanja

Što su RBNF-gramatike?
RBNF je kratica za Rule-Based Number Format: pravila kojima Unicode CLDR opisuje kako se broj izgovara u svakom jeziku. Nije tablica od tisuću riječi, nego gramatika: zato zna da se kaže „dvadeset i dvije stranice“, a ne „dvadeset i dva stranice“, da ruski deklinira brojeve i da francuski do devedeset broji dvadeseticama. Yappy ih interpretira u čistom Rustu, bez ručno pisanih popisa.
Zašto treba scenarist? Zar to ne napravi sam glas?
Ne, i to je namjerno. Model glasa u Yappyju radi na razini znakova: izgovara točno ono što mu stigne napisano. To ga čini brzim i laganim, ali znači da će, ako mu dođe „1492“, pokušati reći baš to, znak po znak. U takvom modelu normalizacija je izgovor. Scenarist je dio koji svaki broj, svaku kraticu i svaki simbol pretvara u riječi koje bi rekao čovjek.
Na koliko jezika radi?
Na svih 31 jezik koji glas govori, svaki sa svojim pravilima: redoslijed datuma, veza broja i valute, ordinali, krative i rimski brojevi. Španjolski za XV. stoljeće kaže „siglo quince“, engleski „fifteenth century“; „Louis XIV“ je „Louis quatorze“, a ne „Louis fourteenth“. Dvanaest istih zadataka, trideset i jedna gramatika.
Zašto karaoke uvijek padne na točnu riječ?
Jer zapis nije samo pretvoreni tekst: on čuva preslikavanje između napisanoga i izgovorenoga. Kad glas izgovori „tisuću četiristo devedeset i dva“, zapis zna da te četiri riječi dolaze od četiri znamenke broja „1492“, pa se podcrtaj položi točno na njih, bez pomaka. To je razlika između osvjetljavanja teksta i pogađanja.
Riječ se izgovara krivo. Mogu li je ispraviti?
Korisnički rječnik izgovora zasad ne postoji. Budući da model čita znakove, najbrži je put da riječ u uređivaču napišeš onako kako zvuči i ponovno je poslušaš. A ako ne radi opći obrazac (kratica, sigla, mjerna jedinica), prijavi to u GitHub temama: tablice zapisivača rastu upravo tim slučajevima.
Je li zapisivač na ovoj stranici isti kao onaj u aplikaciji?
Isti je kod, kompajliran u WebAssembly da radi u tvom pregledniku. Ono što ovdje napišeš ne napušta tvoju karticu. A budući da je cijeli projekt otvoren, pravila možeš čitati jedno po jedno u repozitoriju.

Scenarij je pola priče; druga se polovica sluša.

Poslušaj uzorak