Dodaj do ulubionych

Ivona z Gdyni pomoże milionom Brytyjczyków

18.11.09, 22:08
Dzięki wymyślonemu i stworzonemu w Gdyni syntezatorowi mowy, miliony brytyjskich niewidomych odzyskają choć częściowo komfort życia ludzi pełnosprawnych.

Gdyńska firma IVO Software, założona przez absolwentów PG, Łukasza Osowskiego i Michała Kaszczuka, stworzyła najlepszy na świecie syntezator mowy ludzkiej. Teraz, we współpracy z największą angielską organizacją charytatywną Royal National Institute of Blind People (Królewski Narodowy Instytut Niewidomych, RNIB), wprowadza na rynek dwa anglojęzyczne głosy. Zostaną na nich oparte produkty i usługi, które RNIB dostarcza do ponad dwóch milionów Brytyjczyków z problemami wzroku.

- IVO Software opracowało syntezator mowy nowej generacji o niesamowitej, zupełnie nowej jakości. Zastosujemy go we wszystkich obszarach naszej działalności - mówi Steve Tyler, dyrektor ds. dostępności i innowacji w RNIB.

Dwa nowe angielskojęzyczne głosy syntezatora mowy IVONA - Brian i Amy, wyróżniają się idealną wymową, akcentem, barwą oraz intonacją. Brzmią identycznie, jak klasyczni lektorzy kanałów radiowych i telewizyjnych BBC. Zostały już użyte m.in. do udźwiękowienia systemu informacji pasażerskiej na przystankach komunikacji publicznej w Walii.


www.trojmiasto.pl/wiadomosci/Ivona-z-Gdyni-pomoze-milionom-Brytyjczykow-n35691.html

A tutaj można przetestować oprogramowanie:

www.expressivo.com/pl/
Obserwuj wątek
    • maciekqbn Update 18.11.09, 22:36
      www.ivona.com/
      • maciekqbn Ivona na youtube 18.11.09, 22:42
        www.youtube.com/watch?v=u0YybpK5EaQ
        • ratpole Re: Ivona na youtube 18.11.09, 22:57
          maciekqbn napisał:

          > www.youtube.com/watch?v=u0YybpK5EaQ

          Neat, ale moj GPS gada dokladnie tak samo. W czym tu jest przelom?
          • maciekqbn Re: Ivona na youtube 18.11.09, 23:39
            GPS ma podłożone sample czytane przez lektora (całe wyrazy). Złożyć z sampli
            tekst (np. komunikaty nawigacji GPS czy komputera samochodowego), którego treść
            programista zna (i ma do tego przygotowany zestaw sampli) to zadanie dla
            kiepskiego studenta I roku. Natomiast stworzyć dobry syntezer mowy to wyzwanie
            dla najlepszych. IVONA dokonuje syntezy dowolnych wyrażeń z zapisanego tekstu.
            Robi to lepiej niż np. syntezer Microsoftu.

            www.ivona.com/?tk=XzDDlYrp

            Jeśli nie wiesz na czym polega różnica to dalej nie ma sensu tłumaczyć.
            • ratpole Re: Ivona na youtube 18.11.09, 23:54
              maciekqbn napisał:

              > GPS ma podłożone sample czytane przez lektora

              Niekoniecznie. Moj ma 2 opcje: glos syntetyzowany (computer voice) lub
              samplowany (prerecorded?). Na rynku od lat jest dostepne kilka syntezatorow
              mowy roznych firm, np. Loquendo, IBM ViaVoice. Powtarzam: jakiego przelomu
              dokonali ci wynalazcy?
              • maciekqbn Re: Ivona na youtube 19.11.09, 00:00
                Porównaj jakość głosu syntetyzowanego przez Ivonę z innymi syntezerami (tymi
                prawdziwymi, np. wymienionymi przez Ciebie a nie pseudosyntezerem z nawigacji).

                Zmykam do spania.
                • ratpole Re: Ivona na youtube 19.11.09, 00:24
                  maciekqbn napisał:

                  > Porównaj jakość głosu syntetyzowanego przez Ivonę z innymi syntezerami (tymi
                  > prawdziwymi, np. wymienionymi przez Ciebie a nie pseudosyntezerem z nawigacji).

                  No wiec wlasnie porownalem. Owszem Ivona mowi, ale da sie uslyszec
                  "komputerowosc". W sumie nie odpowiedziales na moje pytanie w czym ta rewolucja
                  w porownaniu do wielkich firm, ktore wydaly o wiele wiecej kasy na o wiele
                  wiecej specjalistow?
                • japoxx Re: Ivona na youtube 19.11.09, 03:38
                  hehehehehehehehehehe maciusiu

                  wbrew twojej propozycji porownalem pseudosyntezer Jill z Garmin z tym prawdziwym IVONA w wersji amerykanskiej- Jennifer
                  mozna powiedziec ze nie ma roznicy

                  nie mam zaladowanej TTS w wersji brytyjskiej wiec nie moge porownac, ale IVONA w wersji brytyjskiej Amy wymawia nazwy lepiej niz w wersji amerykanskiej Jennifer

                  skad wiec ten twoj entuzjazm, pomijajac sam prosty fakt, ze ty tez chcialbys sie czyms pochwalic
      • ratpole Re: Update 18.11.09, 23:01
        maciekqbn napisał:

        > www.ivona.com/

        Ehehehe, najlepiej czyta dorozkarskie wiazanki
        • kupa.pazi sciurku 18.11.09, 23:23
          wez ty zrob uprzejmosc rodzinie i hehe przyjaciolom i na krate rzuc siem,
          uwierz, wszystkie beda cieszyc siem
          • foot_stamps maciek 19.11.09, 02:08
            faktycznie niezly jest ten syntezator, ale powiedz mi macku jak to
            jest technicznie zrobione? to znaczy sa wszystkie dzwieki
            wprowadzane tzn gloski?
            • maciekqbn Re: maciek 19.11.09, 14:55

              foot_stamps napisał:

              > faktycznie niezly jest ten syntezator, ale powiedz mi macku jak to
              > jest technicznie zrobione? to znaczy sa wszystkie dzwieki
              > wprowadzane tzn gloski?

              W ten sposób jak piszesz zrobione są (a raczej były) proste syntezery, typu np.
              SynTalk, charakteryzowały się sztucznym, syntetycznym brzmieniem bez intonacji i
              akcentu.

              Z kolei syntezery stosowane w prostych urządzeniach, które mają zdeterminowane z
              góry komunikaty a jedynie zmienia się sekwencja komunikatów składająca się na
              ich treść - takie jak np. nawigacje GPS - opierają się na zasadzie doboru
              określonych sampli (przeważnie są to całe wyrazy nagranego rzeczywistego głosu
              ludzkiego). Tutaj programista z góry może przewidzieć wszystkie możliwe
              kombinacje komunikatów i sprawa jest prosta.

              Obecne algorytmy stosowane w syntezerach potrafiących odczytać "otwarty" (czyli
              nie znany uprzednio programiście) tekst, to tajemnica ich autorów, ale ogólnie
              ich działanie polega na pełnej symulacji modelu głosu ludzkiego. Czyli
              analizowane są nie tylko poszczególne wyrazy (w kontekście wyodrębnienia głosek)
              ale całe zdania, co pozwala zachować akcent i intonację zbliżoną do realnego
              głosu ludzkiego.
              Nie sposób tego opisać w kilku zdaniach. W najprostszym przypadku, tzn.
              pojedynczy wyraz analizowane są kolejne, sąsiednie grupy znaków i dobierane
              odpowiadające im dźwięki zgodnie z założonym indywidualnym (męski/żeński,
              wysoki/niski, ciepły/ostry itp.) modelem głosu. Rozbijanie wyrazu na głoski
              tutaj nie ma sensu, bo wrócimy do dawnych, "sztucznych" algorytmów.
        • ratpole Re: Update 19.11.09, 03:48
          ratpole napisał:

          > maciekqbn napisał:
          >
          > > www.ivona.com/
          >
          > Ehehehe, najlepiej czyta dorozkarskie wiazanki

          BULLSHIT hehehe yebany czyta jak yebane
    • polany niemozliwe 19.11.09, 02:55
      taki syntezator mowy dla niewidomych jest mozliwy w jezyku wloskim
      ale nie angielskim, ktory jest jezykiem niefonetycznym, jest
      nontransparent, etc. a juz na pewno nie zadziala on w Australii,
      gdzie jest co najmniej 100 odmian jezyka angielskiego, takich jak
      rodzimy ocker poprzez inne azjatyckie szybkie wersje o rozpietosci
      od sri lanki po wietnam, az do niemnieckich i slowianskich akcentow
      rownie bolesnych dla ucha autochtonow co nadepniecie slonia
      • kaszanka_pl kagan 19.11.09, 02:57
        nie spisz?
        • ratpole Re: kagan 19.11.09, 03:02
          kaszanka_pl napisał:

          > nie spisz?

          A ty mozesz spac na glodny zoladek? hehe
          • polany Re: kagan 19.11.09, 03:23
            a ty juz wylizales kawior swojej lady?
            • ratpole Re: kagan 19.11.09, 03:43
              polany napisał:

              > a ty juz wylizales kawior swojej lady?

              Alescie pojechali doktorze.
              Tekst jakby z ust pedryla hehe
              Obessaliscie ogora jakiemus 14 latkowi pod Dworcem Centralnym za obietnice
              postawienia zupy w barze mlecznym? hehe
            • kupa.kazi Re: kagan 19.11.09, 03:47
              polany napisał:

              > a ty juz wylizales kawior swojej lady?
              wlacz glosniki , uslyszysz, jak sciurek portugalskie rodzyny lyka lyk,lyk, a
              fuuujjj smacznego sciur
      • maciekqbn Re: niemozliwe 19.11.09, 15:08
        polany napisał:

        > taki syntezator mowy dla niewidomych jest mozliwy w jezyku wloskim
        > ale nie angielskim, ktory jest jezykiem niefonetycznym, jest
        > nontransparent, etc.

        To nie ma znaczenia. Jest to kwestia stworzenia odpowiedniego modelu głosu - co
        naturalnie nie jest proste, ale jak widać jest możliwe.

        > a juz na pewno nie zadziala on w Australii,
        > gdzie jest co najmniej 100 odmian jezyka angielskiego,

        To nie ma znaczenia, w takim przypadku należy przygotować 100 różnych modeli
        głosu, odpowiednio do każdej odmiany.

        Ze względów ekonomicznych zwykle przygotowuje się model odpowiadający oficjalnej
        "literackiej" wymowie obowiązującej na danym obszarze językowym.
    • internetrat.com Re: Ivona z Gdyni pomoże milionom Brytyjczyków 19.11.09, 15:41
      brzydko zajezdza ten projekt syntetazorem firmy Linguatec.

      Najlepszy dowod ze poki co to tylko Brian i Amy a potem to jeszcze dlugo, dlugo
      nic. Takie bajki jak zapodajesz macius to moze prawic tylko bezlitosny ignorant.
      Darowalibyscie sobie wciskac takie pierdoly medialne w dobie internetu.

Nie masz jeszcze konta? Zarejestruj się


Nakarm Pajacyka