Odczytywanie komunikatów w autobusach i tramwajach

Moderatorzy: Tyrystor, Dantte

fraktal
Posty: 5599
Rejestracja: 17 gru 2005, 12:03

Post autor: fraktal » 17 cze 2025, 23:59

person pisze:
17 cze 2025, 13:00
fraktal pisze:
12 cze 2025, 22:44
Może dlatego Ci najlepsi lektorzy rzadko użyczają głosu w reklamach.
Czubówna na to: :shock: :shock: :shock: :shock:
No Czubówna to akurat zły przykład. Kto nie widział, niech zerknie - ciekawie zrobiona i fonia i wizja.
https://www.youtube.com/watch?v=DoQ1MKNvWvQ

mb112
Posty: 1460
Rejestracja: 22 maja 2012, 23:47

Post autor: mb112 » 18 cze 2025, 0:55

michael112 pisze:
17 cze 2025, 23:35
No ja myślę, że Maciej Gudowski mógłby nagrywać zapowiedzi do wszystkich przystanków i stacji. Podoba mi się jego głos, ale poza subiektywnym odczuciem ma dwie cechy, które wyróżniają go spośród pozostałych lektorów:
1) po pierwsze: żyje, a jego stan zdrowia pozwala na nagrywanie kolejnych zapowiedzi;
2) po drugie: już nagrał część komunikatów, a mianowicie: nazwy stacji metra (obu linii, bo w nowych składach na M1 zapowiada właśnie Gudowski) i SKM.
Jestem natomiast przeciwny generowaniu zapowiedzi AI udających głos realnego, rozpoznawalnego publicznie, lektora.
Ale właściwie dlaczego Wam przeszkadza że jest tak jak jest ? Co z tego że jest kilka różnych głosów, skoro wszystkie są poprawne i dobrze słyszalne ? Dla mnie głos pana Tomasza to już stały element komunikacji, wręcz głupio mi się jeździ jak się coś spieprzy i go nie słychać :) A że już nie będzie możliwości dogrywania jego komunikatów to trudno, a to że cały czas jest słyszalny na co dzień w mieście to chyba najlepsza forma jego upamiętnienia, na razie dogrania wymagała niewielka część, pewnie najwyżej kilka % w mieście, to chyba nie jest duży problem.
michael112 pisze:
17 cze 2025, 23:35
No ja myślę, że Maciej Gudowski mógłby nagrywać zapowiedzi do wszystkich przystanków i stacji. Podoba mi się jego głos, ale poza subiektywnym odczuciem ma dwie cechy, które wyróżniają go spośród pozostałych lektorów:
1) po pierwsze: żyje, a jego stan zdrowia pozwala na nagrywanie kolejnych zapowiedzi;
Tak, jego głos też jest jak najbardziej ok. Natomiast - jak najbardziej mu życzę długiego i zdrowego życia i doczekania ukończenia M4, ale pewnie realnie to może mieć już wtedy z 90 lat jak nie więcej... Nawet jeśli ostateczne nazwy stacji będą znane nieco wcześniej, to dość odległa perspektywa. Nie mówiąc już o M5.
Jestem natomiast przeciwny generowaniu zapowiedzi AI udających głos realnego, rozpoznawalnego publicznie, lektora.
Tak, zdecydowanie, żadnego AI. (-X

Awatar użytkownika
person
(geograf)
Posty: 9744
Rejestracja: 15 gru 2005, 2:45
Lokalizacja: z szafy

Post autor: person » 18 cze 2025, 13:42

mb112 pisze:
18 cze 2025, 0:55
Jestem natomiast przeciwny generowaniu zapowiedzi AI udających głos realnego, rozpoznawalnego publicznie, lektora.
Tak, zdecydowanie, żadnego AI. (-X
A książki powinny być tworzone/pisane ręcznie przez benedyktynów, a nie przez te piekielne maszyny z czcionkami, tak?

Stary Pingwin
Posty: 6067
Rejestracja: 11 lis 2009, 11:48

Post autor: Stary Pingwin » 18 cze 2025, 13:52

Kompromis- benedyktyn piszący na maszynie do pisania.
Klimatyzatory są złe.
Niszczą torowisko.

Awatar użytkownika
Krzysztof_J
Posty: 646
Rejestracja: 19 wrz 2018, 15:34
Kontakt:

Post autor: Krzysztof_J » 18 cze 2025, 14:09

mb112 pisze:
18 cze 2025, 0:55
Ale właściwie dlaczego Wam przeszkadza że jest tak jak jest ? Co z tego że jest kilka różnych głosów, skoro wszystkie są poprawne i dobrze słyszalne ? Dla mnie głos pana Tomasza to już stały element komunikacji, wręcz głupio mi się jeździ jak się coś spieprzy i go nie słychać :) A że już nie będzie możliwości dogrywania jego komunikatów to trudno, a to że cały czas jest słyszalny na co dzień w mieście to chyba najlepsza forma jego upamiętnienia, na razie dogrania wymagała niewielka część, pewnie najwyżej kilka % w mieście, to chyba nie jest duży problem.
Mi osobiście zbytnio nie przeszkadza, jednak coś czuję, że w pewnym momencie zacznie to przeszkadzać samemu ZTM-owi (patrząc na ich tendencje do czasem wręcz przesadnego ujednolicania wszystkiego, zwłaszcza tego, na co pasażer z reguły zwraca najmniejszą uwagę), tylko że pewnie znając życie, to pewnie zrobi się jeszcze większy bałagan, ponieważ okaże się, że np. tu nie wgrają, bo trzeba zmienić coś w systemie, tam nie, bo "Zaraz idzie do kasacji" itd.
person pisze:
18 cze 2025, 13:42
mb112 pisze:
18 cze 2025, 0:55


Tak, zdecydowanie, żadnego AI. (-X
A książki powinny być tworzone/pisane ręcznie przez benedyktynów, a nie przez te piekielne maszyny z czcionkami, tak?
Co innego forma nanoszenia tekstu na papier, a co innego tworzenie samej treści. A chyba raczej każdy wolałby ksiażki pisane przez człowieka, niż generowane przez AI (co pewnie jeśli nawet nie teraz, to za jakiś czas będzie możliwe).

Awatar użytkownika
person
(geograf)
Posty: 9744
Rejestracja: 15 gru 2005, 2:45
Lokalizacja: z szafy

Post autor: person » 18 cze 2025, 14:19

Krzysztof_J pisze:
18 cze 2025, 14:09
A książki powinny być tworzone/pisane ręcznie przez benedyktynów, a nie przez te piekielne maszyny z czcionkami, tak?
Co innego forma nanoszenia tekstu na papier, a co innego tworzenie samej treści. A chyba raczej każdy wolałby ksiażki pisane przez człowieka, niż generowane przez AI (co pewnie jeśli nawet nie teraz, to za jakiś czas będzie możliwe).
Co jest treścią w zapowiedziach przystankowych?


BTW - "piekielne maszyny z czcionkami" to maszyny drukarskie/drukarki/inne powielacze...Czy one tworzą treść książek, które produkują?

fraktal
Posty: 5599
Rejestracja: 17 gru 2005, 12:03

Post autor: fraktal » 19 cze 2025, 7:55

person pisze:
18 cze 2025, 14:19
Krzysztof_J pisze:
18 cze 2025, 14:09

Co innego forma nanoszenia tekstu na papier, a co innego tworzenie samej treści. A chyba raczej każdy wolałby ksiażki pisane przez człowieka, niż generowane przez AI (co pewnie jeśli nawet nie teraz, to za jakiś czas będzie możliwe).
Co jest treścią w zapowiedziach przystankowych?


BTW - "piekielne maszyny z czcionkami" to maszyny drukarskie/drukarki/inne powielacze...Czy one tworzą treść książek, które produkują?
Lektor Jacek Brzostyński wyraził zgodę na wykorzystanie jego głosu przez AI i z dotychczasowych próbek nie wyszło to zbyt dobrze. Jedyne pozytywne próby z AI są wtedy, gdy zmienia się barwę głosu na inną jak to zrobiono w serialu "Rojst" gdzie na kwestie wypowiadane przez Filipa Pławiaka został nałożony przez AI głos młodego Fronczewskiego i brzmiało to dobrze. Podobnie ma być w dubbingu najnowszej części Shreka, gdzie prawdopodobnie na głos Macieja Stuhra zostanie nałożony przez AIgłos Jerzego Stuhra. Ale to trochę co innego niż generowanie zapowiedzi od początku do końca przez AI, bo te póki co nie dorównują ludzkim.

Choć ja już jestem w szoku, że chat gpt potrafi generować zdjęcia na podstawie opisu i wyglądają prawie tak jakby były naprawdę zrobione. Teraz się tym bawię i nie mogę wyjść z podziwu. W sensie, że nie są to rysunki a zdjęcia. Podobną funkcję ma Gemini, choć robi więcej pomyłek, a google już reklamuje się, że na pidstawie opisu tekstowego można robić klipy wideo z dźwiękiem. Ale ato wie, jak to będzie z zapowiedziami głosowymi za kilka lat.

Awatar użytkownika
Bastian
Sułtan Maroka
Posty: 36246
Rejestracja: 13 gru 2005, 14:08
Lokalizacja: Gdzieś tam na północy...

Post autor: Bastian » 20 cze 2025, 0:51

Przecież sociale są już zalane fejkowymi zdjęciami opuszczonych zamczysk tudzież na przykład filmami o marynarzach ratujących polarne niedźwiedzie czy też na odwrót. Ludzie ich przecież nie realizowali.
Honi soit qui mal y pense... Chemia teraz doszła do wspaniałych wyników. Robią wiewiórki z aminokwasów. Kir Bułyczow
Gdzieś tam może i jest prawda, ale kłamstwa tkwią w naszych głowach. Terry Pratchett
Darmowy ser znajduje się tylko w pułapkach na myszy. Kir Bułyczow

Awatar użytkownika
person
(geograf)
Posty: 9744
Rejestracja: 15 gru 2005, 2:45
Lokalizacja: z szafy

Post autor: person » 20 cze 2025, 10:05

fraktal pisze:
19 cze 2025, 7:55
Lektor Jacek Brzostyński wyraził zgodę na wykorzystanie jego głosu przez AI i z dotychczasowych próbek nie wyszło to zbyt dobrze.
To trzeba zmienić lektora.

Do znudzenia będę podawał przykład OeBB:
Our voice
So that everything works via loudspeakers, we have one voice: Chris Lohner – digitised. Our text-to-speech system converts continuous text into acoustic speech. Written text is broken down into its phonetic components and assembled into a digital audio file. Words are edited into an integrated dictionary and thus adapted to a uniform pronunciation throughout Austria. The information system also offers our operational staff a flexible way to quickly communicate any deviations from normal operations.
https://infrastruktur.oebb.at/en/compan ... nformation

A tu macie próbkę z YT. Można znaleźć tam inne nagrania:
https://www.youtube.com/watch?v=7vEl0AHOBBo
(ten delikatny, austriacki akcent <3)

Mam wrażenie, że krytykujący "głos z AI" mają chyba w głowie Ivonę i totalnie nie wiedzą o co w tym OBECNIE chodzi...

fraktal
Posty: 5599
Rejestracja: 17 gru 2005, 12:03

Post autor: fraktal » 20 cze 2025, 11:39

Bastian pisze:
20 cze 2025, 0:51
Przecież sociale są już zalane fejkowymi zdjęciami opuszczonych zamczysk tudzież na przykład filmami o marynarzach ratujących polarne niedźwiedzie czy też na odwrót. Ludzie ich przecież nie realizowali.
Ale do tej pory myślałem, że trzeba znać jakieś programy graficzne do obróbki obrazu, żeby z tego korzystać, przynajmniej podstawy, a nie, że sobie napiszesz zwykły tekst a program to zrobi zupełnie za Ciebie.

Co do samej dyskusji, to myślę, że Warszawę jednak stać, żeby wynająć lektora do zapowiedzi przystanków, a nie posiłkować się sztuczną inteligencją, zwłaszcza że zapowiedzi nagrane przez kogoś znanego mogą być same w sobie atrakcją.

Mnie się wydaje, że mimo wszystko potrafię odróżnić sztuczny głos od naturalnego pomimo wszystko. I na dziś wciąż wolę głosy naturalne.

Awatar użytkownika
person
(geograf)
Posty: 9744
Rejestracja: 15 gru 2005, 2:45
Lokalizacja: z szafy

Post autor: person » 20 cze 2025, 12:50

fraktal pisze:
20 cze 2025, 11:39

Ale do tej pory myślałem, że trzeba znać jakieś programy graficzne do obróbki obrazu, żeby z tego korzystać, przynajmniej podstawy, a nie, że sobie napiszesz zwykły tekst a program to zrobi zupełnie za Ciebie.
...i tu powinniśmy zakończyć, ale ja niestety muszę. Po raz ostatni.

W dyskusji o dźwiękach pochodzących bezpośrednio z krtani człowieka i tym wygenerowanym z próbek głosu danego lektora naprawdę nie chodzi o parcie do nowinek za wszelką cenę.
Chodzi o praktyczność - możliwość wygenerowania komunikatu z przygotowanych próbek jest od ręki. Nie trzeba czekać, nie trzeba robić nowego zamówienia (a jeszcze wpierw "uzbierać" nazwy, bo nikt dla dwóch nazw nie zrobi nagrania) itp. itd.
Pamiętacie jak MW stosunkowo niedawno chałupniczymi metodami zrobiło komunikat o przejściu górą między M1 i M2? No właśnie...
fraktal pisze:
20 cze 2025, 11:39
Mnie się wydaje, że mimo wszystko potrafię odróżnić sztuczny głos od naturalnego pomimo wszystko. I na dziś wciąż wolę głosy naturalne.
Przesłuchałeś zalinkowane przeze mnie jutjuby? To wszystkie jest wygenerowane. Rozpoznałeś w warunkach domowych, a nie na peronie stacji? Komunikat powinien być CZYTELNY. Dyskusja trochę zmierza w obronę "fizycznej gotówki" za wszelką cenę. Dla zasady....

Awatar użytkownika
primoż
Posty: 4157
Rejestracja: 24 gru 2010, 0:57
Lokalizacja: tenmiasto w tenkraju

Post autor: primoż » 20 cze 2025, 15:30

person pisze:
20 cze 2025, 10:05
Mam wrażenie, że krytykujący "głos z AI" mają chyba w głowie Ivonę i totalnie nie wiedzą o co w tym OBECNIE chodzi...
Najbardziej to maja w głowie niechęć przechodząca we wrogość wobec nowych rozwiązań. To jest to samo, co przy kursach skróconych, gdzie co raz są żądania, żeby to były osobne linie 4x/3xx/4xx/8xx, bo tak było od zawsze.
person pisze:
20 cze 2025, 12:50
Przesłuchałeś zalinkowane przeze mnie jutjuby? To wszystkie jest wygenerowane. Rozpoznałeś w warunkach domowych, a nie na peronie stacji?
To ja jeszcze zapodam taki filmik.

fraktal
Posty: 5599
Rejestracja: 17 gru 2005, 12:03

Post autor: fraktal » 20 cze 2025, 17:35

person pisze:
20 cze 2025, 12:50
fraktal pisze:
20 cze 2025, 11:39

Ale do tej pory myślałem, że trzeba znać jakieś programy graficzne do obróbki obrazu, żeby z tego korzystać, przynajmniej podstawy, a nie, że sobie napiszesz zwykły tekst a program to zrobi zupełnie za Ciebie.
...i tu powinniśmy zakończyć, ale ja niestety muszę. Po raz ostatni.

W dyskusji o dźwiękach pochodzących bezpośrednio z krtani człowieka i tym wygenerowanym z próbek głosu danego lektora naprawdę nie chodzi o parcie do nowinek za wszelką cenę.
Chodzi o praktyczność - możliwość wygenerowania komunikatu z przygotowanych próbek jest od ręki. Nie trzeba czekać, nie trzeba robić nowego zamówienia (a jeszcze wpierw "uzbierać" nazwy, bo nikt dla dwóch nazw nie zrobi nagrania) itp. itd.
Pamiętacie jak MW stosunkowo niedawno chałupniczymi metodami zrobiło komunikat o przejściu górą między M1 i M2? No właśnie...
A wiesz, że teraz wielu lektorów młodszego pokolenia ma swoje studia nagraniowe? Żeby nie trzeba było czekać kilka tygodni na nagranie, zresztą jeśli chcą być konkurencyjni dla AI... Pewnie Gudowski nie ma niestety, ale czy nie można na przykład dogadać się jakoś, żeby przy okazji, gdy nagrywa zapowiedzi audycji (bo nagrywa) dla Polskiego Radia, nagrał też kilka komunikatów? Młody Knapik zaś pracuje w telewizji i nagrywa offy. To chyba nie jest jakiś ogromny problem, chociaż tu nie mogę tego z całą pewnością powiedzieć...

Co do głosów AI, nie jestem jej przeciwnikiem, ale uważam, że na razie nie ma potrzeby z niej korzystać w sprawie zapowiedzi, choć w przyszłości nie można tego wykluczyć.

Awatar użytkownika
person
(geograf)
Posty: 9744
Rejestracja: 15 gru 2005, 2:45
Lokalizacja: z szafy

Post autor: person » 21 cze 2025, 9:57

primoż pisze:
20 cze 2025, 15:30
To ja jeszcze zapodam taki filmik.
Nie rozumiem związku :(
fraktal pisze:
20 cze 2025, 17:35
ale czy nie można na przykład dogadać się jakoś, żeby przy okazji,
Dogadać się? W instytucji publicznej? Przypominam, że to ZTM (urząd) byłby zamawiającym.

Awatar użytkownika
primoż
Posty: 4157
Rejestracja: 24 gru 2010, 0:57
Lokalizacja: tenmiasto w tenkraju

Post autor: primoż » 21 cze 2025, 15:03

person pisze:
21 cze 2025, 9:57
Nie rozumiem związku :(
No taki związek, że część materiału wygenerowanego przez AI nie musi różnić się zbytnio, czy wręcz wcale, od nagranego normlanie. Tylko po prostu nie zostało to użyte do rzeczy związanych z transportem.

ODPOWIEDZ