Zapri oglas

Predstavljajte si, da se pogovarjate z neznancem, vendar namesto robotskega glasu iz mobilnega telefona slišite tekoč prevod neposredno v slušalki. Še več, z intonacijo in glasom izvirnega govorca. Google prevajalnik je pravkar predstavil tehnologijo, ki bo dokončno odpravila jezikovne ovire. Strojno prevajanje pri Googlu letos praznuje dvajseto obletnico, podjetje pa se ponaša s tem, da njegovi izdelki zdaj prevedejo več kot bilijon besed na mesec. Novo audio Model Gemini Cilj programa 3.5 Live Translate je dvigniti celotno disciplino na višjo raven. Pozabite na tradicionalno prevajanje besedil in neroden koncept, da morate izgovoriti stavek, počakati, da se obdela, in nato predvajati rezultat. Google se premika k brezhibnemu simultanemu tolmačenju, kakršnega poznamo pri profesionalcih.

Novi model lahko prevaja govorjeni jezik praktično v realnem času, v več kot 70 jezikih. Za razliko od starejših rešitev ne čaka, da govorec konča z govorom. Prevaja neprekinjeno, tako da za govorcem ostane le nekaj sekund, hkrati pa ohranja njegovo intonacijo, tempo in višino tona. Nastali prevod preprosto zveni kot izvirni govorec. Ključna inovacija je neprekinjeno generiranje govora. Model nenehno inteligentno uravnoteži, ali naj čaka na dodaten kontekst (in s tem izboljša kakovost prevoda) ali pa naj prevaja takoj in sledi govorcu. Rezultat je tekoč govor brez nenaravnih premorov. Poleg tega ni treba ročno nastavljati jezika. Model sam zazna več kot 70 jezikov in se zlahka spopade z večjezičnimi pogovori ali hrupnim okoljem.

V novem »načinu poslušanja« preprosto prislonite telefon k ušesu, kot da bi se z nekom pogovarjali po telefonu. Prevod lahko nato diskretno slišite neposredno iz slušalke telefona, kar popolnoma spremeni dinamiko osebne komunikacije v tujem okolju. Nič več držanja roke z zaslonom pred obrazom neznanca. Nova funkcija bo postopoma uvedena v video klice v Google meetPrevajanje govora bo tja najprej na voljo kot del zasebnega testiranja za izbrane poslovne stranke Google Workspace, Google pa obljublja širšo uporabo pozneje letos. Model je razvijalcem na voljo prek Gemini Live API. Med prvimi, ki ga testirajo, je na primer azijska prometna platforma Grab za komunikacijo med vozniki in potniki – samo prek njene aplikacije se mesečno opravi več kot 10 milijonov glasovnih klicev. Vodstvo platforme hvali predvsem samodejno zaznavanje jezika in izjemno nizko zakasnitev.

Tehnologija, ki lahko govori tuji jezik z vašim lastnim glasom, je seveda dvorezen meč. Da bi preprečili širjenje ponaredkov in dezinformacij, ima ves zvok, ki ga ustvari model, neslišni digitalni vodni žig, imenovan SynthID. To omogoča zanesljivo prepoznavanje vsebine z umetno inteligenco v prihodnosti. S tem korakom Google znatno krepi svojo konkurenčno prednost. Apple pred kratkim stavil na prevajanje v živo v AirPodech in Samsung množično vgrajujeta svoj interpreter umetne inteligence neposredno v svoje telefone GalaxyVendar pa novi izdelek Googla deluje odlično s češčino in slovaščino, kakovost prevoda pa je po naših prvih testih vrhunska. Proizvajalci strojnih prevajalnikov za en namen bodo imeli vse težje delo.

Kako takoj aktivirati funkcijo?

  • Posodobite aplikacijo Google Prevajalnik v trgovini z aplikacijami (Google Play / App Store).
  • Ko odprete aplikacijo, tapnite ikono »Pogovori«.
  • Izberite nov element »Poslušanje« in kliknite »Začni«.
  • Prislonite telefon k ušesu in začnite poslušati.chat okolici.

Glede na naše prve uredniške teste funkcija deluje zelo zanesljivo in presenetljivo zvesto posnema glasove izvirnih govorcev. Kaj menite o tej znanstvenofantastični novosti? Delite z nami v razpravi.

Danes najbolj brano

.