Euskal agenteek garatutako baliabideak utziko dizkio Jaurlaritzak Scansofti
2003-12-16 12:12
Hitzarmenaren arabera, euskarazko sintesiaren motorra (euskarazko testua ahots bihurtzeko teknologia) eta ahotsaren ezagutza (ahotsa testu bihurtzeko teknologia) sortuko dituzte. Proiektuak 18 hilabeteko iraupena eta 706.000 euroko aurrekontua du.
Hiru euskal agentek garatuko dituzte baliabideak
- Testu corpus elektronikoa, ASP enpresak egingo duen 25 milioi hitzeko bilduma.
- Oinarrizko lexiko fonetikoa. Gehien erabiltzen diren hitz, laburdura eta akronimoen 60.000 sarrera baino gehiagoko hitz, laburdura eta akronimoen bilduma izango da. Hitzek transkripzio fonetikoa eta gramatikala izango dituzte eta Eleka enpresak egingo du.
- Telefoniako datu base akustikoa ere egingo dute: hainbat grabazio egingo dituzte telefonoa erabiliz. EHUko Aholab taldeak egingo du. Bestalde, EHUko Zientzia eta Teknologia fakultateak beste datu base akustikoa egingo du, bulegoetan egindako grabazioen bitartez.
Joan den azaroaren 21ean eman genuen Sustatun Eusko Jaurlaritzak Scansoft enpresarekin lortutako hitzarmenaren berri.
Erantzunak kargatzen...