Prikaz projekta CESAR 
Tamaš Varadi* Institut za lingvistička istraživanja, Mađarska akademija nauka 
Kratki članak koji sledi pružiće prikaz nedavno pokrenutog saradničkog napora finansiranog iz fondova Evropske unije, da se jezički resursi i alati regiona Centralne i Jugoistočne Evrope poboljšaju i prošire, i da postanu dostupni u lingvističkoj infrastrukturi otvorenog tipa. 
Dalekosežni ciljevi ovog projekta valjalo bi da se sagledaju u kontekstu lingvističkih izazova koje sa sobom nosi globalizovana digitalna komunikacija modernog doba. 
Mnogi evropski jezici suočavaju se sa rizikom da postanu žrtve digitalnog doba budući da nisu u dovoljnoj meri predstavljeni ili resursno zastupljeni onlajn. 
Ogromne mogućnosti regionalnog tržišta ostaju i dalje neiskorišćene usled jezičkih barijera. 
Ukoliko sada ne preduzmemo akciju, sama činjenica da govore svojim maternjim jezikom postaće socijalni i ekonomski nedostatak za mnoge evropske građane. 
Inovativna multilingvalna jezička tehnologija jeste najsavremeniji posrednik koji može pomoći svim građanima Evrope da sudeluju u jednakom i pravičnom, inkluzivnom i ekonomski uspešnom društvu znanja i informacija. 
Jezička tehnologija može biti zamajac trenutne, jeftine komunikacije i interakcije bez napora koja prevazilazi jezičke barijere. 
Od prepoznavanja govora i automatskog sumiranja teksta do iskopavanja iz teksta i mašinskog prevođenja jezička tehnologija nudi sve šire perspektive. 
Svi ovi izvanredni alati i tehnologije rade uz pomoć podataka, 
a tih podataka treba da bude što više i oni treba da budu integrisani sa lingvističkim podacima u formi anotacija. 
Ova dodatna vrednost je ono što podatke pretvara u dragocene resurse - jezičke resurse. 
Projekat CESAR (eng. - Central and South-east European Resources - Resursi Centralne i Jugoistočne Evrope) ima cilj da doprinese razmeni digitalnih resursa širom Evrope putem prikupljanja resursa i njihovog dokumentovanja, povezivanja i nadgradnje kako bi bili u skladu sa opšteprihvaćenim standardima i smernicama. 
Projekat će biti dostupan u vidu jasno profilisanog skupa jezičkih resursa i alata na bugarskom, mađarskom, poljskom, slovačkom, srpskom, i hrvatskom jeziku. 
Ti resursi podrazumevaće interoperabilne jednojezične i višejezične međusobno povezive govorne i pisane baze podataka, korpuse, rečnike i mreže reči (wordnet), kao i sledeće alate: tokenizatore, lematizatore, tagere i parsere. 
Projekat CESAR deo je šire mreže izvrsnosti nazvane META-NET koju finansira Evropska unija. 
Ona se trenutno sastoji od 44 člana, koji predstavljaju 31 evropsku zemlju. 
META-NET sarađuje sa desetak drugih velikih inicijativa, kao što je CLARIN, koji pruža podršku društvenim naukama da u Evropi uspostave novo polje delovanja - Digitalne humanističke nauke. 
META-NET je posvećen ostvarivanju tehnoloških osnova za uspostavljanje i održavanje pravog višejezičnog evropskog informacionog društva koje - omogućava komunikaciju i saradnju na više jezika, - obezbeđuje jednak pristup informacijama i znanju svim korisnicima na njihovom maternjem jeziku, - nudi napredne mogućnosti umrežene informacione tehnologije svim građanima po pristupačnim cenama. 
Misija META-NET-a je da doprinese da izgradnja višejezičnog evropskog digitalnog informacionog prostora postigne uspeh poput pisane kulture nakon Gutenberga. 
CESAR aktivno sarađuje sa drugim partnerskim projektima u okviru META-NET-a radi izgradnje konzistennog pristupa, prakse i standarda koji osiguravaju širi i lakši pristup i ponovnu upotrebu kvalitetnih jezičkih resursa.  
Projekat CESAR teži da podstakne komunikaciju zasnovanu na informaciono-komunikacionim tehnologijama, saradnju i učešće na različitim jezicima i time da doprinese kreiranju jedinstvenog digitalnog tržišta širom Evrope. 
Jedan od osnovnih ciljeva projekta jeste da premosti tehnološki jaz koji postoji između regiona Centralne i Jugoistočne Evrope i ostalih delova Evrope tako što teži da popuni očigledne i značajne praznine koje se tiču infrastrukturnih jezičkih resursa i alata. 
Informaciono-komunikaciona istraživanja u ovim zemljama otpočela su sa značajnim zaostatkom u odnosu na zemlje Zapadne Evrope. 
Jezička tehnologija razvijala se u svim ovim zemljama nezavisno, odnosno uz nacionalnu podršku kako na akademskom nivou tako i u okviru privatnog sektora. 
Ali kao posledica toga, razvijeni resursi često odslikavaju izolovane okolnosti svog nastanka, i nisu uvek u skladu sa standardima. 
Glavni akteri informaciono-komunikacionih istraživanja su u svakom slučaju sada spremni da obnove saradnju među ključnim tehnološkim partnerima u regionu, i da integrišu nacionalne resurse na višem nivou kako bi ih učinili dostupnijim i upotrebljivijim, čineći ih dostupnim široj zajednici jezičkih tehnologija i ubrzavajući obezbeđivanje višejezičnih onlajn servisa. 
U tom cilju, svi postojeći resursi biće objedinjeni i unapređeni tako da budu u skladu sa široko prihvaćenim standardima i društvenom praksom. 
Ključni resursi koje pokriva projekat CESAR će se povezati i postaće upotrebljiviji korišćenjem META-RAZMENA (META-SHARE) rapozitorijuma. 
META-RAZMENA teži da izgradi infrastrukturu za razmenu podataka otvorenog tipa. 
Ciljna zajednica korisnika praktično obuhvata one koji imaju udela u modernom digitalnom tržištu: svakodnevne krajnje korisnike, profesionalne krajnje korisnike (u privredi, administraciji, medijima, obrazovanju, bibliotekama, itd) kao i stručnjake (istraživače, industrijalce, donosioce odluka, itd). 
To podrazumeva pažljivo ispitivanje potreba različitih tipova korisnika - od pojedinačnih korisnika do velikih multinacionalnih organizacija - kako iz perspektive trenutnog stanja tako i sa stanovišta tendencija u neposrednoj budućnosti.  
Projekat CESAR doprineće META-RAZMENI svojim dragocenim resursima, što će u krajnjem ishodu biti značajna komponenta tržišta jezičke tehnologije za istraživače i razvojne inžinjere u oblasti tehnologija prirodnih jezika, jezičke stručnjake (prevodioce, eksperte za lokalizaciju softvera i sadržaja, itd), kao i za velike industrijske igrače, a naročito mala i srednja preduzeća, obezbeđujući im kompletan razvojni ciklus tehnologije prirodnih jezika, od faze istraživanja do inovativnih proizvoda i usluga.  
Jedan od glavnih ciljeva projekta CESAR jeste da pokrene na delovanje nacionalne i regionalne aktere, javna tela i agencije za finansiranje projekata, tako što će organizovati skupove i druga tematska događanja. 
Jedan takav događaj je konferencija "META-Forum 2011 - Rešenja za višejezičnu Evropu", koja je održana u Budimpešti krajem juna. 
To je zvanični događaj Mađarskog predsedavanja Savetom Evropske unije. 
U okviru konferencije je održano nekoliko sesija o evropskoj industriji jezičkih tehnologija i o višejezičnim jezičkim tehnologijama u evropskim institucijama, kao i panel-diskusija o višejezičnom informatičkom društvu, dok su pozvana predavanja održali predstavnici Google-a i IBM-a. 
Više informacija o ovom događaju dostupno je na http://www.meta-net.eu/events/meta-forum-2011/index_html. 
Ciljevi projekta CESAR su usaglašeni sa META-NET-om koji treba da obezbedi materijal koji opisuje nacionalnu scenu zemalja-učesnica. 
Tako je nastao zbornik belih knjiga META-NET-a, "Jezici u evropskom informatičkom društvu", koji daje uvid u stanje svakog evropskog jezika u odnosu prema jezičkim tehnologijama i objašnjava najveće rizike i mogućnosti.  
Zbornik pokriva sve zvanične evropske jezike. 
Iako su do sada objavljeni mnogi značajni i sveobuhvatni naučni prikazi određenih aspekata pojedinačnih jezika i njima dostupne jezičke tehnologije, još uvek ne postoji opšte prihvaćen pregled koji bi sumirao sva glavna saznanja i izazove za sve jezike zajedno. 
Zbornik belih knjiga META-NET-a ima cilj da popuni tu prazninu, 
a njegova štampana verzija bila je prvi put podeljena učesnicima na META-Forumu u Budimpešti.  
Projekat je počeo 1. februara 2011. i traje dve godine. 
Očekuje se da resursi budu objavljeni u tri paketa. 
Prvi će se pojaviti u decembru 2011, a nakon njega uslediće još jedan u julu 2012. i konačno jedan januara 2013. 
Članovi konzorcijuma projekta su: - Institut za lingvistička istraživanja, Mađarska akademija nauka (Mađarska) - Tehnološki univerzitet u Budimpešti ( Mađarska ) - Univerzitet u Zagrebu, Filozofski fakultet (Hrvatska) - Institut za računarstvo, Poljska akademija nauka (Poljska) - Univerzitet u Lodžu (Poljska) - Matematički fakultet, Univerzitet u Beogradu (Srbija) - Institut Mihajlo Pupin (Srbija) - Institut za bugarski jezik (Bugarska) - Institut za lingvistiku L. štur (Slovačka) 
Koordinator konzorcijuma je Tamaš Varadi iz Instituta za lingvistička istraživanja Mađarske akademije nauka. 
