3.062.850 DOKUMENTU TOPATU DITUT

  • Bilatzaileek ahalegin handia egin arren, nahi ditugun web-orriak aurkitzea ez da erraza izaten. Bilaketa egiteko eskatu eta lortutako web-orri zerrendak oso luzeak izaten dira, asko ez dira gure beharretara egokitzen, batzuk abandonatutakoak dira...
Interneten zerbait aurkitu nahi dugunean bilatzaileak erabiltzera jotzen dugu. Nahi adina bilatzaile ditugu eskueran eta askotan zaila izaten da bata eta bestearen arteko ezaugarriak bereiztea. Bilatzaileak datu-base edo informazio-base erraldoietan oinarritzen dira eta hauek etenik gabe automatikoki elikatzen aritzen dira; oro har, elikatzeko bidea robot bilatzailearena izaten da, hauek web-ean argitaratzen dena automatikoki detektatu, indexatu eta indizeak basera kargatzen dituztelarik. Elikatzeko erabiltzen den beste bideetako bat web-orrien kudeatzaileek, interesgarri deritzoten bilatzaileetan, eskuz alta ematearena izaten da.
Interneten egunero hainbat eta hainbat web-orri berri sortzen da eta beraz web-orrien kopurua etenik gabe hazten ari da. Aldi berean badago hazkunde esponentziala duen beste prozesu bat, hots, web-orrien desagerketarena edo abandonaketarena; web-orria desagertzen denean, gehienetan erreferentzia ez da bilatzaileen datu-baseetan ezabatzen eta ondorioz, erreferentzia horren gainean klik egitean desagerpen-abisua edo errore-mezua azaltzen zaigu; web-orrien abandonaketa da, ezbairik gabe, Interneten gehien hedatu den gaixotasuna eta horren froga erraz topa dezakegu edozein bilaketa egin ondoren aurkitutako orriaren eguneraketa-data ikusiz. Honen harira esan, oso ohikoa izaten dela enpresek edo partikularrek web-orriak diseinatzea, Interneten kokatzea eta ahaztea, hau da, Interneten banago eta egin beharrekoa egin dut pentsatzea. Jokatzeko era honek Internetekiko plan estrategikorik ez izatea erakusten du eta hau askorentzat Internet moda baino ez delako gertatzen da.
Beraz, Interneten informazio-posibilitateak zabaltzen doazen neurrian, lastrea ere handituz doa; horregatik gero eta korapilotsuagoa da buruan dugun kontzeptua zehaztasunez eta kalitatez, nolabait esatearren, lortzea.
Kasurik onenean ere, hau da, lastrea alde batera utzita, milaka edo milioika erreferentzia dituen emaitzarekin topo egitea nahikoa arrunta da. Adibidez, artikulu honen izenburuko zenbakia dugu, hau "cat" hitza Altavista bilatzailean idatzi ondoren ateratako emaitza baita.


NOIZ TOPATUKO DUT BEHAR DUDANA?

Halere, oraindik Interneten nahi duguna aurki dezakegu, gehiago edo gutxiago kostata, baina informazio-bilatzaileak gero eta kezkatuago daude arestian aipatu arazoekin. Zer egin, bada, egoera horren aurrean?
Orrien desagerketaren edo abandonaketaren aurrean robot bilatzaile gero eta ahalmentsuagoak garatzen ari dira. Hauek, orriak desagertzean edo abandonatzean, detektatu eta datu-basean erreferentzia ezabatzeko posibilitatea izan behar dute. Garbiketa-prozesuak etenik gabekoa izan behar du eta nahiz eta ez lortu informazio-basea %100 eguneratuta mantentzea, eskaintzen dena kalitate minimo batekin eskainiko da.
Dena den, arazo larrienak, buruan dugun kontzeptua ahalik eta fidagarritasun gehienez bilatzea, izaten segituko du. Orain arteko bilatzaile gehienek hitzak edota hauen arteko elkarketak erabiltzen dituzte bilaketarako oinarri gisa eta gainera bilaketa, hitza idatzi dugun lengoaian bakarrik burutzen da. Hau da, "etxe" hitza dituzten testuak eskuratu nahi baditugu, ez zaizkigu "maison", "casa" edo "house" dituzten testuak azalduko. Gainera buruan dugun kontzeptuak adierazteko ez da nahikoa hitzen arteko elkarketa hutsa egitea, baizik eta esaldiak, perpausak edo parrafoak dira kontzeptu horiek adierazteko bide naturalena. Adibidez, "New Yorkeko burtsen gorabeherak" azaltzen dituen informazioa bilatzeko ez da nahikoa "New York" eta "burtsa" eta "gorabehera" hitzak elkartzea, baizik eta sistemak nolabait ulertu beharko luke indize ekonomiko zehatz baten bilakaerari buruzko informazioa eskatzen zaiola.
Munduan dauden bilatzaileen oinarri edo justifikazio teknologikoa hizkuntzekin erabat loturik doa eta horrela, teknologian zabalduen dagoen hizkuntza ingelesa denez, berau da bilatzaile gehienen motorra. Motor honek euskararen gisako hizkuntza deribatiboetan neurri batean baino ez du balio, kontuan hartu behar baita ingelesezko hitzek oso forma eratorri gutxi dituztela eta aldiz, euskal hitz bakoitzari nahi adina atzizki erants dakiokeela.
Ildo honetan Euskal Herrian garatzen ari den informazio-teknologiak, euskara euskarri gisa duen neurrian, atzerriko bilatzaileen teknologiarekin desberdintasun nabarmenak ditu. Batez ere, bi dira euskararen ezaugarriak kontuan hartuz bilatzaileak eta hizkuntzaren teknologia oro har, garatzen ari diren ikerketa-taldeak, Ametzagaiña Taldea eta IXA Taldea. Nahiz eta bi taldeok ikerketarako teknologia desberdinak erabili, lortutako bilatzaileek hitzen lema dute oinarritzat, hau da hitzei itxura kendu eta erroa hartzen da bilaketa-tresna gisa.


AMETZAGAIÑA.

Ametzagaiña Taldeak hizkuntzaren ingeniaritzan hasieratik orain arte egindako bideak helburu nagusi bat duela esan daiteke, eta hau, sistema informatikoak esaldiak ulertzea da. Ildo honetan, Kapsula deituriko produktu teknologikoa sortu du eta honek hitzen lematizazio automatikoa egiten duenean, automatikoki jasotzen diren hainbat datu gaur indarrean duten bilaketa-sistemarako beharrezkoak ez badira ere, laster helduko zaion analisi semantikoan garrantzi berezia izango dute. Hortaz, euren tresna eta teknologiak prozesu ebolutibo jarraian kokatu dituzte eta bilatzaileak hasieran oso esaldi sinpleak baino ulertuko ez baditu ere, prozesu geldiezin horretan esaldi gero eta konplexuagoak eta beste hizkuntza batzuetan idatzitakoak ere ulertzen joango da.
Ildo honetan, Kapsularen robot web-bilatzaileak, urte honen bukaerarako baliabide garrantzitsu bat izango du, hots, web-orrietan eskuratutako informazioaren katalogazioa automatikoki egitearena. Lehen unean baliabide hau euskarazko informazioarentzat soilik izango da, baina datorren urtean zehar gure kulturan eragina duten hizkuntzentzat ere inplementatzen hasiko da. Honela Kapsula sisteman oinarritutako bilatzaileek, berme teknologikoa eskainiko die bai sistemetako administratzaileei, baita erabiltzaileei ere; batzuek informazioa lortzeko eta antolatzeko tresnak izango dituzten bitartean, besteek kontsulta gero eta zehatzagoak egiterik izango dute.


IXA TALDEA.

IXA taldeak jorratu eta jorratzen dituen ikerketa-lerro nagusiak hiru arlotan bana daitezke erabilgarritasunari begira: oinarriak, tresnak eta aplikazioak. Lehenari dagokionez, oinarrizko tresna linguistikoak ikertzen dituzte, hala nola, datu-base lexikala, testu-bildumak eta hauek prozesatzeko tresnak. Tresnei dagokienez, aplikazioak egiteko erabiltzen diren tresna orokorrak honakoak dira: lematizatzailea, analizatzaile sintaktikoa, desanbiguatzaile semantikoa eta abar. Ixa taldeak edota beste enpresek erabiltzeko aplikazioak zuzentzaile ortografikoa, estilo zuzentzailea, Web bilatzaileak eta hiztegi adimendunak dira batik bat.
Iñaki Alegria Ixa taldeko kideak adierazi digunez, "unibertsitatean gaudenez lehen bi arloak dira inportanteenak guretzako. Aplikazioak hutsuneak betetzeko edo enpresekin lankidetzan garatzen ditugu. Horrela Xuxen Hizkia eta Uzeirekin lankidetzan garatu da eta Web bilatzailea Plazaguneak garatu du guk garatutako zenbait teknologia integratuz".
Ixa taldeak garatu duen bilatzaileak lematizazio bidez bilatzen du euskarazko testuetan, baina talde kideek zaila ikusten dute beste hizkuntzetarako baliatzea.
Garatzen duten aplikazioetan ezagumendu linguistikoa oso garrantzitsua da eta hori euskararako garatu da. Prestatutako programek, batzuetan, aukera ematen dute beste hizkuntzetan aplikatzeko baina hizkuntza horietarako ezagumendu linguistikoarekin osatu beharko litzateke. Alegriaren ustez, "gure lana baino gurekin aritzen diren enpresen lana dela esango nuke gure teknologia beste hizkuntzetarako baliatzea".


GIZARTERATZEA ETA KOMERTZIALIZAZIOA.

Ixa taldea unibertsitateko irakasleek osatzen dutenez, produktuen gizarteratzea edo komertzializazioa enpresen bidez garatu nahi dute. Beraien ideala da enpresekin elkarlanean aritzea eta enpresen lana litzateke komertzializazioa. Enpresarik ez badago horretan interesaturik taldeak berak merkaturatzen du baina salbuespen gisa. Alegriak dioenez, tresna horiek garatzea garestia izaten da, eta euskararen inguruko merkatu txikiak enpresei ez interesatzea eragiten du, laguntza publikorik ez badago behinik behin.
Euskarak eta euskal gizarteak ingeniaritza linguistikoaren alorrean dituen premia gisa segidakoak irizten ditu Iñaki Alegriak.
Oinarriak eta tresna orokorrak garatzen dituzten neurrian horretan sentitzen dute behar handiena: Erreferentzia-corpus zabal, landu eta publiko bat, analizatzaile morfologiko, sintaktiko eta semantiko orokorrak eta horiek eraiki ahal izateko hainbat lan linguistiko sakon: euskararen sare semantikoa, aditzaren azpikategorizazio osoa... Hori eginda aplikazioak garatzea askoz errazagoa omen da. Aplikazioen munduan erabiltzaileek agintzen dutela dio Alegriak "baina hona hemen datorren urtetan garatu beharko diren batzuk: itzulpenerako laguntzak, terminologia lantzeko tresnak, estilo-zuzentzailea eta euskara ikasteko sistema aditua". Hau guztia testuen gainean, ahotsarekin sartuz gero beste hainbat behar dago eta beste talde batzuk daude horretan lanean.
Ixa taldeak garatu duen Xuxen zuzentzaile ortografikoari dagokionez, hil honetan Euskaltzaindiaren azken arauak jasotzen dituen bertsioa aterako da, azaro-abenduan Mac-erako bertsioa eta 2001eko hasieran Xuxen3 zenbait berrikuntzarekin.


Azkenak
José Manuel Uriagereka. Frantziskotarra Hego Korean
“Koreara joan ginenok euskara ederto kontserbatu dugu”

Bermeon jaioa, frantziskotar eginik Hego Korean egin zuen bizimodurik gehiena, 40 urte. Sasoi batean mutil-koskorretan askok egin zuena egin zuen, komentura bidea hartu. Gero, handik mundura jauzi egin zuen Uriagerekak, bestelako hizkuntza eta kultura arrotzetara.


Bilagailuen urrutiko leherketa masiboa
Milaka zauritu eta hamabi hildako Libanon, Israeli leporatu dioten atentatu indiskriminatuan

Israelek lehergailuak jarri zituen Hezbollahk inportatutako milaka bilagailutan, Reuters agentziak kontsultatutako iturrien arabera. Urriaren 7tik jasandako “segurtasun haustura handiena” izan da, talde armatuaren hitzetan. Erantzun bortitza hitzeman du Hezbollahk,... [+]


2024-09-18 | Jon Alonso
Bosgarren zutabea

Erribera, historian, sekula euskalduna izan ote den; horra hor Nafarroan, duela berrogei urtetik hona, hainbestean behin errepikatzen den eztabaida bizantziarra (eztabaida bizantziarra: eztabaida alferrekoa, zeinean alde bakoitzak ezin baitizkio frogatu bere baieztapenak beste... [+]


2024-09-18 | Castillo Suárez
Aldairak

Etxez aldatzen naizenean, edo, areago, norbait etxetik joaten denean, oroiminak hartzen dizkit burua eta bihotza. Orduan hasten naiz zer gordeko dudan eta zer ez erabakitzen saiatzen. Izan ere, objektu guztiek lotzen gaituzte zerbaitetara, edo norbait ekartzen digute gogora;... [+]


Lurraren altxamenduak

Estatu poliziala kanpora! Abesten dute negar-gasen leherketen artetik. Gaztetxo konprometituak, amatxi militanteak, aurpegi estaliak, edo ez, pailazoak, musikariak, sindikalistak eta politikariak, kaskodun medikuak, laborariak traktore gainean... Landa-eremuan zein hirian,... [+]


Palestinak munduari dakarkiona

Ezaguna da enpresa frantses batzuek (Thales, Airbus, Dassault) aspalditik laguntzen dutela Israel haren ekipamendu militarra osatzen. Disclose elkartearen inkesta baten arabera, berriz, Frantziako Gobernuak berak hornitu dizkio osagai elektronikoak Israeli, Gazako zibilak... [+]


Pentsamendu askeak

Gauzak ez dira horrela, gauzak horrelaxe daude. Esaldi hori iltzaturik geratu zitzaidan Gorka Urbizuren diskoa osorik eta patxadaz entzun nuenean. Uste nuen aurkikuntza itzela egin nuela identifikazio horrekin, inozentea ni! Gerora ohartu naiz, merchandising-erako leloa izateaz... [+]


Indarkeria, endogamia eta baztanga Trebiñun

Trebiñu, VI. mendea. Eremita talde bat Las Gobas kobazuloetan bizitzen hasi zen, eta historiaurretik okupatutako Laño ibaiaren haitzarte hartan kobazulo berriak hondeatu zituzten. Hurrengo mendean kobazuloetako bat nekropoli modura erabiltzen hasi zen bertako... [+]


Teknologia
Mundu ikuskerAA

Gizakiontzat ez da inoiz erraza izan lasai pentsatzeko denbora tarte luzeak hartzea, bizimodua aurrera ateratzearen ardurarekin bizi gara, bai geurea zein geure ondorengoena. Bizitzeko izan dugun aukera honetan, ahalik eta ongien nahi ditugu gauzak egin. Ardura horiengatik,... [+]


2024-09-18 | Estitxu Eizagirre
Haziak eta etorkizuneko auziak

Haziak nola egin azaltzen duen jakintza praktikoa eta hazietan datzan ikuspegi politikoa. Biak uztartu dituzte Haziak liburuan Miguel Arribas Kelo-k eta Marc Badal-ek. Hamaika auzi baitaude jokoan hazi bakoitzean: biodibertsitatea vs estandarizazioa, autonomia vs menpekotasun... [+]


“Migratzaileak autoan hartu eta Polizia egon zitekeen errepideak saihestuta eramaten nituen”

Pertsona migratzaile asko eraman ditu Aritzek bere autoan, Poliziak ez ditzan harrapatu, gaueko iluntasunean ez daitezen galdu eta batetik bestera seguru ibili daitezen. Bereziki gogoan ditu Irundik Hendaiara muga gurutzatzen lagundu eta etxean lotan izan zituen emakumea eta... [+]


Ziga (Baztan)
Herri baten sorrera, eskalaz eskala

Zer da herri bat? Galdera horrek oso erantzun desberdinak izan ditzake alderdi materialari edo inmaterialari begiratuz gero: eraikin zein etxeei, edo komunitateari zein elkarbizitza arautzeko moduari. Baina herriek ingurumenari eta lanari estuki loturiko iragan bat dute, eta... [+]


Eguneraketa berriak daude