2013. február 3.

PhiLang 2013

Az a megtiszteltetés ért, hogy a PhiLang 2013 szervezői elfogadták Compositional and Distributional Theories of Meaning című absztraktomat. A Precognox keretein belül igyekszünk a modern gépi tanulás és a szemantikus web technikáit ötvözni. Aki belekóstolt már ebbe, az tudja mennyire bonyolult is ez, hiszen két, már-már ellentétes elméleti keretben kell egyszerre gondolkodni az ilyen projektek során. Ahogyan már egy korábbi posztomban is kifejtettem, valahogy érezzük hogy ez nincs rendben és egyre többen fordulunk a Widdows és Coecke által lefektetett átfogó modellekhez. A PhiLang remek alkalom arra, hogy bemutassam miképp is gondoltam tovább ezt a kérdést és a téma szakértőitől kapjak visszajelzést. A közeljövőben az ezzel kapcsolatos gyakorlati eredmények bemutatására is törekedni fogok, amint elfogadható állapotba kerül a jelenlegi spagetti kód jellegű implementációm. A konferencia után egy rövid posztban természetesen közzé fogom tenni előadásom főbb pontjait, addig azonban nem szeretném ellőni a puskaporomat.

2013. január 31.

Természetes nyelvi keresés, mobil és Graph Search

Mit tud és mit nem tud ma a Graph Search?
Graph Search can search the people, places, interests, and photos in your social network—but it can’t yet search status updates, comments, or Facebook’s Open Graph. [bővebben]
Milyen is lenne, ha ezeket tudná? [részletesebben a Kereső Világon]
Wonder by Yandex Labs from Maxim Grinev on Vimeo.

A Facebook mobilcéggé vált
A mobil platformokról bejelentkezők (havi 680 millió felhasználó, ebből 157 millió kizárólag mobilról jelentkezik be) száma óriásit nőtt, rájuk utalt Zuckerberg azzal, hogy mobilos céggé vált a Facebook. Na meg arra, hogy a hirdetési bevétel 23 százalékát a mobilos Facebook-verziókban megjelenő reklámok termelték, ami óriási szám ahhoz képest, hogy tavaly ilyenkor a mobilos Facebookon még egyáltalán nem is voltak reklámok. [bővebben]
Csak valahogy nem tud mit kezdeni evvel. Égető szüksége van mindenkinek arra, hogy a mobil keretei között fogalmazza újra az internetet. Az én szememben a Graph Search is egy kísérlet erre. Dicséretes hogy alapos nyelvészeti és pszichológiai vizsgálatokkal alakították ki a természetes nyelvi keresést. A korlátozott tesztüzem tapasztalataira alapozva bizonyosan valami nagyon jó fog ebből kisülni. Érdekes, hogy az Open Graph-ot használó Wonder-t mit konkurens eltiltották az API használatától.

Mindeközben a nyelvtechnológia
A Wonder a ma már mindenki számára elérhető Nuance beszédfelismerő API-t használja. Ennek segítségével egyszerűen, különösebb beszédtechnológiai szakértelem nélkül ma már fel lehet ruházni hangvezérléssel egy mobil alkalmazást. Az Open Graph, vagy éppen más linked data adatbázisok természetes nyelvi lekérdezése is megoldható a quepy framework-höz hasonló eszközökkel napjainkban. A Yandex ráérzett arra, hogyan is kell működni a közösségi média és a mobil korában egy keresőnek, a Facebook - habár mobilcéggé vált - még nem.

2013. január 30.

Whispersync for Voice

Tavaly szeptemberben indította be az Amazon a Whispersync for Voice szolgáltatást, ami szerintem minden rendes olvasó ember számára a világ egyik legjobb dolga. A The Economist kapcsán már megemlékeztünk arról, hogy sajnos egyre kevesebb idő jut az olvasásra, remek ötlet ha a tartalmat más módon is fogyaszthatjuk. Az Amazon eddig is szinkronizálta eszközeink között, hogy hol tartunk az adott szövegben, a Whispersync for Voice segítségével viszont lehetőségünk van váltogatni a kétféle modalitás között is!
Persze mindennek ára van! A hangos verziót meg kell venni az Audible áruházában, nem kapjuk meg az írott verzióval ingyen mint a The Economist esetében. Ellenben az ár bizonyos esetekben megéri. Itt nem a szép- és szórakoztatóirodalomra gondolok. Akadnak ismeretterjesztő és tényirodalomi és egyéb non-fiction címek is szép számmal a katalógusban. Ha szeretnénk naprakészek lenni, de állandóan harcolunk az idővel, nagyon jól jön ez a szolgáltatás! Eddigi tapasztalataim szerint a holtidő kihasználásával kb. fele/harmad időbe telik egy könyv "elfogyasztása".

A Kindle Fire tulajok pedig olvasás közben szimultán hallgathatják is a könyvet, ami számomra nagyon idegen élmény volt, de nyelvtanulóknak kifejezetten hasznos lehet.

A Whispersync for Voice az eddigi legjobb productivity tipp amit kaptam, csak ajánlani tudom mindenkinek. Szórakozásnak szerintem drága, de ha a szélesebb értelemben vett szakmai tájékozottsághoz szükséges olvasmányokra költ kicsit többet az ember, akkor már elfogadható hogy kétszer fizetünk a tartalomért. A Kindlevarázs blog nálam sokkal alaposabb posztban foglalta össze a tudnivalókat és leírja miképp lehet kipróbálni pár kötettel ingyenesen is a szolgáltatást. A technológia már csak azért is üdvözlendő, mert ismét bebizonyosodott, nem kell rögtön kvantumkeresést, topic modelleket és egyéb hókuszpókuszokat rászabadítani a szövegre. Néha elég, ha csak fogyaszthatóvá tesszük...

2013. január 28.

Adatújságírás hack-day - Van ötleted?


2013 április 6-án kerül megrendezésre az első magyar adatújságírás nap és hack-day.

A hack-day célja, hogy olyan, egy nap alatt kivitelezhető fejlesztést valósítsanak meg az önkéntesek, mely használható a sajtó munkatársai számára. Kizárólag nyílt forráskódú, szabadon elérhető program fejlesztésére van lehetőség a hack-day során!


Ehhez várjuk ötleteiteket 2013 március 18-ig a zoltan.varju(kukac)gmail.com címre (a tárgy mezőbe csak annyit írj, OpenNews). Maximum egy oldalban írd le a projekt célját, milyen hátterű önkéntesekkel tartod megvalósíthatónak és te miben tudod segíteni a csapatot a hack-day során (pl. első sorban szakértelemre gondolunk itt). A beérkezett ötletek közül a szervezők és szakértők csapata választja ki a legjobbakat melyek reálisan meg is valósíthatókat. A nap végén a résztvevők kiválasztják azt a projektet, mely a leghasznosabb és leginkább érdemes arra, hogy az OpenNews source programjára jelentkezzen és további fejlesztéséhez támogatást nyerhessen. 

Bővebben a rendezvényről

A Nyelv és Tudomány (Kincse Szabolcs) és az NLP meetup (Recski Gábor és Varjú Zoltán) szervezésében 2013 április 6-án kerül megrendezésre az első magyar adatújságírás nap és hack-day, a Knight-Mozilla OpenNews támogatásával.

Mi az az adatújságírás?
Az adatújságírás egy gyűjtőfogalom, ami lefed minden olyan digitális írást, ami adatvezérelt. Fából vaskarika is lehetne ez, de napjainkban egyre több adat keletkezik és szerencsére ezek egyre nagyobb része szabadon hozzáférhető. A Világbank, az EU, vagy éppen a KSH rengeteg adatot tesz közzé, de akad olyan város, ahol a tömegközlekedéssel kapcsolatos adatok (késések, jegyeladási adatok, stb.) valós időben nyomon követhetőek. A nyers adatok legtöbbünk számára nem sokat mondanak. Egy újságíró segítségével az adatok elmondhatják mi is van mögöttük és fontos összefüggésekre hívhatják fel a közvélemény figyelmét, mint pl a The Guardian beszámolói a 2011-es londoni zavargásokról. http://www.guardian.co.uk/news/datablog+uk/london-riots (Ha többet szeretnél megtudni az adatújságírásról, a szabadon hozzáférhető Data Journalism Handbook http://datajournalismhandbook.org/  a legjobb kiindulásipont)

Hogyan?
A rendezvény két párhuzamosan zajló eseményt takar. Az egyik teremben előadások zajlanak majd, a másikban pedig egy hack-day.

Az előadások során külföldi szakértők (The Guardian, European Centre for Journalism, Open Knowledge Foundation) mutatják be az adatújságírás gyakorlatát, valamint hazai médiumok  képviselői beszélnek saját kezdeményezéseikről.