21. avgust 2008

Umetna inteligenca za telebane

Leta 2006 sem na internetu objavil svojo podjetniško iniciativo (glej originalno besedilo povzetka**) in pri tem naletel v mednarodnih krogih na tako dober odziv, da smo še istega leta ustanovili družbo »AI-in-Law Future Technologies Inc«, ki se ukvarja z uvajanjem umetne inteligence v pravo …

Čeprav je bila družba* ustanovljena v ZDA, pa so njeni glavni partnerji in sodelavci iz Evrope in sicer iz Slovenije, Nizozemske, Madžarske in Italije. Ker bo šlo za visoko inovativne tehnologije, ki zahtevajo zelo visoko stopnjo zaščite industrijske lastnine (vključno s patentiranjem programskih rešitev in algoritmov), je bila njihova ocena, da je to trenutno bolje in lažje doseči v ZDA, poleg tega pa je na tem trgu čutiti tudi največji interes za komercialni razvoj družbe in celo oploditev s tveganim kapitalom.

Družba AI-in-Law bo skušala s pomočjo pretežno pravniških timov zgraditi (dopolniti že obstoječe) pravne ontologije (najprej splošne, kasneje pa tudi za posebna področja), tako da bodo programerji lahko iz besedil (celotne) zakonodaje in judikatov (preteklih sodnih odločb) potegnili pomen vsakega posameznega stavka. Z jezikovnimi tehnologijami se ne bodo ukvarjali, temveč bodo uporabili (kupili) že odlične rezultate (pri nas je to družba Amebis), ki so doseženi že skoraj v vseh pomembnejših jezikih. Del tega bo tudi izražanje v »naravnem jeziku«, kar bo kasneje omogočilo, da bo uporabnik svoj (pravni) problem vnesel opisno in neformalno, v obliki poljubnih stavkov.

V drugi fazi bodo s pomočjo specialnih tehnologij (že razvite splošne umetne inteligence), predvsem »strojnega učenja« še zelo izboljšali odstotek točnosti pri (raz)poznavanju besednih in stavčnih povezav. Tu si bodo pomagali z obstoječimi pravnimi slovarji in tezavri, predvsem pa tudi s statistiko (pojmov, ki se ponavadi in normalno pojavljajo skupaj). Vse to jim bo omogočilo, da bodo v bistvu zelo obogatili praktično vrednost besedilnih podatkovnih zbirk.

Tako obogatene zbirke (sedaj že tudi ZNANJA) bodo služile za številne druge koristne namene in projekte, od katerih bo »matična« družba AI-in-Law razvijala le nekatere, praviloma pa jih bodo uporabljali drugi subjekti, na podlagi dokumentacije, specifikacije in navodil osnovnega razvojnega sistema.

Moduli umetne inteligence (temelječi na obogatenih zbirkah pravnega znanja) bodo lahko koristno uporabljeni prav pri vsakem projektu modernizacije (kateregakoli) sodnega sistema, saj jih bodo izvajalci lahko uporabili za izdelavo ekspertnega sistema za spremljanje sodnih postopkov. Krona tega bo gotovo na koncu, ko bodo sodniki lahko s pomočjo računalnika dobili osnutek (predlog, katerega bodo lahko sprejeli, zavrgli ali dopolnili) sodbe z obrazložitvijo.

Podobno (ali pa še bolj) uporabni bodo moduli AI (kot obogatene zbirke pravnega znanja) na področju javne uprave in drugih zahtevnih sistemov množičnega komuniciranja z uporabniki. Vloge v elektronski obliki so (le) prvi korak … do končnega cilja, da vlagatelj dobi tudi kvalitetno in hitro rešitev.

Ko bodo celotne zakonodaje posameznih držav (EU) obdelane in obogatene z znanjem (meta podatki), jih bo tudi lažje med seboj primerjati in usklajevati (s predpisi EU). In ker bodo takšni sistemi med seboj povezani, bo neprimerno lažje naprej graditi kvalitetne in kompatibilne pravne sisteme. Ob spremembi enega (člena) zakona, bodo na več mestih zasvetili rdeči gumbi: v upravnem postopku za izdajanje potnih listov, v spletni aplikaciji za izvršilne predloge, v komercialnem programu za odvetniške pisarne, v službi za evropske zadeve, v mednarodnem programu za medsebojno obveščanje državnih tožilstev itd.

Jasno je, da se bo uporaba umetne inteligence v pravu, od zakonodajnega postopka naprej, poznala tudi pri kvaliteti, saj bo v pravnih predpisih ter sodnih in upravnih odločbah manj leporečja, nejasnosti, dvoumnosti, napak, podvajanj, itd.

Družba AI-in-Law je svoje vmesne rezultate (po dveh letih petletnega projekta) tudi že javno predstavila na pomembni in odmevni mednarodni konferenci »e-Pravosodje & e-Pravo 2008«, katero je organizirala Slovenija v okviru predsedovanja EU. V Portorožu so bila vsa predavanja strokovnjakov družbe AI-in-Law pred 400 udeleženci sprejeta z velikim zanimanjem in odobravanjem.

Bil sem zelo ponosen, ko sem videl, da smo Slovenci enkrat za spremembo uspešno nekaj »učili« informacijske strokovnjake iz Avstrije, Nemčije, Francije, Velike Britanije, Španije …

**We plan to connect the best researchers and developers from various countries on the field of AI & Law with investors who believe that well planed and produced modules of AI could be of great value for different future (say - 5 year) projects involving e-justice, e-administration, e-forms, e-legislation, online created documents, etc. The newly established company will try to take and maintain the leading position in this area of endless opportunities. We truly believe that this practical collaborative approach would first of all raise general awareness about tangible benefits AI would bring into the legal world, and secondly, motivate investors to help with the current and future projects and research.

18. avgust 2008

Brez umetne inteligence je računalnik neumen

Pred nami je največja revolucija na področju iskalnih strojev! Dosedanja gola zaporedja znakov (strings of characters) v besedilih se bodo dala računalniku prepoznati s pomočjo vse bolj razvite umetne inteligence. Potem ne bo več tako usodnega pomena, če smo pri iskanju izbrali ustrezne »ključne besede«, saj bo bolj pomemben POMEN besedil (tudi iskalnega izraza), kot pa znaki s katerimi so napisani …

Bolj kot razvijamo in obvladujemo informacijske tehnologije, bolj spoznavamo, kako fantastično razvita in popolna s(m)o že milijone let delujoča živa bitja - in mi ljudje, kot krona stvarstva še posebej. Sedaj, ko imamo že super hitre procesorje, gigabajtne nosilce »spomina« in celo terabajtno svetovno omrežno podporo, uspevamo počasi (in zelo nezanesljivo) računalniško prepoznavati obraze na (ustrezno kvalitetnih) slikah, kar je sicer prava malenkost za vsakega povprečnega otroka, pa čeprav tudi preko človeškega očesa informacije pridejo v možgane preko tisočih pikčastih impulzov (v bistvu tudi digitalnih) …

Družbe, kot Riya*, ki so doslej uspele še najbolje spoznati vsebino slik (»Visual Search«), se hvalijo s tem, da so še največ dosegle na enem od področij umetne inteligence – »computer vision«. Slike, katere mi spoznamo in »razumemo, sprejmemo« v sekundi, morajo računalniki najprej spremeniti v matematične algoritme in šifre (povprečne slike jih imajo vsaka po 6.000), nato pa se začne strašno komplicirano »računanje« zato, da bi se našle znane in smiselne kombinacije … In če naj bi nek obraz prepoznali za potrebe bio-metričnih potnih listov, potem je treba dobljene kombinacije primerjati še s tisoči in tisoči drugih slik … (kar mi spet naredimo ponavadi kar mimogrede, ko se spomnimo znanca izpred 10 let) …

Na vizualno področje sem opozoril zato, da bi si lažje predstavljali, na kakšen zapleten način mora »neumni« računalnik začeti delovati tudi na področju besedil. Zaporedje črk in drugih znakov je potrebno najprej »na grobo« spoznati in razdeliti na besede in stavke. Umetna inteligenca je potrebna od tu naprej, začenši z že dokaj razvitimi jezikovnimi tehnologijami. Visok nivo (formalnega) prepoznavanja besedil tudi v slovenščini si lahko ogledate pri Microsoftovih orodjih v Pisarni – Office 2003, kjer vam računalnik lahko že kar koristno pomaga pri odpravljanju slovničnih napak.

Trdo delo pa se tu seveda šele začenja: ugotoviti, kaj besedilo POMENI, in to potem povezati z drugimi ustreznimi pojmi in besedili. Za to pa je potrebno (biti vključeno) že zelo specifično znanje. Umetna inteligenca na področju medicine (ki je tudi že precej razvita), mora povezati težave s krvnim pritiskom z (ne)primerno prehrano in z ustreznimi terapijami in zdravili.

Nepogrešljivi iskalni stroji doslej niso imeli ustreznih rešitev, niti vključenih elementov umetne inteligence. Google bi nas na področju medicine verjetno hitro pripeljal tudi od visokega pritiska do ustreznih zdravil (s plačanimi oglasi). Za splošno iskanje je tudi to ponavadi dovolj, nikakor pa ni to prava smer za bolj zahtevno in kvalitetno iskanje – predvsem tudi ne na pravnem področju. Z vidika iskalnika je namreč celotni internet ena sama ogromna zakladnica najrazličnejših besed (na določenih straneh), skupaj s povezavami med temi besedami in stranmi. Pa prav nič več!

Upam si celo trditi, da še tako izpopolnjen(i) iskalnik(i) á la Google predstavlja(jo) povsem neustrezno smer (»dead end«) nadaljnjega razvoja obdelave informacij, razen seveda, če jim bodo določili povsem novo arhitekturo. Kot si lahko predstavljate, bodo morali pri (zasnovi in) izdelavi novega (pravega) iskalnika na medicinskem področju sodelovati predvsem zdravniki, na pravnem pa – predvsem pravniki. Med bilijoni in bilijoni besed (pogosto obdanih z morjem navlake) bo možno dobro informacijo najti le z uporabo pravega ZNANJA (ki pa doslej ni bilo ustrezno vkomponirano v iskalnike).

Imamo srečo, da je prav pravo eno od najbolj ustreznih področij človeške dejavnosti za obvladovanje s pomočjo računalnikov, saj se študentje na nek način vsa leta študija učijo predvsem raznih PRAVIL.

S pomočjo umetne inteligence bo torej potrebno najprej vsa ta pravila (in njihove povezave) predstaviti računalniku, ki bo odslej znal prepoznati tudi nova (pravna) besedila in nam jih predstaviti preko iskalnika. Postopek bo sicer dopolnjen s spoznanji strojnega učenja in statistike, vendar bo temeljil na znanju in pravilih, katera bodo definirali pravniki.

Takšnega zelo ambicioznega (in dolgotrajnega) projekta uporabe umetne inteligence v pravu smo se prvi lotili Slovenci, skupaj s partnerji iz nekaterih najrazvitejših držav EU. Zaradi boljše možnosti zaščite intelektualne (»industrijske«) lastnine smo družbo »AI-in-Law Future Technologies Inc« sicer ustanovili v ZDA, vendar lahko napovem, da bodo uporabniki sistema IUS-INFO eni prvih, ki bodo uporabljali PRAVI pravni iskalnik.


*Priporočeni link: http://www.riya.com/

11. avgust 2008

Project LLx - 0811

To poletje smo vsi malo zaljubljeni… Pripravljamo namreč našo prvo aplikacijo za Facebook, ki pa bo imela zelo zanimivo vsebino: ljubezenska pisma (in druge podobne izraze simpatije), prilagojena lastnostim (profilu) naslovljenca/ke…

Sedaj torej že lahko razkrijem pomen imena našega skrivnostnega »Projekta LLx«… Seveda: »Love Letters, X- version«…

Zadevo bomo naredili najprej za slovenske uporabnike (in ta bo tudi v celoti brezplačna!), nato pa bomo vse skupaj prevedli (in priredili) v angleščino in druge jezike. Priznam, da nameravamo potem to tudi tržiti… No, ja kakšen dolar bo pa že vreden vzorec kakšnega kvalitetnega pisemca, prilagojenega ljubljeni osebi in naravi razmerja z avtorjem, saj bo izdelek tudi lepo okrašen, z grafiko in (malo kasneje) razpoloženjsko glasbo v ozadju. Posebno če to primerjamo s popularnimi »darili«, katera ljudje za 1$ kupujejo, čeprav gre le za najmanjšo slikico torte ali srčka…

Poskusiti ni greh… Bomo videli, kako globoko se nam bo uspelo preriniti v 90 milijonski trg FB uporabnikov, ki so vsi le kakšno sekundo in nekaj klikov oddaljeni… Takole smo razmišljali na začetku za korajžo: »Če jih prodamo le 1 miljon, pa smo že na konju…«

Danes smo imeli usklajevalni sestanek in sem kar zadovoljen s potekom in dosedanjim delom ekipe. Programerji so si lepo razdelili naloge in se eden ukvarja z vmesnikom, drugi z analizo besedil, tretji z ozadjem na strežniku, četrti s Facebook okoljem itd. Vesel sem, da se je naš »competitive dialogue« tako lepo iztekel in da se našlo delo za vsakega, ki se nam je pridružil.

Malo kritično pa je postalo z vsebino!? Ker rabimo veliko različnih vzorcev (ljubezenskih pisem), smo se odločili da uporabimo kar »crowd-sourcing«: k sodelovanju bomo povabili kar malo širši krog naših prijateljev in prijateljic na Facebooku! Konec koncev je bo to tudi naša končna »ciljna skupina« in se bo prav tu najlažje izoblikovala ustrezna vsebina glede na okus publike…