Magamról

Saját fotó
Főiskolai, majd egyetemi diplomamunkáimtól kezdve világ életemben, adatok, adatbázisok, adattárházak (leginkább Oracle) környékén mozogtam. Mostanság adattárházasként, adatbányászként élem napjaimat.

2010. szeptember 14., kedd

Intelligens ügyfélszolgálati rendszert vezet be a Vodafone

. Az alább következő blogposzt már v1.1-es verziójú és egyelőre egy darabig véglegesnek is tekinthető. A tegnapihoz képest jelentős javítást az indokolja, hogy a hír mögötti új hangbányászati illetve -felismerési technológiára az elmúlt pár órában lett egy pici rálátásom, már nem kell annyira a sötétben tapogatóznom.Mivel v1.1-et írtam és nem v9.0-t nagy csodát senki ne várjon! ;) Friss tegnapi tárgybeli hír két forrásból is, a második (indexes) cikk kommenteket is tartalmaz, ennyiben érdekesebb. :o)   Intelligens ügyfélszolgálati rendszert vezet be a Vodafone (index.hu) A gépek figyelnek, ha a Vodafone-t hívjuk (privatbankar.hu)
A Vodafone Magyarország és a Montana Tudásmenedzsment Kft. intelligens ügyfélszolgálati rendszert vezet be a mobiltávközlési társaságnál, a valós idejű ügyfélkiszolgálás egy folyékonybeszéd-felismerő szoftveres megoldáson alapul, s első lesz a magyar piacon A kedden Budapesten sajtótájékoztatón bemutatott megoldás a telefonáló beszédének elemzésével automatikusan meghatározott kategóriákba sorolja a hívást. A rendszer képes lesz olyan statisztika előállítására is, amely megmutatja az ügyfélszolgálat kihasználtságát és a leggyakoribb kérdéseket. A kategóriáknak köszönhetően hatékonyabban lehet majd a munkát megszervezni, a munkatársakat beosztani, így az ügyfél gyorsabb és pontosabb megoldást kaphat problémájára. A Montana által vezetett fejlesztést az Európai Unió és a magyar állam összesen 218,4 millió forinttal támogatja. A kutatás-fejlesztés révén a Vodafone először alkalmazhat majd hangfelismerő rendszert call centerében. A projekt teljes bekerülési költsége 336 millió forint. A projekt két év alatt, 2012 első negyedévének végére éri el a kívánt eredményt.
NÉZZÜK AKKOR, mit lehet ennyi infóból kihámozni.
* Nincs új a nap alatt: következzenek a történelmi előzmények. 

Régi vágy a szakmában a szöveg (text) és a hang (voice) kölcsönös megfeleltetése. Míg azonban a szöveg felolvasása hanggá régóta és jó minőségben létezik, úgymond könnyű feladat. A másik irány vagyis a hangzó szöveg írott szöveggé alakítása jóval nehezebb feladat. A historikus előzményeket is figyelembevéve vannak különböző nehézségi fokozatok:

- Nem mindegy, hogy például Bőzsöny Ferenc szép magyar beszédét CD-minőségben kell dekódolni írott szöveggé, avagy szegedi tájszólásos ember recsegős és/vagy háttérzajos vonalas- vagy mobiltelefonról érkező hangját.

- Nem (feltétlen) mindegy a nyelv, különös tekintettel arra, hogy a magyar nyelv agglutináló (ragozó) nyelv, szemben az ebből a szemponból jóval egyszerűbb angol nyelvvel. Nem is véletlen, hogy angol nyelvterületen előbb voltak sikerek a témában.

- Nem mindegy, hogy egy szöveghez kapcsolódik-e érzelmi analízis. Nyílván az olyan ügyfélre jobban kell figyelni, aki ordít és/vagy dühös, pláne, ha kiemelt jó ügyfélről van szó. Vagy olyan esetben, amikor a cég call-centeres ügyintézője vált véletlenül "bicskanyitogató" módba.

- Nem mindegy, hogy csak kategóriákba kell-e sorolni egy hanganyagot, avagy hangról-hangra dekódolni kell azt.

- A friss indexes hír szövegből derül ki egy érdekes feladat, nevezetesen megkísérelni azonosítani a gyakori kérdéseket/problémákat. Ez a fenti kategórizálásos problémánál nehezebb csoportosítási/osztályozási feladat. Ide eljutni is hírértékű lenne (magyar nyelvterületen, gyenge minőségű telefonos hanganyag esetén).

- Végül nem mindegy, hogy
+ teljesen általános, spontán, hétköznapi, szűkebb szókincsű(?) folyamatos beszéd folyamatos online valós-idejű konverziójáról van-e szó
+ egy konferencia moderátorának félig spontán beszédének szöveggé alakításáról van-e szó
+ egy tévés hírcsatorna híradósának előre megírt szövegéről van-e szó.
Érezhető, hogy egyfelöl könnyebbedik a feladat, másfelöl más-más a pontossági követelmény és a várható felhasználás.

* Magyar nyelvterület eddigi eredményeinek áttekintése (amiről én tudok)

- A témában - hangsúlyozottan az én tudtommal, és alapvetően két éves emlékeimre támaszkodva -, legelőször két éve a Nextent robbantott. Ők a Szegedi Tudományegyetem egyik műhelyében kikísérletezett tudományos kutatást hoztak fel termékszintre. Ebben van érzelmi analízis is. Alapvetően szócentrikus metódus, lényegi működése, hogy előre megadott szavakat keres rossz minőségű telefonos hangfile-okban. A módszer mélyében egy nem publikus módon módosított/feltalált SVM (kernel-módszer) algoritmus húzódik. A módszer akkor lehet előnyös a teljes hang->szöveg konverzióval szemben, ha a felismerendő szavak tényleg nagyon nagy megbízhatósággal felismerődnek és akkor hátrányos, ha a teljes hang-szöveg konverzió átlagosan is nagyon magas megbízhatóságú. Ebben az esetben akkor már csak árversenyben tudhat jobbat adni a szófelismeréses módszerű szoftver (technológiai értelemben nem).

Itt egy korabeli két évvel ezelötti  indexes cikk egy létező, kapható folyamatosan fejlesztett termékről, szintén kommentekkel, amik persze mutatnak némi áthallást a friss kommentekkel. ;)
A hangulatunkat is elemzik a call centerek

Itt a magyar fejlesztésű termék honlapja:
Voice Miner

- Nem sokra rá jött a magyar piacra a nagy konkurens izraeli Nice cég, amelyik rohamtempóban próbálta meg angol nyelvterületen már létező megoldását adaptálni magyar nyelvterületre. Olykor övön aluli módszereket is alkalmazva: ügyfél által súlyos pénzekért megvásárolt call center system által speciális file-formátumban tárolt hanganyagokhoz nem engedte a saját pénzes ügyfeleit hozzáférni, saját tulajdonának tekintve azt.

- A harmadik legfrissebb szerepelő a BME-vel együttműködő Netxtenthez hasonlóan magyar Aitia.

Összefoglalva tehát ez egy többszerepelős piac, más-más fókuszokkal, súlypontokkal, előélettel.

* Azt azért látni kell a friss hírek kapcsán, hogy:

- Nem szabad elfelejteni, amiről hírt kaptunk a fentebbiek szerint, az egyelőre csak terv. 2012-re várható eredmény a projekttől. Ez egy kötelező kommüniké volt, a támogatás miatt.

- Ügyfélszolgálati kihasználtsági mutatókhoz, egyéb hang-, szöveg- és adatbányászati megoldásoktól független technológiák is rendelkezésre állnak.

- 336 millió forint nekem nagyon kevésnek tűnik egy fullos megoldáshoz. Bár kétségtelenül lehet belőle valamilyen eredményt szállítani. :o)

- Egyébként az "szép" lehet az egész történetben, hogy az ügyfelek fogják megfizetni vásárolt szolgáltatásokon keresztül ezt a drága call centeres technológiát: mármint hogy gépekkel lehet majd társalogni nem kevés várható potenciális probléma árán, miközben a minél tökéletesebb hangfelismerés egyéb célokra is használható lesz.

- Az indexes cikk kommentjeiből egyértelműen kiderül két reakció
(1) szkepticizmus
(2) azonnal előkerül a nagy testvér figyel típusú adatvédelmi aggodalom.

* Folyékonybeszéd-felismerő

Ez eredendően elég tág határok között értelmezhető: lehet csak annyiról szó, hogy képes a program megkülönböztetni az élőbeszédet a zenétől például. Egészen addig elmenve, hogy a hangot képes valós időben text-állománnyá lekonvertálni illetve szövegbányászatilag feldolgozni. Na ez utóbbit én a saját tapasztalatom alapján egészen egyszerűen nem hiszem el -> írtam tegnap. Ma meg saját szememmel láttam egy AITIÁ-s demót, és nem hittem a szememnek, azt hittem káprázik.

Egy nő telefonált egy internetszolgáltatóhoz talán, és ahogy mondta tök normál sebességgel a szöveget t-é-n-y-l-e-g azonnal íródott ki a (magyar) szöveg a képernyőre, elképesztő pontossággal. Volt a szövegben pár xyz de lényegtelen volt (az sem kizárt, hogy recsegés következményeként), én így hasraütve a lényeget illetően 99%-os pontosságot mondanék rá. (Nyilván ez egy jól kiválasztott minta volt, lehetnek jóval gyengébb minták is) Részemről maximális respect, technológiai megvalósíthatósági értelemben lenullázódott a szkepticizmusom.Ha nem demó-, hanem éles üzemi körülmények között látom, akkor azt mondom, hogy komplett kiérlelt a technológia. Amennyi kevéske infóm nekem van, annak alapján azt mondom a Nextent megoldásának fel van adva a lecke, egy erős konkurens érkeztével.

* AITIÁ-s technológiai háttér

Természetesen egy ilyen impresszív élmény után megpróbáltam utánajárni mi lehet a háttérben. Nyilván sok infó azért nem elérhető angolul sem, rövid idő alatt nem lehet csodát tenni egy ilyen blogposztban, ráadásul én sosem dolgoztam a témában. Hiába áll szívemhez közel a hangbányászat is, mint speciális adatbányászat, ha olykor még a terminológiával sem vagyok tisztában a fentiek miatt. Ami nekem lejött nagyon röviden:

- Mivel folyamatos beszéd detektálásáról van szó, szó nem lehet szavak detektálásáról. Vesznek mondjuk egy 10 másodperces hangrészletet azt elemzik. Próbálják megtalálni a neki megfelelő szöveget. Próbálnak benne detektálni szünetet. Ha analógiával akarnék élni, a szövegbányászatban ismert n-gram technikához hasonlítanám. Ami nóvum, az az, hogy ezek az elemek a felismerés során egyre "értelmesednek" illetve hálózatot, praktikusan például Bayes hálózatot alkothatnak, rákövetkezési valószínűségekkel "súlyozva". Óriási szakmai gyönyörűség ha más nem is, csak ilyen felismerési hálózatokkal foglalkozhatni. :o)

- Minden például 10 másodperces hanganyag legelőszöris átesik egy lényeg/jellemző-kiemelésen (->feature extraction).Az így kapott jellemzővektor illesztődhet aztán szótárban előzetesen meglévő mintákhoz.

Kétféle szótár van:

+ Akkusztikai alapú: jellemző nyelvspecifikus fonémák jellemzővektorainak szótára. Ez alapjában egy sok helyről összelapátolt cucc, van benne Bőzsöny Ferenc típusú hanganyagtól kezdve háttérzajos, meg spontán benyögéses anyag is.A szótár bővíthető, a kritikus pont a hanganyagok leképzése algoritmus szemponból már kezelhető jellemzővektorokra. Amúgy a képbányászok is alapvetően ilyen - esetükben nyilván képspecifikus - jellemzővektorokkal dolgoznak egyébként.

+ Nyelv(tan)i alapú: itt jön a szavak - emlegetett és valószínűségekkel megfűszerezett - Bayes hálózata.

A poén az, hogy a kettő összefűzhető: a akkusztikai verzióból kapott statisztikai valószínűségek (eloszlások) megfeleltethetők a nyelvi verzióval, ezáltal azok kvázi beágyazhatók ez utóbbiba. Ha működik, elmondhatatlan szépségű elképzelés.

- Kulcskérdés a hangzó szöveg megtalálásának konfidencia szintje (nem mindegy, hogy legjobb közelítéssel avagy pontosan találjuk el mit mondtak), mindezt kettős célkitűzéssel. (1) Minél magasabb legyen, és (2) minél pontosabban megadható. Az az ígéret, hogy ebben van az egyik nagy dobás.Sikerült egy olyan számítási módszert találni ami kvázi egyetlen valós számot rendel megfeleltetésekhez és a megfeleltések optimális aggregálása után jönnek a döbbenetes eredmények. Na ez a konfidencia-számolás meg a másik óriási szakmai gyönyörűség. :o)

- A felismerési hálózatkonfiguráció révén tehát, egyre értelmesebbre leképzett hangfoszlánydarabkákhoz valós számmal reprezentált hasonlóságmértékünk lehet. A következő kérdés hogyan kell legjobbat választani? Egy véges bármilyen nagy szótár/korpus nem elégséges mindehhez. Ezért jön a következő nagy ötlet. Egy olyan felismerő hálózatot generálni, ami minden jellemzővektor-sorozathoz jól illeszkedik. Én ebből az állításból azt értem, hogy miért jó és örömteli. Viszont ha nekem kéne egy ilyen hálózatot generálnom, így első belegondolás után ebbe beletörne a bicskám, olyan nehézségűnek hangzik, méretre is, kezelhetőségre is.

- Konfidencia-konklúzió tehát, hogy a hang+nyelv illesztés, illetve a mindenhez illeszkedő hálózat együttesen tudhat kellően jól artikulált és argumentált konfidencia eredményt adni.

- Egy dologról nem esett szó: hogyan tud ez valós-időben menni. Természetesen fogalmam sincs.Úgy képzelem a jellemzővektoros összehasonlítás, pláne valamiféle indexes támogatással nem egy nagy dolog. Utána a Bayes hálózat valószínűség szorzásai, összeadásai megint nem elviselhetetlen műveletigényűek. És a legvégső aggregálásnál sem látok szorzás összeadásnál bonyolultabb műveletet, és belőlük sem sokat. Azaz a valós-idejű működést tudom a legjobban elképzelni az egész fenti történetből, működhetőség szempontjából.

* Végül itt egy már működő érdekes webes alkalmazás/honlap a csapattól.Itt videókban lehet szöveget keresni.
Mindroom

Köszönet mindenkinek a blogposzthoz nyújtott különféle segítségért.

2010. szeptember 6., hétfő

Frissebb adatbányász könyvek az amazon.com-on.



1.
The Top Ten Algorithms in Data Mining
Price: 64 USD
Hardcover: 232 pages
Publication Date: April 9, 2009
Publisher: Chapman & Hall
CRC Data Mining and Knowledge Discovery Series
Xindong Wu (Editor) - Vipin Kumar (Editor) 

Topics:
* classification
* clustering
* statistical learning
* association analysis
* link mining

Algorithms:
01.C4.5
02.k-Means
03.SVM
04.Apriori
05.EM(=Expectation Maximization)
06.PageRank
07.AdaBoost
08.kNN
09.Naive Bayes
10.CART


2.
PMML in Action
Unleashing the Power of Open Standards for Data Mining and Predictive Analytics

Price: 32 USD
Hardcover: 188 pages
Publication Date: May 18, 2010
Publisher: CreateSpace

ADAPA

Példák adatfile-okkal(zementis.com-on)


3.
Temporal Data Mining

Price: 54 USD
Hardcover:395 pages
Publication Date: March 10, 2010
Publisher: Chapman and Hall/CRC



























Szerzői blog


4.
Springer Optimization and Its Applications
Data Mining and Knowledge Discovery via Logic-Based Methods:
Theory, Algorithms, and Application

Price: 124 USD
Hardcover: 350 pages
Publication Date: June 28, 2010, 1st Edition
Publisher:  Springer

This monograph focuses on the development and use of a novel approach, based on mathematical logic.


5.
Synthesis Lectures on Data Mining and Knowledge Discovery
Ensemble Methods in Data Mining:
Improving Accuracy Through Combining Predictions

Price: 28 USD
Hardcover: 126 pages
Publication Date: February 24, 2010
Publisher: Morgan and Claypool Publishers

Ensemble methods combine multiple models into one usually more accurate than the best of its components.

Ensembles can provide a critical boost to industrial challenges
* investment timing
* drug discovery
* fraud detection
* recommendation systems
* where predictive accuracy is more vital than model interpretability.

Ensembles are useful with all modeling algorithms, but this book focuses on decision trees to explain them most clearly.

After describing trees and their strengths and weaknesses, the authors provide an overview of regularization -- today understood to be a key reason for the superior performance of modern ensembling algorithms.

The book continues with a clear description of two recent developments:
* Importance Sampling (IS)
* Rule Ensembles (RE).

IS reveals classic ensemble methods
* bagging
* random forests
* boosting

REs->linear rule models derived from decision tree ensembles. They are the most interpretable version of ensembles

Snippets of code in R are provided to illustrate the algorithms


6.
Machine Learning: An Algorithmic Perspective

Price: 62 USD
Hardcover: 406 pages
Publication Date: April 1, 2009, 1st Edition
Publisher: Chapman & Hall

The book covers
* neural networks
* graphical models
* reinforcement learning
* evolutionary algorithms
* dimensionality reduction methods
* the important area of optimization

2010. szeptember 2., csütörtök

KDD MLG Workshop, 2010 - Hírek másodkézből

.
Sajnos nem lehettem ott a neves eseményen, ahol az akadémiai és üzleti világ körülbelül 900 embere tolongott információért. Viszont láttam olyan embert, aki ott lehetett. :o)

Előszöris, MLG! Ez nem más mint Mining and Lerning Graph, azaz gráfok (adat)bányászata. A Workshop igen szellemesen fogalmazta meg a legfontosabb 'hot topic'-okat, tulajdonképpen ennek leírásáért is születik ez a blog-bejegyzés.

(1) Időben változó gráfok tanulása, modellezése
(2) Rejtett változós modellek gráfoknál
(3) Skálázás nagy gráfokra (lásd még bioinformatika)
(4) Gráfok vizualizációja
(5) Gráfalgoritmusok validálása
(6) Gyakori részgráfok keresése.

A poén az, hogy általánosságban is ezek a 'hot topic'-ok, a 'gráf' szó elhagyásával.

Így első ránézésre, meg az információs sokk csillapodása után, az én szőrszálhasogató vénám azt súgja /nemkicsit képzavar? :o)/, hogy a fenti témák nem egyforma súlyúak. Miközben az (1), (3), (6)-ról maximálisan elhiszem, hogy komoly fejlődési pontenciált tartalmaznak, nehéz és létező problémák, addig a többivel vannak horderő és kiérleltségi problémák.

Az (1) időben változó gráfoknál, ahol az idővel egyszerre változhat (szünhet meg illetve keletkezhet) csúcs, él, topic/cimke, sőt a topic-ok korrelációja is változhat, ezt lemodellezni, az valós probléma és nem kis kihívás. Az egyik Workshopon előadó cikkíró performanciális gondok miatt a legdurvább esetet kénytelen volt 2000 gráfcsúcsról 500 gráfcsúcsra leredukálni. Miközben úgy tűnt a párhuzamosításban rejlő lehetőségekkel nem foglalkozott.

(2) Rejtett változós gráfoknál nem igazán fogtam fel a "rejtett változó" értelmét. Én értem, hogy a gráfélekhez valószínűségek voltak rendelve, meg SVD(=Singular Value Decompsition) analógia miatt a látens szemantikiai indexelés is képbekerül, meg az LDA(=Latent Dirichlet Allocation)-ban is ott a rejtett kulcsszó. De nekem valahogy csak az jött le, hogy itt gráfklaszterezésről van szó, ahol a klaszterek kezdetben nyílvánvalóan rejtettek, azt' mondhatni semmi több. Valahogy csak terminológiai különbségeket bírtam felfedezni, ha próbáltam az alapproblémát hétköznapira lefordítani. Persze ez túlzott szimplifikáció, azért ennél szinesebb a téma.

Ami még lejött nekem, hogy míg egy neurális hálónál csak az elgoritmus fekete doboz, itt gyakorlatilag minden. A klaszterek, az algoritmus, sőt maga a végeredmény kiértékelése sem ad túl sok fogodzót. Magyarán csomó adatból számolunk valamit, amit mind interpretálni, mind mérni, nagyon nehéz. Elképzeltem, hogy egy ilyen modellt, ha el kéne adnom az üzleti életben, hát lehet, hogy felkopna az állam. :o) De legyünk optimisták, fejlődhet ez még emberbarátibb irányba.

(3) A gráfok vizualizációja egyértelműen nem az én témám (se régen, se aktuálisan, se a jövőben). :o) Én már ott megvagyok lőve, hogy ugye eleve képernyőn akarjuk megjeleníteni a gráfokat. Ott eleve nem lehet sok gráfcsúcsot megjeleníteni. Magyarán kisméretű a probléma, azt számol ki az ember, amit akar (megjelenítési koordinátákhoz). Ilyenekre vannak függvénykönyvtárak; egész egyszerűen nem látom a fejlődési potenciált az ügyben. De ha ezen továbblépünk is, az hogy egy gráfot hogyan jelenítünk meg, mi szép és mi nem szép, az annyira szubjektív, hogy már fájdalmas.

Az alapprobléma megfogalmazása azért szép:
* Gráfcsúcsok ne legyenek egymáshoz se túl közel, se túl távol
* Gráfcsúcsok egyenletesen oszoljanak el a képen
* Az élhosszak is egyenletesen oszoljanak el.
* Minél kevésbé messék egymást az élek.

Fizikai analógia: legyen rugó minden él, ha elengedjük a rendszert, amit felvesz formát, közel úgy nézzen ki a gráf. Számolási műveletigénye ennek a legtragikusabb, de optimalizálás után is köbös. Egy trendi módi: SSN-LDA.

Érdekes ötlet: vizualizáció, mint információ-visszakeresési probléma (arra való visszavezetés)

Érdekes és szellemes - objektíven számolható - minőségmérés, a gráfvizualizációra:
Közelebb kerül, aminek távolabb kéne kerülni (precision)
Távolabbra kerül, aminek közelebbnek kéne (recall)
Bennem némileg analógiát kelt a klaszterezés minőség mérésére (klaszteren belüli és klaszterek közötti távolságok aránya)

Számomra új távolság fogalom: Hellinger távolság.

Én ehhez azt tenném hozzá, szubjektíve, hogy amit én elvárok egy gráfvizualizációtól, az nem más, mint
* Nagyon gyorsan lehessen mindkét irányba zoomolni
* Könnyen lehessen csúcsokba beleklikkelni, további információkért.
Ennek szép példáját láttam a Sixtepben

(5) A gráf algoritmusok validálása témában én már ott meg voltam lőve, hogy mi volt a KDD Worshopon gráfspecifikus, sőt magát az egész témafelvetést nem értettem. Úgy látszik ma nehézfejű napom volt. De a legfőbb problémám ott volt, hogy fekete dobozként kellett elképzelni, mind a problémát, mind a rajta dolgozó algoritmust. Csak az képezte vizsgálat tárgyát, hogy a végeredmény mennyire jó. Ahol én már azt sem értettem, hogy ez miért validálás.

Azért sikerült egy idevágó alapproblémát kicsikarni, hogy némileg el lehessen az egészet képzelni: képzeljük el, hogy van diákok hálózata, ahol a diákok a csúcsok, az élek reprezentálják, mondjuk a barátságot. Akkor van él valamilyen súllyal/valószínűséggel, ha két diák barát. Cimkézzük meg a csúcsokat aszerint, hogy dohányzik-e a diák vagy sem. Kezdetben pár csúcs cimkézett, feladat cimkézzük meg a maradékot. A feladat értelmes gráfon belül is, meg gráfok között is.

2010. szeptember 1., szerda

Klímaváltozás: előrejelzési visszásságok

.
Az indexen nemrég jelent meg egy cikk a tárgybeli témában.

Már Lomborg szerint is probléma a klímaváltozás

És mivel már én is foglalkoztam a témával korábban itt a blogon, így aktuális az egész ügyet ismét elővenni. :o)

Miután évekig a szkeptikusok táborát erősítette, Bjørn Lomborg most azt mondja, hogy a legfontosabb helyre kell tenni a klímaváltozás elleni küzdelmet. Legújabb könyvében arról ír a koppenhágai gazdasági iskola professzora, hogy évente százmilliárd dollárt kellene a klímaváltozás elleni harcra fordítani.
Tegyük most félre a pikirt, rosszindulatú feltételezést, hogy a tudós esetleg részt akar venni a bizniszben, az erőforrások tűzközelségében. Az viszont már lényeges lehet, hogy az indexes cím viszont félrevezető, több dolog miatt is:

(1) A "fontosság" és a "költségigény" nem feltétlen korrelál egymással. Lehet fontosabb egy dolog, ami jóval kevesebb erőforrást igényel és lehet a klímatéma kevésbé fontos, ami viszont iszonyat pénzeket.

(2) Nem mindegy, hogy valami elismerten probléma-e, vagy csak egy problémalista végén van-e.

(2) A klímaszkeptikusok jelentős része nem tagadja a globális felmelegedést. És egyikük sem örül a tömeges szén-dioxid és metán légkörbe kerülésének, sem annak módjának (AGW=Antropogen Global Warming).Ők csak azt mondják, hogy nem mindegy hogy milyen érveléssel, mire költenek pénzt, milyen előrejelzés és hatásvizsgálat alapján, és mennyire használják "bunkóként" egyes vitatható tárgybeli érveléseket. Magyarán igenis lehet értelmesen pénzt költeni a témára ebben nincs vita. Ilyen értelemben abszolút szenzációhajhász az egész indexes tálalás.

Az én klímaaggódó definicióm a következő. Az aki szerint
(1) van, létezik globális felmelegedés
(2) alapvetően emberi eredetű ez a globális felmelegedés (AGW=Antropogen Global Warming)
(3) AGW elmélete szerint a nem-vízgőz jellegű üvegházhatást okozó molekulák (széndioxid, metán, stb.) földfelszínről légkörbe bocsátása egyfelöl egy pozitív visszacsatolásos folyamatot indított be (több molekula légkörbe -> még melegebb földfelszín), másfelöl e molekulák koncentrációja már túllépett egy kritikus értékek (390 ppm), ami visszafordíthatatlanná (irreverzibilissé) tette az egész mechanizmust, következésképpen, a pozitív visszacsatolás exponencialitása révén, körülbelül 60 éves távlatra vonatkozó előrejelzése szerint a földi globális átlaghőmérséklet 2 fokos emelkedésével az élővilág jelentős része, 5-7 fokos emelkedéssel pedig az ember is eltűnik a földről, maximum kb. ha hangyák maradnak. (Jelenleg száz év távlatában 0-6-0.7 fokos a globális átlaghőmérséklet-emelkedés számításaik szerint)
(4) A kvázi egyetlen kármentő utat a széndioxid, metán és társaik levegőbejutásának akadályozásában látják, ami jelentős érdeksérelmet okoz a kínai, idiai jelentős hátrányból induló jelentősen növekvő gazdaságnak.

A klímaszkeptikus elsősorban valamelyik fenti pontot cáfolja (esetleg többet is), de azzal nem szokott vitatkozni, hogy a
(1) fossziliákat kialakulásukhoz képest (200 millió év), túl gyorsan égettük el (200 év)
(2) fossziliákat értelmesen kellene elégetni (ami megmaradt)
(3) alternatív energiaforrások, és egyéb témákba érdemes kutatási pénzeket invesztálni

A friss indexes cikknek azonban van előzménye (2008.május 6.)

Stöckkert Gábor interjúja Bjorn Lomborggal: Kiotó rossz ötlet volt

Tárgyunk szempontjából itt vannak az érdekesebb dolgok. ;) Azt gondolom megéri a fáradságot elolvasni és magunkban végiggondolni az egész kérdést, specifikusan is, általánosan is. Fontos, folyamatosan ismétlődő motívumok felbukkanása miatt is. Mégha egy kicsit megkésve is (cikk íráshoz képest több mint két évvel később).

- A leggyakoribb kritika a könyvéről az, hogy ön szelektál az adatok között, a pesszimista forgatókönyvekkel nem foglalkozik. Jó példa erre a tengerszint emelkedése, amit ön az ENSZ klímabizottsága, az IPCC jelentésére hivatkozva 30 centiméterben határoz meg. Csakhogy ebben a jelentésben a legrosszabb forgatókönyv 59 centiméterrel számol, és az azóta megjelent újabb modellek többsége ennél is többet, legalább másfél métert jósol.

- Igazuk van azoknak, akik azt mondják, szelektíven használok fel adatokat. Nem véletlenül válogatok: a tengerszint emelkedésére rengeteg modell és vélemény létezik, a NASA szakértője, James Hansen például öt métert jósol. És sok olyan tudóst ismerek, akik bőven egy méter alá becslik az emelkedést, csak ők nem kerülnek be a napi hírekbe, mert a félméteres emelkedés nem olyan jó sztori, mint az ötméteres. Az IPCC jelentésében szereplő 18-59 centiméterrel viszont több száz szakember, mondhatni a tudományos többség egyetért, és a 30 centiméter ennek az intervallumnak a középértéke.
Na most ugye ebben a fenti gyöngyszemben pár dolgon azért el lehet mélázni.

(1) Tengerszint emelkedés előrejelzésére 0.3m, 0.59m, 1.5m, 5m. Azért a laikus is érzi, hogy itt valami nem stimmel. És az óvatos szkeptikus gondolkodásnak meglehet a létjogosultsága, ha már százmilliárd dollárt kéne szánni a témára. A korábbi posztom idevágóan pont erről szólt (most csak röviden): diszkrét adatok alapján, pozitív visszacsatolásos exponenciális felfutás nagyságrendjének előrejelzését, exponenciális felfutás elött előrejelezni, egyszerűen nonszensz: a fele és duplája közé sem lehet hitelesen 'belőni' a dolgot.

(2) Az én szerény véleményem szerint az előrejelzések közül egyébként tényleg érdemes szelektálni, és nem például átlagot számolni rá, ahogy teszi Lomborg is. Ugyanis az előrejelzések között érezhetően kellenek rosszak is legyenek.

Nem gondolom, hogy mindig a legrosszabb forgatókönyvekkel kell számolni
Újabb (tanulságos) aranyköpés. :o) Ma már egyébként egyfajta divat armageddonistának lenni. A mondás üzenete számomra:

(1) Először is tán meg kellene vizsgálni, hogy minek mekkora a valószínűsége. Aztán gondolkodni csak különféle forgatókönyvekben. Nem a forgatókönyvek "rosszasságából" kéne visszafele következtetni.Persze elvben nem zárom ki a kölcsönhatás miatti iteratív elemzést, de itt nem kicsi a tét, óriási bizonytalanságok mellett.

(2) Másodszor érdemes szem elött tartani a örökbecsű, közismert, szakállas viccet.
Malacka elindul a nyuszi felé, hogy kölcsönkérje tőle a vasalót. Az úton egyfolytában morfondirozik magában:
-Lehet, hogy nem is adja oda, és akkor hiába keltem útra
Malacka megy tovább
- Áh. Biztos nem fogja odaadni.
Malacka ismét csak megy tovább.
- Tuti nem fogja odaadni, mert én sem kínáltam meg múltkor sütivel.
Malacka megérkezik a nyuszikához, idegileg tök felspanolva:
- Tudod mit nyuszika! B@zd meg a vasalódat!
Magyarán nem kéne fejben lejátszani teljesen komplex dolgokat, pláne nem időben messzire vetítve.

- Azért ez nem a legjobb hasonlat. A globális felmelegedés létezik, az egész világra hat és az emberi tevékenység miatt ekkora mértékű, mindezt ön is elismeri. Megtehette volna, hogy az IPCC mind a hat forgatókönyvét alapul veszi a könyvben levezetett elemzéseihez.

- Őszintén megmondom, nem akartam nagyon hosszú könyvet írni. Az alapvető mondanivalómon nem változtatott volna, ha az összes forgatókönyvet számításba veszem.
Pestiesen szólva, azért ez nem semmi. ;) Tegyük félre a kérdezővel kapcsolatos udvariasságot és téma iránti alázatot érintő kérdéseket. Azt viszont fontos leszögezni:

(1)  Globális felmelegedés tényében sincs konszenzus. Sőt van, aki már a mérési módszertant is kifogásolja, nemhogy a mérésekből kalkulált számokat.

(2) Az hogy feltétlen emberi eredetű lenne-e a felmelegedés, az vita tárgyát képezi. Az meg külön említésre méltó részlet, hogy a szibériai permafrost metán problémája viszont nem antropogén.

(3) Az viszont hátast dobás eglatáns példája, hogy azért szelektálunk, mert rövid könyv írása van célkeresztben.

Ugyanakkor rengeteget költünk ezekre az elérhetetlen célokra, és ettől jól érezzük magunkat. Ha ezzel a pénzzel a megfelelő kutatásokat – mindenekelőtt az alternatív energiaforrások fejlesztését – támogatnánk, hosszú távon sokkal jobban járnánk. Nem biztos, hogy rögtön jól éreznénk magunkat, de 2050-re több eredménye lenne egy ilyen tervnek, mint bármilyen teljesíthetetlen szén-dioxid-kibocsátási korlátozásnak.

Ez viszont klasszikus klímaszkeptikus álláspont. Csak azt nem értem mi változott a tudósban mára, ez ügyben. ;)

- Önt sokan nem szeretik, egy honlapon a könyveiben található hibák olvashatók összegyűjtve.

- Ismerem azt az oldalt, egy munkanélküli dán biológus üzemelteti, aki valamiért engem személyes ellenségének tart. És azt mondom, jó, hogy létezik ez az oldal, mert ez is hozzájárul az értelmes párbeszédhez. A gazdájával ugyan személyesen nem tartom a kapcsolatot, de a nyilvánosság előtt különböző fórumokon már közel tíz éve vitázunk annak ellenére, hogy a nézetei más téren is távol állnak tőlem ? ő például ellenzi, hogy leszbikusok is vállalhassanak gyereket. Néhány apróságban igazat adtam neki, de úgy gondolom, többnyire téved, és úgy érzem, akármit mondhatok, azzal ő ellenkezni fog.
Egyébként ő volt az ellenem tudományos tisztességtelenség miatt indult eljárás egyik fő támogatója, és nem titkolta, hogy politikai okai is vannak annak, hogy engem támad. Az ügyemben eljáró bizottság egyetlen érvet sem vett át tőle, nem találták elég meggyőzőnek.
Erre a témára nem vesztegetnék sok szót. Most azon átlépve, hogy mi köze a szexuális beállítottságnak a klímaváltozáshoz, csak annyit jeleznék, hogy a heterószexuális Miskolczi Ferenc is megjárta a klímatémában az egzisztenciális ellehetetlenítés poklát.Ha nagy a tét, durvulnak a résztvevő játékosok

- Az Index olvasottsági statisztikáit figyelve azt látom, hogy az embereket egyre kevésbé érdeklik a klímaváltozásról szóló hírek, holott mindenkit érint a jelenség.

- Ezen nem vagyok meglepődve. Az embereknek égetőbb problémái vannak: a gazdaság, a munkanélküliség, az oktatás, egészségügy, háborúk, és így tovább. A klímaváltozással hasonló történt, mint a madárinfluenzával. Az emberek jól megijedtek tőle, aztán belefáradtak abba, hogy a csapból is ez folyik. A madárinfluenza most is legalább olyan probléma, mint néhány éve, mégsem hallunk róla annyit. A klímaváltozással is riogatták az embereket, nem csoda, hogy elfordultak tőle. De legalább túl vagyunk az ijedtségen, most már elkezdhetnénk értelmesen beszélni a jelenségről.

Abszolút kulcskérdés. Elég analógiaként a sertés influenza és az ellene kifejlesztett nagy (költségvetési) pénzeket mozgató vakcina körüli visszásságokra gondolni (lefizetett WHO-sok). Ebben az a tragédia, hogy:

(1) Ilyen pályán mozogva egyre kevésbé lehet majd tisztán látni, és tényleg bele lehet fáradni, tömeges méretekben

(2) Nem kéne felejteni a farkassal riogatós mesét. Egyszer tényleg lehet nagy baj és lehet tragédia a vége. Nem kéne játszadozni és visszaélni lényeges kérdésekben.

Al Gore és az IPCC kapták tavaly a Nobel békedíjat. Mit szól ehhez?

Néhány ember dönt a díj odaítéléséről, és ez a döntés kicsit a gazdag nyugat-európai országok aktuális szándékát tükrözte.

Azt gondolom perdöntő motívum felismerni (nem csak itt a klíma témában), kevés ember irdatlan nagy hatását.

2010. augusztus 30., hétfő

Kérdés-felelet alapú kereső

.
Az index-címlap mai vezércikke az alábbi:

Jó kérdésre hülye válasz

Ezzel a kérdezz-felelek keresővel, mint témával sose foglalkoztam, még gondolati szinten sem, pedig szenzációs és érdekes téma. A cikkben említett közösségi támogatásról is csak egy konkrét projekt esetében hallottam, a Yahoonak volt egy képfelismerős / képaláírás-generálós története, ahol, ha két ember ugyanazt mondta, akkor elfogadták képaláírásnak.

Pár gondolat, ami eszembejut így reggeli elött:

* A legnagyobb részét a projektnek - a szövegbányászatot - most abszolút nem említeném, ez volt / van / lesz, hatalmas téma. Ennél a tárgybeli projektnél "csak" fel kell használni a téma arzenálja nyújtotta támogatást.

* Két technika merül fel azonnal a feladatban /mint a jelszótöréseknél :o)/ -> az algoritmus alapú és a szótár alapú technika. Az egyik amikor algoritmikusan meg akarjuk érteni, a gép számára értelmezhetővé akarjuk tenni például a "mi a szerelem" típusú kérdést. A másik amikor például konkrét kérdésre a konkrét válasz megvan a neten, akkor ezeket csak lajstromba kell venni és az összes rokon módon feltett kérdést csak pluszba rájuk kell irányítani (meg persze kezelni a bábeli nyelvzavar örökölt problémáját).

* Mi a fenti bulletpoint üzenete? Hogy érdemes végiggondolni mekkora alapkincs (szótár) áll a rendelkezésre kérdés-válasz gyűjtésre. Az intuició azt súgja (legalábbis e blog írójának), hogy alapvetően és először alulról felfelé érdemes építkezni (minél automatikusabban). Hozzátéve, hogy fölülről-lefelé való építkezéseknél célszerű minél hatékonyabban bevonni az emberi közösséget.

* A következő gondolatom a témában, ami csak közvetetten derül ki az indexes cikkből, hogy nem válogatás nélkül dolgoznám fel szövegbányászattal a netes dokumentumokat (azok irdatlan és nagyon zajos mennyisége miatt) kérdés-feleletek után nyomozva, hanem
(1) venném a már meglévő kérdezz-felelek adatbázisokat
(2) aztán venném a hagyományos keresők keresőkifejezéseit
(3) míg legvégül a természetes emberi nyelv szókincsét.
(+1) az ezutáni következő lépésen meg ráérek a következő témabeli poszt írásakor gondolkodni. :o)

* Mi esik át a szitán a fenti menetrend alapján? Hát az olyan kérdések, amik értelmesek,  van is rájuk válasz, csak még nem tették fel. Én viszont azt mondom, az első fázisnak a már feltett kérdéseknek kellene lenniük. És számomra kérdés, szükséges-e egyáltalán egy ilyen projekt keretében foglalkozni a potenciális kérdésekkel. (Az persze nyilvánvaló, hogy a folyamatosan érkező új kérdésekk persze bővítést jelentenek, nem ezt feszegetem e bekezdésben).

* Legvégső esetben meg a kérdezz-felelek símán átcsaphatna normál keresőbe, ha nem sikerül választ adni (ehhez persze algoritmikusan fel kéne ismerni a jól nem megválszolható kérdéseket illetve kellene generálni egy hagyományos keresőkifejezést. Ez egy igen izgalmas alprojekt lehetne.

* A definitive kérdezz-felelek adatbázisok már eleve kérdés-feleleteket tartalmaznak, ugye, ott maximum az összefűzés (merge), hiperlinkelés és a többnyelvűség lehet csak a probléma (nagy vonalakban).

* Azt gondolom triviális: keresőkifejezés-alapú kérdezz-felelek keresőt a Google Corporation tudna építeni leggyorsabban és leghatékonyabban, és ami fő alapvetően közösségi támogatást nem igénylően, tök automatikusan. A guglinak ugyanis óriási adatbázisa van/lehet a már eddig neki feltett kérdésekről:

(1) Összes feltett keresőkifejezés (darabszámmal)
(2) A feltett kérdésre adott találati oldal(ak)
(3) A találati oldalakon egymás utáni klikkelések, különösen az utolsó klikkelés
(4) IP-címről indult-e új keresés
(5) Leszűrni mely oldalakon találnak választ a kereső felhasználók (gyakoribb kérdéseknél)
Stb.

* Ha már említettem az irdatlan mennyiséget és a zajt: miért is a keresőkifejezések alapján érdemes elkezdeni bővíteni a kérdezz-felelek alapadatbázist? Mert legyünk durvák van a nyelvünkben durván egymillió szó, ami szófajokba szervezhetők, és van használati gyakoriságuk. Ha el kezdenénk generálni az értelmes kérdéseket (pl.: "van-e élet a halál után" típusúakat), az nem egy beláthatatlan feladat. A rettenet feladat az ahhoz kötödik, hogy a világban lévő minimum exabyte méretű információtenger van, ami rohamosan nő is. Igenám, de annak nagy része zaj és szemét, és lássuk be értelmes ember kérdése alig-alig vezet bele.

* Összefoglalva tehát, nagyon sok információ van, ezek túlnyomórészt atomiak, rájuk egyszerű kérdéseket generálni ("hány betű van a taxi szóban"), viszont nagy részére a kutya sem kiváncsi. Nemkicsit szemfényvesztés tehát az indexes cikkben a százmilliárdok említése. A másik véglet, hogy vannak az értelmes, egyre komplexebb és/vagy több alakú kérdések kérdések, amikre jó lenne választ találni, ezekből jóval kevesebb van, viszont a kérdés-válasz generálás is nehezebb feladat.

* Itt érkeztünk el tehát a következő fázishoz, hogy a kérdéseket tehát alaposan rendszerezni kell. Hogy ne mondjam hierarchiába / taxonómiába szervezni őket, súlyozással / priorizálással kombinálva.
(1) Mik a különböző alakú de azonos kérdések
(2) Mik a gyakori kérdések,
(3) Mely kérdések kérdeznek atomi vagy összetett információra
Stb.

* Informatikusként / programozóként, azért nem lenne lehetetlen feladat egy ekkora projekt keretén belül, mondjuk egy programozási nyelvre egy értelemesen használható hierarchizált / hiperlinkelt FAQ / GYÍK generálása.

* Érdekes kérdés a közösségi támogatás bevonásának kérdése. Ott ugyanis nemcsak a hogyan a kérdés, hanem a hibaszűrést, a zajszűrést, a projekt elleni 'támadó' fellépést is megfelelően kell menedzselni.

* Persze van a dolognak létjogosultsága, hiszen az emberek szeretnek kérdéseket megválaszolni (meg válaszokat minősíteni (ratingelni), és adott esetben olyan minőségű válasz születhet humán erőforrás billentyűzetéből, amit programból generálni sosem lesz esélyes.

Végül, de nem utolsósorban a társblog mai szenzációs posztja egy kis derühöz: :o))

Képes illusztráció a PhD-ről

2010. augusztus 27., péntek

Előrejelzés. Kinek higgyen az ember?

.
Az index.hu friss cikke kiváló apropót nyújt arra, hogy egy régi fixa ideámról szóljak pár szót a blog keretei között.

Rémes hónapok várnak ránk

Ismét megszólalt a válságot már idejekorán megjósoló professzor, Nouriel Roubini. A jósprofesszor ezúttal az újabb gazdasági recesszió valószínűségét 40 százalékra tette, amit elsősorban a megszűnő kormányzati gazdaságélénkítő programok negatív hatásaival és a jegybank gyengülő hatékonyságával magyaráz.

Lépjünk túl az index.hu azon slamposságán, hogy pontosan milyen válságot is jósolt meg a professzor (amit a cikkben globális pénzügyi válságként aposztrofálnak)

Nézzük meg, hogy csak az indexen belül Roubini hogyan szerepelt, a 2008 nyárvégi Lehmann Brothers bedőlés elött. Persze kézenfekvően merül fel a kérdés, miért jövök itt az index.hu-val. Egyrészt mert rendszeren belül akarnám vizsgálni a dolgot, akkor is, ha adott konkrétumban a sajtóorgánum éppenséggel téved (rosszul hangsúlyoz). Másrészt mert az index.hu, a magyarországi online mainstream sajtó jellegzetes képviseletében, jelentős hatást gyakorol a magyar emberek véleményformálására, reakcióira (a híreivel, tálalásával). Különben sem vállalkozhatok egy blogposzt keretében mélyebb elemzésére, csak problémát szeretnék felvetni.

Mivel szerencsére elég jellegzetes neve van az úrnak, így könnyű a keresés.

Nyakunkon a pénzügyi válság? (2006.július 3.)

A régió országainak gazdasági-pénzügyi problémáival foglalkozik a Financial Times mai internetes kiadásának egyik cikke, külön kiemelve a lap szerint szinte minden fronton sebezhető Magyarországot - írja a Portfolio.hu. A neves brit lap utal rá, hogy a forint a május 29.-június 29. közötti időszakban mintegy 8,5 százalékot vesztett értékéből az euróval szemben, ami azt jelzi, hogy hazánk Európa legsebezhetőbb gazdasága. A kérdés csak az, hogy ez a probléma mennyire marad magyar határokon belüli, vagy mennyire bizonyul fertőzőnek az EU más felzárkózó gazdaságai számára - jegyzi meg a cikk.

Az FT Christian Menegatti és Nouriel Roubini 2005-ös tanulmányára hivatkozva kiemeli, hogy a 14 vizsgált kelet- és dél-európai feltörekvő gazdaság mindegyike jelentős folyó fizetési mérlegdeficittel rendelkezett. Ezek mellett több országban az államháztartás is magas hiányt mutatott.

Magyar üzletemberek nélkül Davosban (2007.január 25.)

Természetesen a szakértők rámutatnak a kockázatokra is: a New York Egyetem professzora, Nouriel Roubini előadásában kifejezésre juttatta azon aggodalmát, hogy kemény földet éréssel végződik az amerikai gazdaság szárnyalása.

Öt év múlva jöhet a válság (2007.május 21)

Ugyanakkor beléptek más jellegű kockázatok is, melyeket az extrém nagyságú likviditás és a hatalmas eszközbuborék képvisel – állítja viszont Nouriel Roubini, a New York-i Roubini Global Economics LLC elnöke.

Az első cikk emleget pénzügyi válságot de más kontextusban és azt firtatva, hogy éppen az olyan sebezhető kicsik mint mi, dönthetjük romba a világot.

Lehmann Brothers bedőlése elött 19 hónappal szintén(?) megkondulnak a vészharangok. Az események valóban "kemény földetérésben" kulmináltak. Mondjuk nem derül ki, hogy miért is vélekedett így a professzor. Nem belemenve a részletekbe, így ebben a formában csak 50-50% az előrejelzés beteljesülésének esélye, hiszen vagy igen vagy nem a végeredmény.

Lehmann Brothers bedőlése elött 15 hónappal már konkrétum is kerül elő. Az amerikai másodlagos jelzáloghiteles subprime válság motivumai bukkanak fel. Ehhez viszont nem kötödik válságjelzés.

Ha össze akarnánk foglalni mit tekintünk komolyan vehető előrejelzésnek, akkor tehát meg kéne követelni 
(1) egy eseményt (válság)
(2) egy időpontot valamilyen hibahatárral (hiszen válság mindig volt és lesz)
(3) valamilyen alátámasztó érvelést (hiszen világvégét egy jehovás is tud előrejelezni).
(+1) Plusz elvben mindehhez kapcsolódna utólag egy kiértékelés is, az időpont után.

Na ha ezzel megvolnánk akkor jön a következő lépés. Hány ilyen időpont elötti előrejelzés van a világban? Azt hiszem mondhatjuk, hogy
(1) nagyon sok
(2) a totális nemtől a teljes igenig a teljes spektrumot felölelően.
Ezekből kéne választanunk valahogy véleményünk megformálásakor.

A következő probléma, hogy ha valaki egyszer jelzett jól előre, akkor az ő szavára érdemes-e jobban odafigyelni. Miért is garancia egy sikeres előrejelzés egy további sikeres előrejelzéshez? Vagy megfordítva aki egyszer tévedett az legközelebb is téved?

Ugyanide vágó hasonlatos probléma (lásd még idősorok), az a divatos irány, ami igyekszik a hasonló típusú komplex folyamatokba ciklusokat belelátni ( Martin Armstrong: It's Just Time , Kondratieff hullámok ). Ez ugye megkönnyíti az előrejelzést hiszen (most durván szólva) a sinus görbénél is tudjuk mikor vevődik fel a maximum/minimum. De kérdés, hogy a ciklus valóban adekvát ciklus-e, örökéleten át tart-e, és ha nem akkor nem most generálódik-e kivétel. Azaz itt sem vagyunk beljebb a saját értékelésünkkor.

Most nem foglalkoznék az olyan pszichológiai vetületekkel mint önbeteljesítő jóslatok vagy az Antalffy Tibor tipusú armageddonistákkal. (Noha személy szerint én is sokszor inkább felhősen látom a jövő egét)

A kérdés azonban fennáll. Milyen előrejelzéseknek higgyünk?

Adatbányászként az alábbi analógiára támaszkodom. Az adatoknak mindig jobban lehet hinni mint az előrejelzésnek. :o) Hiszen ha már az adat is rossz, akkor azonnal nincs értelme a ráépülő előrejelzésről beszélni. (Az olyan komolytalanságokat most hagyjuk figyelmenkívül, hogy valaki rossz adat alapján jelez előre jól.)

Magyarán és lefordítva, mindig az érvelésekből érdemes szerintem kiindulni (és függetlenül attól, hogy ki mondja). Mennyire támaszkodik érvényes elvekre, mennyire jól súlyoz/priorizál, ha van mögötte adatos elemzés, az mennyire elfogadható stb. Az meg hogy egy földön mint emberek hálózatán végigfut-e egy rengés (mint például a mondjuk most így nagyvonalúan: 2008-cal induló globális pénzügyi válság) vagy pláne, hogy ez mikor következik be, azt az üveggömbbel dolgozó cigányjósasszony is ugyanolyan 'hitelesen' tudja prezentálni. Vannak annyira komplexek a (nyugati) gazdasági és társadalmi viszonyok, hogy ez mondhatni lehetetlen legyen (hitelesen).

Van viszont egy aspektus ami mellett nem mehetek el szó nélkül. A "befektetők" (akiket az index is előszeretettel emleget, és aki névtelen láthatatlan tömeg), azok
(1) szeretnek különféle konkrét elemzésekre támaszkodni, többnyire ösztön- semmint objektív komolyanvehető alapokon fogadják el őket (vagy hogy éppen melyikre fizetnek elő).
(2) Ami ennél is súlyosabb probléma a befektető aktorok együttesen óriási rengéseket tudnak előidézni a világban, rámutatva golyóbisunk emberiségének óriási sérülékenységére, egyúttal teret adva a másodvonalbeli politológia iránt érzékenyeknek egy jó kis ideológizálásra saját koncepcióik hirdetésére.

2010. augusztus 19., csütörtök

Két mondás: igazságosan egy nyugatról, egy keletről :o)



Szívnek megvannak a maga indokai, amelyeket az indokló értelem nem ismer. (Blaise Pascal)


A laikus fejében sok lehetőség kínálkozik, a mesterében csak kevés. (Daisetz Teitaro Suzuki)