Zobrazují se příspěvky se štítkemanalyza. Zobrazit všechny příspěvky
Zobrazují se příspěvky se štítkemanalyza. Zobrazit všechny příspěvky

18. září 2015

Vizualizace nejvytíženějších poboček České spořitelny aneb víté kdy máte jít do banky?

Rozhodl jsem se po dlouhé době pro několik věcí - napsat článek v češtině (občas bloguju anglicky na http://kutil.org),  pohrát si daty a zkusit něco nového/netradičního (čti: to co nikdo ještě nezkusil). A tak jsem si naprogramoval robota, který zjišťuje kolik lidí je na pobočce v České spořitelně (ČSAS). Výsledky najdete na konci článku.


Když jsem poprvé viděl mobilní aplikaci Lístkomat od České spořitelny, tak mě příjemně překvapilo o jak pokrokové řešení se jedná. Pro připomenutí: jde o bezplatnou aplikaci, pomocí které můžete virtuální objednat na pobočku, zjisti jak dlouho budete čekat a kolik lidí je před vámi.



Přemýšel jsem, zda by těchto dat a vztahů nešlo nějak využít.

Po dlouhé době jsem se k myšlence vrátil a během krátké chvíle vytvořil prototyp. Pomocí reverzního inženýrství (= to jsou ti lidé s titulem gni.) jsem odchytil jaké HTTP requesty mobilní aplikace posílá.

O to více byla zajímavá samotná implementace (=střeva, backend, server), protože na pozadí jde opravdu o tak dlouho avizované Web API, tj. REST URL s tokenem při zasláíní requestu a JSON na výstupu.

Informace o pobočkách jsou např na URL adrese
http://csas.cz/webapi/api/v1//qmatic/branches/ID

kde místo ID je číslo pobočky (20-780)

Připojil jsem se a do Google Tabulky stáhnul všechny veřejné a dostupné informace o pobočkách.(white hat, neasi). Pak jsem si opět v Tabulkách pana Googla a pomocí Google Apps Scriptů (=když jsem ten Google Developer Expert, howgh!) naprogramoval triggery/spouštěče, které se každých zhruba 10 minut připojí na toto API a zjisti kolik lidí je na dané pobočce.

A celý tento zázrak jsem nechal běžet od 14.9 do {dnesni_datum}. Po prvním týdnu (= 5 dní) jsem měl cca 12 000 záznamů, které jsem měl jako řádky uložené stále v Google Tabulce. Nakonec jsem udělal kontigenční tabulku s agregací podle poboček a hodin.

Výsledek? Největší nával je na Štefánikově (průměr 10 lidí ve frontě)  s odstupem pak Vítězné náměstí (průměr 3 lidi) a Sokolovská (průměr 2 a půl člověka). Časově není překvapivé, že nejvíc lidí chodí na pobočku 15-17h. Podrobná data najdete najdete zde nebo jako embed níže.









Zajímá tě více?

30. července 2012

Svaté grály marketingu (1) - Google Schemer

Seriály na tomto blogu začínají a zároveň končí vždy u prvního dílu. Rád bych toto změnil tímto dílem a trochu můj blog oživil. V předposledním díle se hned podíváme na službu, která se jmenuje Google Schemer

Hlavní motivací ke vzniku služby jsou samotná data uživatelů, která se transformují do zpeněžitelné podoby. Google Schemer je nepřímá nástavba na sociální síť Google+, která vám umožňuje si označovat věci, které chcete udělat anebo následně označit jejich provedení. Najdete tak obecný scheme a přidáte ho mezi své. Můžete tak chtít vidět film Inception, získat Galaxy Nexus nebo uběhnout maraton. Zároveň se můžete podívat na věci, které je možné dělat na konkrétním místě - ať už jde o Paříž, Londýn nebo Prahu. Pokud cestujete, rozhodně to může být inspirující. Zároveň jsou schemes záložkovány do štítků, takže si snadno vylistujete inspiraci na knihy, aktivity pro dešťový den nebo pro piknik



A v čem je ta hlavní síla? Jednoznačně reklama - už to čicháte? Na Facebooku systém funguje na minulé aktivity. Líbí se vám město Paříž, kniha Hypnotizér nebo skupina Muse, protože jste ji v minulosti navštívili/četli/slyšeli. Kdežto pokud označujete,že byste rádi chtěli podívat do Londýna, přečetli knihu Derrena Browna nebo šli na koncert U2, tak se na vás rozhodně bude lépe cíli reklama. Letenky do londýna, výprodej knih nebo lístky na koncert. Po sjednocení podmínek používání u Google a návaznosti na jeden Plus účet je to již možné!

Služba tak vznikla především pro získání zájmu uživatelů, pro snadnější cílení reklam a možná i pro další statistické korelace. A protože namačkat vše do G+ by nemělo smysl, vznikla tak služba vedle - která ovšem zpočátku využívá vztahy (kruhy) vytvořené na plusku.



Zajímá tě více?

4. dubna 2012

Nejnavštěvovanější stránky Ataxo (návod jak jsem kdysi měřil H1.cz)

Před dávnou dobou jsem napsal článek Známe nejnavštěvovanější stránky (služby) na webu H1.cz, který vzbudil odezvy typu "jak že jsem to jenom změřil" či “on něco takového umí Google Spreadsheet”. Doba pokročila a tak jsem se rozhodl připravit krátký nástin toho, jak jsem to provedl. Některé z níže popisovaných věcí již nemusí fungovat a proto budu psát v minulém čase (jednotného čísla, třetí osoby, pohlaví mužského). Předně také musím napsat a upozornit na slovo “odhad” návštěvnosti. Sám vím, že nejde o 100% přesnou metodu, ale v rámci možnosti jste byli schopni alespoň rámcově či poměrově odvodit návštěvu jednotlivých stránek (např. kolik % uživatelů z hlavních stránky navštíví stránky kontaktů nebo o jaké služby je nejvíce zájem). Nemusíte se, prosím, namáhat upozorňovat na nepřesnosti a kritizovat správnost. 

U webu H1.cz jsem prováděl odhad návštěvnosti cca v době září-říjen 2010 a u ATAXO pak v době říjen 2010 - duben 2012 (nechal jsem to prostě běžet :-)

1) Seznam stránek
V prvním kroku jsem musel získat seznam stránek daného webu. U většiny webů naleznete něco jako sekce Mapa webu (http://www.ataxo.cz/mapa-webu) a u těch SEO lepších pak dokonce i sitemapu XML (http://www.ataxo.cz/sitemap.xml). Tato data jsem si zparsoval a udělal nich txt soubor. To pro případ když bych měřil déle a web se dynamicky změnil. Tento txt soubor jsem si uložil na server (netradičně ataxo.txt)

2) CSS hack (teorie)
Kdysi dávno měla většina prohlížečů (později už jen část těch méně chytrých) velmi zajímavý bug/feature. Každý navštívený odkaz (link) změní v prohlížeči svoji barvu. Uživatel má tedy přehled, na jakých stránkách již byl. A právě k této hodnotě se dostane JavaScript.

3) CSS hack (praxe)
Vytvořil jsem si PHP stránku, která automaticky načetla všechny URL odkazy z ataxo.txt a vytvořila HTML kód

<a id="s0" href="http://www.ataxo.cz/">http://www.ataxo.cz/</a><br>
<a id="s1" href="http://www.ataxo.cz/nabizime/male-firmy">http://www.ataxo.cz/nabizime/male-firmy</a><br>
<a id="s2" href="http://www.ataxo.cz/nabizime/velke-firmy">http://www.ataxo.cz/nabizime/velke-firmy</a>

V CSS jsem vytvořil styl, který zjistil navštívené odkazy (přes a:visited) a nastavil jim horní odsazení na 100 pixelů

#odkazy a:visited { top: 100px; }

4) JavaScriptu tomu vládne
V JavaScriptu jsem si načetl všechny odkazy z minulého kroku a zjistil jsem jaký je jejich offset (tedy které jsou těch 100 pixelů posunuté). Toto měli vlastně dle CSS stylu jen ty weby, na kterých daných návštěvník byl. Pak jsem podle jednoduché binární logiky vytvořil serii 0 a 1 (pořadí odpovídá pak dané stránce). Např. 010 znamená, že uživatel navštivil pouze prostředí stránku (tedy “s1” http://www.ataxo.cz/nabizime/male-firmy)
Toto číslo jsem si pomocí AJAXu uložil to TXT souboru, kde jsou již hodnoty z minulých návštěv (takže by tedy přičetla návštěva k druhému webu).

5) Sháníme crowd
No a co dál? Tento skript (např. iVan.php) jsem pomocí
IFRAME vložil na potřebné stránky, gadgety a další srandy po webu :) Převážně šlo o můj blog (v kódu nehledejte, už je fuč :)

Pokud tedy uživatel navšítvil web, automaticky se v iframe načetl můj skript (iVan.php), který načetl seznam všech stránek webu Ataxo (z textaku ataxo.txt), vykreslil HTML kód. CSS styl změnil vlastnosti již u navštívených odkazů a tyto jejich hodnoty (vlastně URL) uložil do dalšího souboru, který byl sumou všech návštěv pro jednotlivé stránky. Nejblíže byl vlastně Lukáš Zaplatílek,který o variantě CSS hacku hovořil a  čímž získává prvního bludišťáka. Gratulujeme!

6) Statistika (ne)nuda je!
Protože mám rád Google Spreadsheety a myslím že se hodí na všechno (kromě otevírání konzerv), tak jsem si importoval data právě sem. Vytvořil jsem si z toho pěkné (někdy i barevné) grafy a ukazoval je církvi, králi, vlasti, múzam a světu. (K. H. B.).

7) Intepretace výsledků 
Nejnavštěvovanější stránky (ad procenta - pokud má hlavní stránká 25 000 přístupů a v závorce je 20% tak stránká má 5 000 přístupů)
  • ataxo.cz/o-nas/reference/rozdeleni-podle-produktu/seo-optimalizace-pro-vyhledavace/list (58%) 
  • ataxo.cz/o-nas/reference/zakaznicke-segmenty/velke-firmy-a-korporace/list (57%) 
  • ataxo.cz/produkty/sprava-ppc/odmena-z-media (51%) 
  • ataxo.cz/produkty/sprava-ppc/garantovana-cena (43%) 
  • ataxo.cz/nabizime/male-firmy/emailing (35%) 
  • ataxo.cz/o-nas/reference/rozdeleni-podle-produktu/sprava-ppc/list (31%) 
  • ataxo.cz/o-nas/proc-ataxo (30%) 
  • ataxo.cz/o-nas/reference/zakaznicke-segmenty/zivnostnici-a-male-firmy/list (28%) 
  • ataxo.cz/nabizime/male-firmy (26%)

Nejvíce je zájem o o reference, u H1 to bylo O nás a Tým. Zajmavé, že..


Graf ve velkém, barevném provedení na  http://jsbin.com/aqiduk (pokud si z toho chcete udělat plakát)


Zajímá tě více?

11. ledna 2011

Analýza: Koupilo Ataxo firmu H1.cz za __ Kč ?

Disclaimer: Analýza je pouze mým pokusem, jak dospět alespoň k rámcové ceně jedné z nejzajímavějších transakcí v letošním roce (pozn. dnes je 11.1.2011 :-) tj. odkupu firmy H1.cz společností Ataxo, respektive jejím vlastníkem Garvest. Data jsem čerpal z dostupných zdrojů, analýzy jsou čistě mojí dedukcí. Na věc si udělejte vlastní názor a moje data neberte vážně.

Situaci netřeba představovat, stačí odkázat na tento článek, Ataxo koupila 100 procent v konkurenční H1.cz který rozpoutal vlnu na Twitteru. Proto jsem si v době zkouškového zkusil takovou malou analýzu, abych zabránil tomu, aby mě přepadla prokrastinace.


Vycházejme z podobné situace před 3 lety, kdy Garvest odkoupil minoritní podíl v Ataxo (zdroj). Za tuto část zaplatil 220 milionů korun, předpokládejem že koupil 40%, tak aby v té době významní akcionáři (Pavel Doležal a Petr Dejma) měli každý 30%. Jistě plánovali odkup zhruba za dva roky (což se skutečně stalo a odkoupili zbytek viz zdroj), takže v té době kupovali firmu za hodnotu budoucí (zápisky z Corporate Governance), což by mohlo činit 550 milionů Kč (tj. 100%) . Což je výhodné pro obě strany - nakupující  že nebude překročena cena a prodávající má jistotu oné transakce.

 Do roku 2008 jde o tvrdá čísla (zdroj firemní monitor), po roce 2008 jde o odhady meziročního růstu z grafu níže
Meziroční koefiicent k růstu


Aktiva Ataxodosahovala hodnoty 24 milionů Kč (zdroj firemní monitor). K tomu připočteme velmi dobrý růst, takže se jistě jednalo o zajímavou transakci.


Co kdybychom tato data aplikovali na H1.cz?

Ta v roce 2008 měla aktiva 3 miliony (zdroj firemní monitor) s taky velmi dobrým meziročním růstem (Vladimír Kovář má za cíl zveda obrat o 1.2 za rok). S růstem firmy patří i růst aktiv, které se dá předpokládat k nárustu na zhruba 6 milionů Kč. (meziroční růst 2007/2008 byl 1.88 násobků, což později řekl bych stabilizovalo na přibližných 1.44x násobku). Aktiva u firmy Ataxo (meziroční vývoj je zde zde neměnný, viz hodnoty 22, 24.3  a 24.1 milionů). zůstal stabilní na 24-25 milionů.

Poměr mezi aktivy H1 a Ataxo je tedy zhruba 4x násobně menší. Zároveň rozdíl v obratu za rok 2010 by z grafu mohl být 2.8x násobný (předpokládáme růst obou firem, o malinko menší než v letech minulých). Pokud z těchto dvou koeficientů vytvoříme geometrický průměr, vyjde nám kouzelná konstanta 3.3.

Takže pokud bychom podělili dříve získanou hodnotu 550 právě tímto číslem mohla by nám vyjít konečná hodnota nákupu v milionech Kč. (tj. 550 : 3.3).




Zajímá tě více?

29. srpna 2010

Šest důvodů proč talentová show Primy opět porazí Novu

Je to tak. Opět se bude opakovat cca čtyři roky starý souboj mezi Primou a Novou o stejný formát pořadu (tehdy šlo o reality show VyVolení vs. BigBrother). Tentokrát jde o hledání talentů, ve spojení se zahraničními (slovenskými) televizemi.


0:1


1.) Obecné "nemáme rádi Novu" a fandíme slabšímu
Na velké se více útočí, protože jsou více vidět nebo velkým můžeme více zavidět. Třeba takový Microsoft  - na poli operačních systémů, přiznejme si to otevřeně, je jediný systém - Windows (Linux, Mac OS jsou tak maličtí, že je nebereme v potaz - naopak u prohlížečů je to zajímavější, viz. stav IE,. Firefox, Safari, Opera, Chrome, Lynx etc.). A protože je MS hodně vidět, holt se na něho lépe útočí. - do několika let toto čeká Google, po další vlně přijde Facebook.

Přesně tohle nastává v oblasti TV - Nova je největší, takže lidi ji "obecně nemají rádi" (a řekl bych že z nich většina nadává a stejně kouká).

Druhou formou je že jako lidi obecně fandíme tomu menšímu, slabšímu - protože ten silnější už má z principu náběh na vítězství.

2.) Moderátoři
Paradoxní je že sama Prima chtěla přetáhnout Mareše na svoji loď - to se ji (naštěstí pro ni) nepovedlo. Určitě věřím že Leoš je chytrý moderátor, bohužel na českém rybníčku poněkud vyčpělý.. Je všude, moderuje velké akce, jeho vtipy jsou čím dál více předvídatelné a nevtipné (což je u vtipů průser, jaksi). To vše doplňuje svoji osobní image, kdy ze spokojeného manžela se synem, se stal mládenec co utrácí jak rychle to kreditka dovolí a prohání děvčata.

3.) Marketing, slogan

Daleko lépe to zvládla Prima. Potkal jsem malé děti jak si v autobuse zpívali pro sebe "Česko slovensko má talent, jen na Primě a Jojce" - tak to je známka dobře provedeného marketingu. Prostě slogan který se dá svázat s danou věci - to Nova nemá - nic uchopitelného.Talentmánia je celá nemastná, neslaná


4) Facebook
Předběžné údaje o konečné sledovanosti nám může poskytnout Facebook a jednotlivé fanouškovské stránky. Počet fanoušku Talentmánie Novy se blíží k 10 000, zatímco počet Česko-slovensko má talent Primy se blíží 15 000.


5) Formát pořadu
Na cca 10 minut jsem si pustil oba pořady, abych mohl porovnat. Nova se utápěla v trapnosti typu silvester "slavíme, tančíme, je to tu skvělé", který uváděl Mareš - jak jsem uvedl vyčpělý, bez jiskry, vtipu..

Naproti tomu Prima působí jako menší, skromnější. Díky tomu že má pro znás známější formát pořadu, je to divákovi bližši. Moderátoři stojí v zákulisí a komentují to (stejně tak jak známe z YouTube Susan Boyle nebo Paula Pottse)


6.) Influencers a "pošli to dál"
První komentování lidí na twitteru působí že Nova opravdu tento zápas prohrála Stačí se podívat na výpis všech přidružených hashtagů  http://talent.jdem.cz

To však není u konce - většina lidí ve svém okolí působí jako influnceři. Jsou to lidé, kteří zvládají používat IT a internet na vyšší než průměrné úrovni (proto mají/umí používat twitter :-) takže pro své okolí působí chytře. Tudíž jejich názory jsou respektovány  - a pokud taková osoba jen tak mezi řečí zmíní že ta Nova to opět pok*zila není se čemu divit že takto ovlivní i okruh přihlížejících..

Tak nebo tak, záleží na míře vašeho vkusu. Je jedno zda koukáte na jednu či druhou show, když v tu dobu můžete pomáhat sobě, králi, vlasti, múzám nebo světu.



Zajímá tě více?

13. června 2010

Byl Leonardo da Vinci geek nebo nerd ?

Pokud bychom měli označit renesančního malíře nálepkou dnešní doby, jednalo by se o příhrádku geek nebo nerd? A co vlastně tyto až mystické značky znamenají? Pojďme se na to chvíli podívat...


Historie
V každé době existovala skupina lidí, která v něčem převyšovala ostatní. To něco bylo spojené s myšlením a zkušeností. Tedy pokrok, který určoval a posouval další generaci společnosti.

Pravěk - v této době lidi nehleděli na jídlo zda jim chutná/nechutná, hlavním cílem bylo nasytit se a nezemřít. Většina lidí sbírala kořínky a jinou zeleninovou potravu, ti jiní chodili na lov, uměli sestavit luk a rozdělat oheň. Tato skupin často obsahovala muže (statečnější?), kteří byli většinou starší (zkušenosti?).
Takže máme lovce.
(kteří ostatním přidali divní - sakra proč se chceš nechat zabít kvůli jídlu...)




Antika - lidstvo se posouvalo a bylo nutné odpovědět na pár otázek ohledně bytí/nebytí. K hlavním představitelům řecké inteligence patřili filozofové/matematici. Zabývali se věcmi, které nás ovlivňuji doteď (např. Eukleidovy Základy o geometrii)
Takže máme filozofy+matematiky
(kteří ostatním přidali divní - "proč řešíte věci které nejsou aktualní" - a vida jak nadčasové myšlenky to byly)

Renesance - shodou okolností i když jde o návrat k antice, tak důležitou roli hrají malíři - dochází k objevení zlatého řezu, použití perspektivy,
Takže máme umělce
(kteří ostatním přidali divní - proč taky pořád něco malovat, bláznivé vynálezy, proč raději nejít do šenku)


Novověk - moderní doba jistě souvisí s parními stroji, elektřinou a výpočetní technikou. Vzhledem k tomu že se ze dvou prvních staly komodity dostupné pro všechny, bez schopnosti využít znalosti s tím spojené, lze vnímat jako nejdůležitější část lze právě výpočetní techniku.
Takže máme IT odborníky
(kteří ostatním přpadají divní - proč stále řešíte ty technologie, bavíte se o tom atd)






Jak na tom byl Leonardo ?

Leonardo byl typický renesanční člověk,který se věnoval malířství, zkoumal přírodu, sochal sochy, vynalézal, zajímal se o hudbu, architekturu a mnoho dalšího. Z toho jak já chápu dav pojmy, tak bych ho řadil mezi geeky, tedy člověk který se zajímal aktivně o moderní technické novinky, zůstal nepochopen a jeho práce je ovlivněna i několik století po jeho smrti.

A proč nebyl nerd ? Protože stále byl renesanční člověk a dbal i o svůj zevnějšek, snažil se jíst zdravě a sportoval. Nerdi jsou spíše lidi natolik zabráni do svého oboru lidského snažení, že neznají svět okolo




Geek obecný (Geekus geekus) v dnešní době ?

Tak jak si můžeme myslet. Pro okolí zůstává nepochopen, jenže pro mnoho lidí je neviditelnou cestou pokroku. Nebýt geeků, neměli bychom posun v IT tam kde je ted. Například Biil Gates (founder Microsoft) nebo (co -founder Apple) jsou typičtí představitelé.

Takže važte si geeků dokud tu ještě jsou - až budou druhem vyhynulým nastanou dvě možnosti.
Buďto úplný konec světa nebo nová znalostně-myšlenková revoluce - kde zas přijdou jiní - nepochopení...






Zajímá tě více?

26. března 2010

Jakým způsobem vyřešit vyhledávání s časovou lokalizací na internetu

Článek byl napsán pro blog předmětu Transformace SAAS: http://obchodnimodely.blogspot.com

V naší době internetové daleko více než kdykoliv předtím platí pravidlo, že není důležité mít všechny znalosti, ale vědět kde konkrétní věc najít. S množstvím rostoucích dat, roste i potřeba důležité informace třídit. Velmi zajímavou oblastí je třídění dle místního nebo časového hlediska. Pro časové hledisko nastávají dva problémy- jak vyhledat v již zveřejněných záznamech a s tím souvisí aplikace řadícího algoritmu. Druhým problémem je jak vyřešit zapsání časových informací k danému obsahu.

Vyhledávání


Internetové zdroje jsou plné časových záznamů, které se liší jak země od země či systém od systému. O zpětnou konverzi na svůj vnitřní datový formát se snaží velké vyhledávače, aby mohli s těmito údaji dále pracovat. Google takto indexuje nejen webové stránky (daří se mu i v případě českých variant), ale také např. naskenované články ze starších novin. Díky těmto meta-informacím o stránce, je může třídit dle uživatelských kritérií (např. vybrat článek z definovaného období)



Link na dotaz IBM uvedeného na obrázku výše



Jediným problémem je fakt, že uživatel musí přímo konkrétně definovat období, ze kterého požaduje dané výsledky. Vyhledávač stále chápe slova pro určení časového období (tj. včera, dnes a zítra nebo v sobotu večer a v neděli ráno) jen jako běžné fráze a tak s nima pracuje. Na prvních jsou nejlépe optimalizované výsledky na daná slova. Ideální případem je stav kdy frázi dnes identifikuje jako dnešní datum (= 26.3.2010) a dle toho filtruje výsledky vyhledávání z dalších klíčových slov.

Zapisování informací o obsahu k datu


Práci, by všem vyhledávacím robotům a tedy i koncovým uživatelům, ušetřilo masové použití mikroformátu. Mikroformáty jsou přesně definované vlastnosti html tagů, tak aby jim rozuměli hlavně roboti (či vyhledávací crawlery), a ohraničují data viditelná uživateli.

Např. tento segment kódu informuje o probíhající akci a datumu. (mikroformát: hCalendar)

<div class="vevent">
<p>Termín<span class="summary">zkoušky z předmětu Transformace SAAS</span> je naplánován na
<span class="dtstart">2010-05-13T11:00</span>.
</p>
</div> 


Takovéto označování dat pomoci meta-informací přináší výhody i pro uživatele s možnosti automatizovaného zpracování tohoto obsahu (např. přidání položky do kalendáře).

O výhodách použití mikroformátů si je vědom Google a ve svém blogovacím systému Blogger (na kterém běží i tento blog) je poctivě používá. U každého napsaného článku je datum vydání článku zapsáno např. takto.

<abbr class='published' title='2010-03-16T21:17:00+01:00'>21:17</abbr>

To již nyní umožňuje nechat si vyfiltrovat články publikované (např. zde najdete články na anglicky psaných blozích, publikovaných během posledních 12 hodin na téma SAAS)


Další servery taktéž přidávají sémantickou informaci. Facebook jakžto uzavřená platforma používá vlastní, i když stále snadno identifikovatelný formát. Twitter naopak otevřeně podporuje možnost přístupu jiným systémům (přes API)

Facebook
<abbr class="timestamp" title="Sat, 20 Mar 2010 09:58:57 -0700">15 minutes ago</abbr>

Twitter
<span class="published" title="2010-03-20T10:07:06+00:00">about 7 hours ago</span>


Řazení výsledků


S rozvojem mikroblogovacích systémů (Twitter, později Buzz a můžeme zde zařadit i Facebook) se klade důraz na časovou a místní meta-informaci. Jakmile tedy uživatel něco publikuje, je cílem systémů tuto zprávu zaregistrovat, zpracovat a poskytnout. Vzniká pojem real-time search, který nečeká na vytváření zpětných odkazů a budování např. PageRanku. Cílem je zachytit a nejrychleji zobrazit. Jenže nastává problém v tom, která informace je důležitějši.


V dosavadním modelu řazení výsledků vyhledávání se zohledňovala důležitosti pro uživatele. Ta je často vyjádřena mnoha neveřejnými faktory (mluví se zhruba o stovce), mezi nejznámější patří - množství klíčových slov, jejich umístění a semantické označení, počet odkazů vedoucí na stránu a ze stránky, počet návštěv daného webu atd. Pokud se všechna tato data vloží do matematické formule, vyjde jedno konkrétní číslo vyjadřující kvalitu stránky.


V modelu novém je ve chvíli položení dotazů, mnoho odpovědí. Ty jsou řazeny pouze podle jednoho kritéria - datum publikování, s tím že nejrelevantnější příspěvky jsou nejvýše.



Závěr 
Již publikované texty se průběžně zpětně doplňuji o meta-informaci datumu a času, tak aby mohli uživateli poskytnout větší svobodu při filtrování výsledků. Důvodem je přidaná hodnot pro uživatele.


Do budoucna širší používání mikroformátů, umožní poskytování kvalitnějších výsledků, se kterýma se dá snadněji pracovat. Jakmile toto bude reálně funkční, zbývá kousek k dodefinování algoritmů, aby rozuměli slovům časového významu (dnes, zítra, atd).


Na závěr bych ukázal zajímavý koncept pro vizuální vyhledávání, řešící jako lokační tak časovou filtraci [1]. Na mapě vybere oblast (vyřešení lokaĺizačního filtru) a v panelu vybere období (vyřešení časového filtru). Dále se dodefinuje oblast zájmu (fotky, videa, události, zprávy) a konečně i vyhledávací dotaz.






Otázka na závěr: Budeme k informacím vždy přistupovat pouze textově přes jedno vyhledávací pole ?


Zdroj:
[1] FAAS, Michel: Virtual Moment for Google Maps/Earth
http://www.slideshare.net/MichelFaas/virtual-moment-presentation



Zajímá tě více?

5. prosince 2008

Toto bude skladba Vánoc v České republice

Párkrát v minulosti se mi stalo, že jsem dopředu odhadl jakým směrem půjdou určité trendy (hudba, film, web, školní učivo ;). Baví mě analyzovat, přemýšlet, dávat dohromady, jenže dosud jsem nepublikoval žádný hmatatelný (psaný text). Rozhodl jsem jít s "kůži na trh" i za cenu že moje analýza bude špatná.

Hitem letošních vánoc bude písnička Could You Would You Should You od hitmakera Shauna Bakera (V.I.P, Hey Hi Hello).





Zde jsou důvody proč právě ona:

Vztah k České repulice
Jedná se o disco remix známe melodie z vánoční pohádky Tři oříšky pro Popelku. Tuto informaci jsem se dozvěděl již během srpna a marně jsem sháněl jakékoliv zmínky či hudbení ukázku, protože mě to zajímalo jak se remix povedl.Nikde jsem nenašel žádnou zmínku. Písnička tedy mohla být uvedena už v září, ale autor počkal až na správné načasování. O to více že Tři oříšky pro Popelku k vánocům patří, jedná se vždy o nejsledovanější večerní pořad, nejoblíbenější vánoční pohádka se známou hudbou Karla Svobody.


Se silným rádiem v zádech
Evropa2 se může pyšnit značkou nejkomerčnější a nejposlouchanější rádio. Její vliv jsme mohli postřehnout již v září, kdy z neznámého písničkáře Marka Ztraceného a jeho písničkou Ztrácíš udělala skoro přes týden hudbení hvězdu. Jeho písničku si zamilovala plno lidí a o Markovi se začalo mluvit.

Opět se opakuje podobný scénář, jenže Evropa2.cz jde ještě se silnějším kalibrem. Nabízí zdarma ke stažení MP3.To způsobí ještě snadnejší rozšíření mezi početnou skupinu uživatelů internetu, kteří nechají hudbu hrát svým kamarádům z mobilu, iPodu nebo si dále budou přeposílat linky na stažení.



Milujeme Bakera
Jeho dva poslední hity V.I.P a Hey Hi Hello se dostaly na první místo v žebíčku nejhranějších skladeb týdne. Stejný úspěch se povedl v 4x větším sousedním Polsku. Je vidět že jeho styl hudby našim posloucháčam sedí.

Hvězda stoupá vzhůru
Dle hratelnosti písniček v rádii jsem zjistil že před čtrnácti dny byla teprve nasazena, minulý týden byla 69. nejhranější skladbou a tento týden je na 43. místě.

Dvě verze
Existují dvě verze písničky, v horním videu si můžete pustit Disco remix (pro mladaší publikum, poslouchače rádii, discofili) a v dolním videu je normální pomalá verze pro všechny ostatní (babičky, děděčky, rodiny s dětmi ;)






Na závěr použiji slova Pavla Maňase ze společnosti Helios (powered by LCS), která zmínil že lepší nepřesná analýza budoucnosti, než dobrá analýza starých dat..

Nechť toto byl první článek nové sekce ANALÝZA.


Zajímá tě více?