Výuka a školení Excelu Výuka a školení Excelu Výuka a školení Excelu
Výuka a školení Excelu Výuka a školení Excelu

neděle 12. května 2013

Analýza nákupního košíku - marketingová zbraň hromadného ničení

Když si kupujete něco v eshopu, často se Vám stane, že e-shop nabídne ještě další zboží, které by se Vám mohlo hodit. Když si například chcete koupit notebook, nabídne Vám e-shop ještě tašku na notebook, klávesnici, myš... Často je to zboží, které se Vám hodí a vy si jej často koupíte - což je samozřejmě to, čeho chce e-shop dosáhnout.
Systém e-shopu totiž dobře pozná, které zboží by Vás mohlo zajímat. Pozná to podle toho, co si kupovali lidé před Vámi. Tedy když si lidé před vámi kupovali k notebooku tašku na notebook, nabídne to systém i Vám. 
Takové nabídky zboží jsou velmi efektivní - protože pravděpodobnost, že si takto nabídnuté zboží koupíte, je mnohokrát větší než při náhodném výběru.
Pojďme si takovýto odhad udělat v Excelu. Je to překvapivě jednoduché - systém po uživateli nechce, aby znal logiku výpočtu, stačí zadat data a pochopit výsledky.
Pro výpočet potřebuji dataminingový doplněk v Excelu.
V příkladu použiji demodata dodávaná s doplňkem.  
Jedná se o tabulku s objednávkami zákazníků (pokud byste pracovali s daty neuloženými v tabulce, je třeba nejprve tabulku vložit). Zajímá nás v zásadě jen první a třetí sloupec. V prvním je číslo objednávky a ve třetím nakoupené zboží. Všimneme si, že hodnoty v prvním sloupci (čísla objednávky) se opakují - je to logické, protože v rámci jedné objednávky zákazníci nakoupili více druhů zboží.
V menu doplňku kliknu na Associate.

První obrazovka je jen informativní a mohu ji s klidem přeskočit.
V další obrazovce jen mohu vybrat tabulku nebo rozsah buněk, obsahujících analyzovaná data.

V další tabulce pak vybírám z tabulky správné sloupce k analýze. Pro Transaction ID vyberu první sloupec Order Number a pro Item vyberu Product. Tedy v Transaction ID vybírám údaj, který definuje skupinu, do které položka patří, a v Item vyberu to, co vlastně chci analyzovat.

Na další obrazovce nemusím nic měnit, jen kliknu na Dokončit a tím se spustí výpočet, který de facto probíhá ne v Excelu, ale na SQL Serveru (což nám ale může být jedno).
Takto vypadá výsledek:

Než se nad výsledkem zamyslím, přepnu si v Show Show attribute name and value na Show attribute name only. Tím se zbavím slova Exists u všech položek a výsledky jsou přehlednější.
Co mí tedy říká tabulka? Např. Probability 100%, Importance 0,96 a Rule "Classic Vest, HL Road Tire "šipka" Road Tire Tube mi říká, že ten, kdo si koupil současně "Classic Vest" a "HL Road Tire", si s nejvyšší možnou pravděpodobností koupí i "Road Tire Tube". Význam toho pravidla je 0,96, což vychází z toho, kolikrát se tato skutečnost v datech opakuje. Čím vícekrát a číslo je vyšší, tím je toto pravidlo samozřejmě prověřenější a dá se na něj více spoléhat.
Tabulku si mohu vyexportovat do Excelu pro snadnější použití při řízení marketingových kampaní.
Pro jiný pohled na souvislosti se ještě lze podívat do karty Dependency Network - interpretaci výsledků asi není třeba popisovat....

Analýza nákupního košíku - marketingová zbraň hromadného ničení

Když si kupujete něco v eshopu, často se Vám stane, že e-shop nabídne ještě další zboží, které by se Vám mohlo hodit. Když si například chcete koupit notebook, nabídne Vám e-shop ještě tašku na notebook, klávesnici, myš... Často je to zboží, které se Vám hodí a vy si jej často koupíte - což je samozřejmě to, čeho chce e-shop dosáhnout.
Systém e-shopu totiž dobře pozná, které zboží by Vás mohlo zajímat. Pozná to podle toho, co si kupovali lidé před Vámi. Tedy když si lidé před vámi kupovali k notebooku tašku na notebook, nabídne to systém i Vám. 
Takové nabídky zboží jsou velmi efektivní - protože pravděpodobnost, že si takto nabídnuté zboží koupíte, je mnohokrát větší než při náhodném výběru.
Pojďme si takovýto odhad udělat v Excelu. Je to překvapivě jednoduché - systém po uživateli nechce, aby znal logiku výpočtu, stačí zadat data a pochopit výsledky.
Pro výpočet potřebuji dataminingový doplněk v Excelu.
V příkladu použiji demodata dodávaná s doplňkem.  
Jedná se o tabulku s objednávkami zákazníků. Zajímá nás v zásadě jen první a třetí sloupec. V prvním je číslo objednávky a ve třetím nakoupené zboží. Všimneme si, že hodnoty v prvním sloupci (čísla objednávky) se opakují - je to logické, protože v rámci jedné objednávky zákazníci nakoupili více druhů zboží.
V menu doplňku kliknu na Associate.

První obrazovka je jen informativní a mohu ji s klidem přeskočit.
V další obrazovce jen mohu vybrat tabulku nebo rozsah buněk, obsahujících analyzovaná data.

V další tabulce pak vybírám z tabulky správné sloupce k analýze. Pro Transaction ID vyberu první sloupec Order Number a pro Item vyberu Product. Tedy v Transaction ID vybírám údaj, který definuje skupinu, do které položka patří, a v Item vyberu to, co vlastně chci analyzovat.

Na další obrazovce nemusím nic měnit, jen kliknu na Dokončit a tím se spustí výpočet, který de facto probíhá ne v Excelu, ale na SQL Serveru (což nám ale může být jedno).
Takto vypadá výsledek:

Než se nad výsledkem zamyslím, přepnu si v Show Show attribute name and value na Show attribute name only. Tím se zbavím slova Exists u všech položek a výsledky jsou přehlednější.
Co mí tedy říká tabulka? Např. Probability 100%, Importance 0,96 a Rule "Classic Vest, HL Road Tire "šipka" Road Tire Tube mi říká, že ten, kdo si koupil současně "Classic Vest" a "HL Road Tire", si s nejvyšší možnou pravděpodobností koupí i "Road Tire Tube". Význam toho pravidla je 0,96, což vychází z toho, kolikrát se tato skutečnost v datech opakuje. Čím vícekrát a číslo je vyšší, tím je toto pravidlo samozřejmě prověřenější a dá se na něj více spoléhat.
Tabulku si mohu vyexportovat do Excelu pro snadnější použití při řízení marketingových kampaní.
Pro jiný pohled na souvislosti se ještě lze podívat do karty Dependency Network - interpretaci výsledků asi není třeba popisovat....

pátek 10. května 2013

Rozdíl mezi směrodatnou odchylkou a směrodatnou odchylkou

Musím říct, že rozdíl těchto dvou položek v menu není na první pohled úplně patrný :)

Výsledky jsou mírně odlišné, proto se asi liší způsob zpracování vstupů - ale nešlo by to lépe popsat?

čtvrtek 9. května 2013

Šestá hádanka - detektivní (kartel benzínek)

Představte si, že jste analytikem Úřadu pro ochranu hospodářské soutěže. Máte podezření, že některé benzínky jsou spolu domluvené a nastavují ceny společně - což je zakázané.
Víte, že v kartelu jsou spolu tři benzínky - jen nevíte, které. Poznáte to z přiloženého souboru, ve kterém jsou ceny benzínu za poslední měsíce?
Čísla jsou zcela vymyšlená.
Časová náročnost úkolu je do jedné minuty.
Další hádanky si můžete vyzkoušet tady.




Omezení doplňku PowerPivot v Office 2013

V minulých příspěvcích na tomto blogu jsem popisoval práci s doplňkem PowerPivot. Myslím si, že je to věc, která se Microsoftu opravdu povedla a která přináší i běžným uživatelům možnost využívat pokročilé techniky Business Intelligence.
V Office 2010 to fungovalo tak, že jste si doplněk stáhli a pak, do kterékoliv verze, jednoduše nainstalovali.
Předpokládal jsem, že tak nějak to bude fungovat i ve verzi 2013. V Microsoftu si ovšem asi řekli, že je třeba zákazníky po čase zase trochu naštvat. A od verze 2013 povolili PowerPivot pouze k verzi Office Professional Plus.
Jinými slovy pokud máte Office pro domácnost (3500 Kč) nebo pro podnikatele (6800 Kč), tak máte smůlu. Pro použití PowerPivotu si musíte koupit Office pro profesionály (14000 Kč). Za to dostanete jako bonus několik dalších aplikací, které nejspíš v životě nebudete potřebovat...
PowerPivot je hodně zajímavý pro každého, kdo se chce vážněji zabývat zpracováním dat v Excelu. Pokud je to i Váš případ a nechcete utrácet za nejdražší verzi Office, doporučuji velmi pečlivě zvážit přechod na novou verzi.

úterý 7. května 2013

Chcete být sexy? Naučte se pracovat s kontingenční tabulkou.

Myslíte si, že abyste byli sexy, je třeba dobře vypadat?
Pak nejspíše žijete v minulém století. Podle tohoto článku v Harward Business Review je v našem století tím nejvíce sexy ten, kdo umí analyzovat data.
Takže - klidně jezte, nesportujte a kašlete na svůj vzhled, ale kontingenční tabulky se učte :)

sobota 4. května 2013

Pátá hádanka - marketingová (kolik zaplatit za oslovení zákazníků)

Jste analytikem u významného mobilního operátora.
Vaše firma teď dostala zajímavou nabídku od marketingové agentury. Tato agentura Vám nabízí, že za určitou částku osloví 5000 Vašich potenciálních zákazníků ve věkové skupině mezi 27 a 29 roky.
Vy se teď připravujete na jednání s agenturou o ceně a potřebujete zjistit, kolik je maximální cena, za kterou se Vám ještě vyplatí nabídku využít.
Máte zjištěno, že zákazník, který si produkt koupí, pro Vás znamená čistý zisk cca 1000 Kč.
Při rozhodování Vám pomůže tabulka, kde máte výsledky oslovení zákazníků z dřívějších akcí, které byly velmi podobné.
Takže - za kolik ještě službu koupit a za kolik už ne?
Časová náročnost úkolu je zhruba několik minut.
Další hádanky si můžete vyzkoušet tady.