Dávná rada od Padáka | Mňamka #43

Transformace se nezdařila. What??! Ok, tak teda znova. Kde že je ta chyba? Aha, na řádku 770000 potřebuju "R" vyměnit za ";". No ******** !  ... Tak tohle zná snad každý, kdo někdy prováděl transformaci. Pro začínající analytičku samo o sobě celkem flustrující. A co teprve, když to CSV má 4GB a opravdu s ním není lehká "manipulace". Doteď si pamatuju tu opakující se velkou nekonečnou zoufalost :-) A pak přišla tahle rada jako dar z nebes od mého tehdejšího mentora - Tomáše Mátla.   

Základní příprava dat a Padákův deníček

Znáte blog Petra Šimečka z Keboola "Padákův deníček"? Kdo ne, tak vřele doporučuji si ho projít a přečíst. Najdete tam hodně zajímavého, hlavně pokud pracujete s Keboola. Ale zpátky k tématu - jak tedy naložit s velkým CSV, kde je na řádku 770000 chyba - a buhví kde ještě? Odpověď se jmenuje: Základní příprava dat v konzoli od Petra. Najdete tam několik rad, jak si připravit data v konzoli na serveru, včetně rady, jak získat levně server, na kterém si můžete hrát. 

A takhle vypadalo to tehdejší řešení od Petra. Jsou prostě rady, na které se nazapomíná a měly by se tesat do kamene! :-)

Eva

Máte k článku nějaké otázky nebo připomínky? Klidně mi napište, ráda to s Vámi proberu :-)

Eva Hankusová
detektiv nových příležitostí
LinkedIn

Zeptej se svých dat: BigQuery vs. Fabric vs. Copilot | Mňamka #558

Zeptej se svých dat: BigQuery vs. Fabric vs. Copilot | Mňamka #558

Je to sen skoro každého manažera: místo čekání na analytika prostě napíšu do chatu „jak nám rostly tržby po regionech za poslední kvartál?" a za pár vteřin mám odpověď, ideálně i s grafem. Říká se tomu konverzační analytika a tři velcí hráči ji dnes nabízejí. My jsme si všechny tři osahali. Tady je upřímné srovnání, co funguje a kde to zatím drhne.

Postavili jsme stejného AI chatbota nad firemními daty v Googlu i v Microsoft Azure. | Mňamka #557

Postavili jsme stejného AI chatbota nad firemními daty v Googlu i v Microsoft Azure. | Mňamka #557

Skoro každá firma dneska sedí na hromadě vlastních dokumentů - produktové listy, FAQ, smlouvy, zápisy z projektů. A skoro každá firma by chtěla to samé: chatbota, kterému napíšete otázku a on odpoví z vašich dat, ne z toho, co si kde přečetl na internetu. Zní to jednoduše. My jsme si to chtěli osahat pořádně, a tak jsme jedno a to samé řešení postavili dvakrát - jednou v Google Cloudu, podruhé v Microsoft Azure. Tady je, co z toho vypadlo.

Microsoft Fabric vs. dbt | Mňamka #556

Microsoft Fabric vs. dbt | Mňamka #556

Když firmy modernizují svou datovou platformu, narazí dřív nebo později na otázku, jaký datový stack zvolit a co je pro jejich byznys nejvhodnější. Migrovat na Microsoft Fabric? Nasadit dbt? Otázka je ale položená trochu zavádějícím způsobem, jde totiž o srovnání dvou věcí, které stojí na jiné úrovni datového stacku: Fabric je platforma, dbt je transformační nástroj, který na takové platformě běží. Přesto má smysl se ptát, jak se tyto dva světy doplňují, kde si uvnitř Fabricu konkurují nativní nástroje a dbt, a kdy se vyplatí sáhnout po dbt jako standardní transformační vrstvě.