Hur funkar det då med Pizzan och när den ska skitas ut? Du kan väl säga att den ska skitas ut senast 3 dagar efter den har ätits? Men om du får reda på mer fakta/data om den som köper den klart du kan gissa mer exakt, eller?
Så du menar att man skiter på kommando? Ponera att Pizzan vid ett av
dina tillfällen innehåller bakterier som gör dig magsjuk 20 minuter efter
det att du ätit den. Då brakar din statistik samman eller så måste du föra
in osannolikhets variabler i din algorithm och hur många blir det?
Alla eller bara några få?
Ponera att du som mätobjekt skickar din granne till att köpa
en Pizza, redan där fick du således in en felaktig variabel.
Så fungerar det för de som jobbar med detta.
För visso men det låter för mycket Saida om det!
Det är just det som är Data Mining ju fler variabler du slänger in ju mer har du att jobba med. Det är skillnaden mellan statistik och data mining. hypotetsgenererande kontra hypotetskontrollerande.
Som sagt kolla på R. Testa får du se.
Jamen vad är det du pratar om då? Statistik och eller data mining?
Jo men det är en annan sak. Jag talar om att med en stor mängd data och massa variabler med olika grad av % sannolikhet predicera en människas beteende.
Visst, men det krävs då att allt data är kopplat till ditt mätobjekt och
att mätobjektet har ett mönster. Hur stor blir då % talet? Om personen
ifråga får reda på att den är ett mätobjekt så kommer den säkert att
ända sitt mönster för att störa mätningen. annars så är det ju fullständigt
meningslöst att vara medlem i Al Queda tex.
För att tex avgöra när denna ska köpa pizza, nappa på ett specifikt reklamerbjudande, vara en kreditrisk, eller varför inte vara en terrorist. Varför tror du NSA har alla Data Mining programm? :) För att de tycker det är kul att ha dem?
Ja absolut, men varför blanda ihop pizza köp med terrorist jakt, vad
är din konkreta poäng du vill fram föra i ditt resonemang?
Jag för min del har ju redan framfört att det ligger i FRA's intresse
med sociogram. kalla sen själv informations inhämtandet vad du vill.
Vad NSA verkligen borde vara intresserade av är Google. Snacka att finna mönster i stor mängd data. Undrar turerna dem emellan. :)
Det är för mycket data, hur ska du veta vad som är sant kring ett
visst objekt? Planterade data fins det gott om. Däremot har du nog
rätt att NSA rotar runt i Google.
Bevisvligen fungerar DM vad det gäller reklamerbjudanden tex. Det har jag sett massvis med exempel på.
Att folk är idioter, ja det är en säker sak att dom sen går på direkt marknadsföring det är en konsekvens men hur vet du att det är sant?
Sen ska man tolka resultat är det en annan femma. Barn som har större skor har högre IQ alltså har barn med större fötter högre IQ. Nix barn med större fötter är äldre än barn med små fötter. Det är åldern som är förklaringen. Det finns massvis med sådana exempel.
Inte om barnet har kromosomfel vilket kan göra att de kan ha
abnormt stora fötter.
Hursomhelst vad du pekar på är just det som Data Mning har utsatts för vetenskaplig kritik. Man ska inte fiska hypoteser, man ska inte lägga till variabler osv. Men så finns det de som skiter i detta rigida sätt att se på det hela så länge det fungerar och ger resultat.
Du menar NSA och FRA? Hmm, vad var poängen du ville få fram?
Att man använder statistik till fel saker och gör felaktiga beslut
utifrån detta?
Leif GW har ju kritiserat Polisens allt för rigida hållning till statistik
kring en person, se tomas quick, hur vissa manipulerar data för
att passa deras agenda, tror du NSA, CIA är bättre?