Bestämma signifikansnivå enligt beslutsregeln

Hej!
Hur vet man att det handlar om binomialfördelning här ? Varför är p=0.5 och hur listar man ut det om H0 är sann enligt beslutsregeln för att bestämma signifikansnivå?
Hur vet man att det handlar om binomialfördelning här ?
Vi har ett fixt antal försök () där varje försök har två utfall: eller . Sannolikheten för ett "gynnsamt" utfall är lika i varje försök och försöken är oberoende av varandra. Detta är exakt definitionen av en binomialfördelning (kolla upp i kursboken eller online om du inte är säker).
Varför är p=0.5
Nollhypotesen säger att den genomsnittliga skillnaden är noll. Om detta är sant innebär det att det inte finns någon systematisk skillnad och för varje kvinna är det då lika sannolikt att få ett som ett , dvs. att .
hur listar man ut det om H0 är sann enligt beslutsregeln för att bestämma signifikansnivå?
En hypotesprövning på ett stickprov kan aldrig visa huruvida någon hypotes är sann. Det finns alltid en chans att man drar fel slutsats, så det är inte korrekt uttryckt att säga att nollhypotesen är sann eller falsk. Det kan vi nämligen aldrig veta helt säkert om vi inte mäter varenda svensk kvinnas underarmar. Det är därför man ofta uttrycker det som att man "förkastar" nollhypotesen, eller "reject" på engelska. Det betyder dock inte att man visat att någon av hypoteserna är sanna/falska.
Det finns 7 st plustecken och 3 st minustecken. Beslutsregeln säger att vi förkastar om antalet plustecken är högst 1 eller minst 9. Eftersom varken eller så förkastar vi inte enligt denna regel. Detta behöver vi dock inte svara på i uppgiften.
Signifikansnivån, kalla den , är per definition sannolikheten att förkasta nollhypotesen om den vore sann, dvs.
, vilket enligt beslutsregeln är
, vilket vi beräknar med hjälp av binomialfördelningen:
,
(pga. symmetri), så
.
Gustor skrev:Hur vet man att det handlar om binomialfördelning här ?
Vi har ett fixt antal försök () där varje försök har två utfall: eller . Sannolikheten för ett "gynnsamt" utfall är lika i varje försök och försöken är oberoende av varandra. Detta är exakt definitionen av en binomialfördelning (kolla upp i kursboken eller online om du inte är säker).
Varför är p=0.5
Nollhypotesen säger att den genomsnittliga skillnaden är noll. Om detta är sant innebär det att det inte finns någon systematisk skillnad och för varje kvinna är det då lika sannolikt att få ett som ett , dvs. att .
hur listar man ut det om H0 är sann enligt beslutsregeln för att bestämma signifikansnivå?
En hypotesprövning på ett stickprov kan aldrig visa huruvida någon hypotes är sann. Det finns alltid en chans att man drar fel slutsats, så det är inte korrekt uttryckt att säga att nollhypotesen är sann eller falsk. Det kan vi nämligen aldrig veta helt säkert om vi inte mäter varenda svensk kvinnas underarmar. Det är därför man ofta uttrycker det som att man "förkastar" nollhypotesen, eller "reject" på engelska. Det betyder dock inte att man visat att någon av hypoteserna är sanna/falska.
Det finns 7 st plustecken och 3 st minustecken. Beslutsregeln säger att vi förkastar om antalet plustecken är högst 1 eller minst 9. Eftersom varken eller så förkastar vi inte enligt denna regel. Detta behöver vi dock inte svara på i uppgiften.
Signifikansnivån, kalla den , är per definition sannolikheten att förkasta nollhypotesen om den vore sann, dvs.
, vilket enligt beslutsregeln är
, vilket vi beräknar med hjälp av binomialfördelningen:
,
(pga. symmetri), så
.
Jag förstår. Hur kommer man på att p=0.5 utan att ha räknat ut detta? Är det bara en regel att så fort nollhypotesen säger att det finns ingen genomsnittlig skillnad så innebär det att det finns 50 % sannolikhet att varje kvinna får + såväl som - i mätvärde?
Hur kommer man på att p=0.5 utan att ha räknat ut detta? Är det bara en regel att så fort nollhypotesen säger att det finns ingen genomsnittlig skillnad så innebär det att det finns 50 % sannolikhet att varje kvinna får + såväl som - i mätvärde?
Det är bra att du frågar, för det är faktiskt inte självklart.
Ska man vara noga så följer det faktiskt inte att från den nollhypotes som formulerats i uppgiften.
Det skulle nämligen kunna vara så att den dominanta underarm är 9 cm längre i 10% av fallen, och 1 cm kortare i 90% av fallen.
Låt vara definierad som "dominant armlängd - icke-dominant armlängd", dvs. längdskillnaden (med tecken).
Notera att man i tabellen i uppgiften inte mätt utan en annan variabel, kalla den , definierad av att antar värdet om och värdet om .
Väntevärdet av är noll, eftersom . Att väntevärdet av längdskillnaden är noll betyder precis att det inte finns någon genomsnittlig skillnad, vilket är vad nollhypotesen säger.
Men vi skulle i genomsnitt få 9 gånger fler - än + om vi fortsatte försöken som i uppgiften, eftersom det med 90% sannolikhet fås att .
Det som nollhypotesen säger kan alltså vara sant även fast .
För att korrigera detta så bör man formulera en mer exakt nollhypotes:
": fördelningen för är symmetrisk kring 0."
Denna hypotes innebär nämligen att . Samtidigt så är eftersom händelserna och är komplementhändelser. Detta ger oss att både och måste vara .
Jag tror att man i uppgiften menat med formuleringen "ingen genomsnittlig skillnad" att fördelningen är symmetrisk. Det är dock formellt sett ett starkare antagande att en fördelning är symmetrisk (i vilket fall den även har väntevärdet noll) än att den enbart har väntevärde noll.
Gustor skrev:Hur kommer man på att p=0.5 utan att ha räknat ut detta? Är det bara en regel att så fort nollhypotesen säger att det finns ingen genomsnittlig skillnad så innebär det att det finns 50 % sannolikhet att varje kvinna får + såväl som - i mätvärde?
Det är bra att du frågar, för det är faktiskt inte självklart.
Ska man vara noga så följer det faktiskt inte att från den nollhypotes som formulerats i uppgiften.
Det skulle nämligen kunna vara så att den dominanta underarm är 9 cm längre i 10% av fallen, och 1 cm kortare i 90% av fallen.
Låt vara definierad som "dominant armlängd - icke-dominant armlängd", dvs. längdskillnaden (med tecken).
Notera att man i tabellen i uppgiften inte mätt utan en annan variabel, kalla den , definierad av att antar värdet om och värdet om .
Väntevärdet av är noll, eftersom . Att väntevärdet av längdskillnaden är noll betyder precis att det inte finns någon genomsnittlig skillnad, vilket är vad nollhypotesen säger.
Men vi skulle i genomsnitt få 9 gånger fler - än + om vi fortsatte försöken som i uppgiften, eftersom det med 90% sannolikhet fås att .
Det som nollhypotesen säger kan alltså vara sant även fast .
För att korrigera detta så bör man formulera en mer exakt nollhypotes:
": fördelningen för är symmetrisk kring 0."
Denna hypotes innebär nämligen att . Samtidigt så är eftersom händelserna och är komplementhändelser. Detta ger oss att både och måste vara .
Jag tror att man i uppgiften menat med formuleringen "ingen genomsnittlig skillnad" att fördelningen är symmetrisk. Det är dock formellt sett ett starkare antagande att en fördelning är symmetrisk (i vilket fall den även har väntevärdet noll) än att den enbart har väntevärde noll.
Jag tror jag förstår det mesta förutom att X är symmetrisk kring 0 dvs P(X<0)=P(X>0) (varför är dessa sannolikheter lika ?). Jag kan förstå att en jämn funktion så är den symmetrisk kring y-axeln vilket jag antar är vad du menar här ? såhär säger AI:
"När man säger att en slumpvariabel är symmetrisk kring origo menar man att fördelningen är symmetrisk kring värdet 0. Samtidigt säger man att slumpvariabeln är symmetrisk kring origo , eftersom sannolikhetsmassan är lika stor på båda sidor om 0."
Ja, det betyder samma sak som att täthetsfunktionen är jämn i detta fall. Generellt är en täthetsfunktion symmetrisk kring om
för alla tal .
Med följer det bland annat att . Det blir uppenbart om du tänker på hur grafen till täthetsfunktionen ser ut.
Normalfördelningen är ett exempel på en symmetrisk fördelning (symmetrisk kring sitt väntevärde).
Gustor skrev:Ja, det betyder samma sak som att täthetsfunktionen är jämn i detta fall. Generellt är en täthetsfunktion symmetrisk kring om
för alla tal .
Med följer det bland annat att . Det blir uppenbart om du tänker på hur grafen till täthetsfunktionen ser ut.
Normalfördelningen är ett exempel på en symmetrisk fördelning (symmetrisk kring sitt väntevärde).

Aa här är grafen till täthetsfunktion och vi ser P(X<x) och sen P(X>x) på andra sidan. Normalfördelning är symmetrisk kring origo med E(X)=0
Antar att vi är klara här?