Asesmen kumulatif CA02
Asesmen ini bernilai 100 poin. Sepuluh masalah masing-masing bernilai 10 poin. Semua peluang, harapan, dan risiko harus menyebut hukum pengambilan sampel yang dipakai. Nama teorema tanpa asumsi pokoknya tidak memperoleh poin yang dialokasikan untuk asumsi. Jawaban numerik tanpa derivasi tidak memperoleh poin derivasi, dan aproksimasi harus dibedakan dari identitas sampel berhingga.
Masalah 1 — pengambilan sampel tanpa pengembalian dan indikator (10 poin)
Dari populasi berlabel \(1,2,3,4,5,6\), dipilih tepat tiga label secara acak seragam tanpa pengembalian. Tuliskan \(I_j=\mathbf1\{j\text{ terpilih}\}\), \(Y=\sum_{j=1}^6jI_j\), dan \(B=\{\text{sedikitnya satu dari label 5 dan 6 terpilih}\}\).
- Hitung \(P(B)\) dan \(P(I_1=1\mid B)\) dengan menghitung himpunan bagian.
- Turunkan \(E(I_j)\), \(\operatorname{Var}(I_j)\), dan \(\operatorname{Cov}(I_i,I_j)\) untuk \(i\ne j\).
- Gunakan indikator untuk menghitung \(E(Y)\) dan \(\operatorname{Var}(Y)\).
- Hitung \(E(Y\mid B)\), dengan membedakan label \(1,\ldots,4\) dari label \(5,6\).
Petunjuk 1
Ada \(\binom63=20\) himpunan bagian yang sama peluangnya. Komplemen \(B\) memilih ketiga label hanya dari \(\{1,2,3,4\}\).
Petunjuk 2
Untuk \(i\ne j\), gunakan \(P(I_i=I_j=1)=(3/6)(2/5)\). Untuk varians \(Y\), jangan hilangkan \(2\sum_{i<j}ij\operatorname{Cov}(I_i,I_j)\).
Jawaban singkat
Untuk setiap \(j\), \(E(I_j)=1/2\) dan \(\operatorname{Var}(I_j)=1/4\), sedangkan untuk \(i\ne j\), \(\operatorname{Cov}(I_i,I_j)=-1/20\). Maka
Solusi lengkap
Ruang sampel terdiri atas 20 himpunan bagian berukuran tiga, semuanya berpeluang \(1/20\). Kejadian \(B^c\) mempunyai \(\binom43=4\) himpunan bagian, sehingga
Jika label 1 sudah dipilih, dua label lain dipilih dari lima label tersisa. Agar \(B\) terjadi, tidak boleh keduanya berasal dari \(\{2,3,4\}\). Jadi ada \(\binom52-\binom32=7\) himpunan bagian yang termasuk dalam \(\{I_1=1\}\cap B\), dan
Simetri pengambilan sampel memberi \(P(I_j=1)=3/6=1/2\), sehingga peubah indikator Bernoulli tersebut mempunyai varians \(1/4\). Untuk dua label berbeda,
Kovarians negatif muncul akibat kendala ukuran sampel tetap, bukan independensi. Perhitungan indikator dan kovarians ini menerapkan teknik umum dari Solusi lengkap dan Solusi lengkap.
Linearitas harapan tidak memerlukan independensi, sehingga
Karena \(\sum j^2=91\) dan \(\sum_{i<j}ij=\{(\sum j)^2-\sum j^2\}/2=175\),
Untuk setiap \(j\le4\), hitungan yang sama seperti untuk label 1 memberi \(P(I_j=1\mid B)=7/16\). Untuk \(j=5,6\), kejadian \(I_j=1\) sudah menyiratkan \(B\), sehingga
Oleh karena itu
Masalah 2 — transformasi dan hukum minimum–maksimum (10 poin)
Misalkan \(X_1,X_2,X_3\) iid dengan densitas
Tuliskan \(L=X_{(1)}\), \(M=X_{(3)}\), dan \(R=L/M\).
- Tunjukkan bahwa \(Y_i=X_i^2\) iid Seragam\((0,1)\), lalu turunkan densitas bersama minimum dan maksimum \((Y_{(1)},Y_{(3)})\).
- Ubah kembali ke \((L,M)\) dan turunkan densitas bersamanya beserta kedua densitas marginal.
- Transformasikan \((L,M)\) menjadi \((R,M)\). Putuskan apakah \(R\) dan \(M\) independen.
- Hitung \(P(R\le1/2)\) dan \(E(M^2)\).
Petunjuk 1
Untuk \(0<y<1\), \(P(X_i^2\le y)=P(X_i\le\sqrt y)\). Untuk tiga peubah Seragam, satu titik menjadi minimum, satu menjadi maksimum, dan satu berada di antaranya.
Petunjuk 2
Pada transformasi \(a=l^2,b=m^2\), Jacobian mutlaknya \(4lm\). Pada transformasi \(l=rm\), Jacobian mutlaknya \(m\).
Jawaban singkat
Marginalnya adalah
Selanjutnya
pada \(0<r,m<1\), sehingga \(R\) dan \(M\) independen. Akhirnya
Solusi lengkap
CDF satu pengamatan adalah \(F_X(x)=x^2\) pada \((0,1)\). Karena transformasi kuadrat monoton naik di domain itu,
Jadi \(Y_i\) iid Seragam\((0,1)\). Kontinuitas membuat peluang terjadinya nilai kembar sama dengan nol. Untuk \(A=Y_{(1)}\) dan \(C=Y_{(3)}\), ada \(3\cdot2\) cara memilih label minimum dan maksimum, sedangkan observasi ketiga jatuh di antara \(a\) dan \(c\). Maka, seperti langkah umum pada Solusi lengkap,
Karena \(a=l^2,c=m^2\) dan Jacobian mutlaknya \(4lm\),
Integrasi pada dukungan segitiga memberi
Kedua integral bernilai satu pada domain masing-masing, yang juga mengaudit faktor Jacobian.
Untuk \(R=L/M\), inversnya \(l=rm\) dan Jacobian mutlaknya \(m\). Jadi
pada domain hasil kali \((0,1)^2\). Bentuk tersebut dapat difaktorkan menjadi densitas \(f_R(r)=4r(1-r^2)\) dan \(f_M(m)=6m^5\); integral keduanya sama dengan satu, sehingga independensi benar-benar terbukti. Hasil ini tidak bertentangan dengan ketergantungan \(L,M\): normalisasi melalui rasio telah menghilangkan skala yang ditentukan oleh maksimum. Terakhir,
dan
Masalah 3 — kuantil, titik ujung, dan audit himpunan dukungan (10 poin)
Delapan observasi iid kontinu mempunyai statistik urutan teramati \(x_{(2)}=1{,}1\), \(x_{(7)}=3{,}4\), dan \(x_{(8)}=4{,}0\).
- Tanpa mengasumsikan keluarga parametrik, misalkan \(q\) adalah median populasi unik. Hitung cakupan eksak selang \([X_{(2)},X_{(7)}]\) dan laporkan selang teramatinya.
- Sekarang tambahkan model \(X_i\sim\operatorname{Uniform}(0,\theta)\), \(\theta>0\). Bentuk selang kepercayaan eksak 95% untuk titik ujung \(\theta\) dari \(M=X_{(8)}\), lalu hitung nilainya.
- Transformasikan selang titik ujung itu menjadi selang 95% untuk median parametrik \(q=\theta/2\).
- Audit mengapa argumen Wald reguler tidak sah untuk titik ujung ini dan bandingkan asumsi dua selang median yang diperoleh.
Petunjuk 1
Jika \(K=\#\{i:X_i\le q\}\), kontinuitas dan keunikan median memberi \(K\sim\operatorname{Binomial}(8,1/2)\). Selang mencakup \(q\) tepat ketika \(2\le K\le6\).
Petunjuk 2
Dalam model Seragam, \(P_\theta(M/\theta\le u)=u^8\). Gunakan \(P(M/\theta\ge0{,}05^{1/8})=0{,}95\) dan ingat bahwa \(M\le\theta\) hampir pasti.
Jawaban singkat
Selang bebas distribusi \([1{,}1,3{,}4]\) mempunyai cakupan
Selang titik ujung eksak adalah
Karena \(q=\theta/2\), selang median parametriknya kira-kira \([2{,}0000,2{,}9084]\). Dukungan yang bergantung pada parameter dan MLE yang berada di batas membuat prosedur Wald reguler tidak sah.
Solusi lengkap
Untuk populasi kontinu dengan median unik \(q\), indikator \(\mathbf1\{X_i\le q\}\) iid Bernoulli\((1/2)\). Jadi \(K\sim\operatorname{Binomial}(8,1/2)\). Peristiwa \(X_{(2)}\le q\le X_{(7)}\) setara dengan \(2\le K\le6\), karena nilai yang persis sama dengan \(q\) berpeluang nol. Maka
Cakupan ini sekitar \(0{,}92969\), bukan otomatis 0,95; sifat diskret peringkat menentukan nilainya, sebagaimana pada Solusi lengkap. Selang teramati adalah \([1{,}1,3{,}4]\).
Di bawah model Seragam,
Dengan \(c=0{,}05^{1/8}\),
Peristiwa ini setara dengan \(M\le\theta\le M/c\). Jadi
Untuk \(M=4\), faktor \((0{,}05)^{-1/8}\approx1{,}4542154\), sehingga \(C_\theta\approx[4{,}0000,5{,}8169]\). Karena transformasi \(q=\theta/2\) monoton dan satu-ke-satu, invariansi cakupan memberi
Fungsi kemungkinan untuk titik ujung adalah \(L(\theta;x)=\theta^{-8}\mathbf1\{\theta\ge M\}\). Himpunan dukungan data bergantung pada \(\theta\), MLE \(M\) berada pada batas acak, dan galatnya berorde \(1/n\), bukan \(1/\sqrt n\); asumsi himpunan dukungan bersama, titik interior, identitas skor, dan normalitas akar-\(n\) yang diperlukan Wald gagal. Pivot eksak tetap sah karena diturunkan langsung dari CDF maksimum; lihat Solusi lengkap. Selang peringkat pertama hanya memerlukan iid, kontinuitas, dan median unik, tetapi cakupannya \(119/128\). Selang kedua benar-benar 95% hanya bila model Seragam dengan titik ujung benar. Nilai kembar, median tidak unik, atau bentuk distribusi yang bukan Seragam mengubah argumen yang relevan.
Masalah 4 — konsistensi tanpa konvergensi momen kedua (10 poin)
Misalkan \(X_1,X_2,\ldots\) iid dengan \(E(X_i)=\mu\) dan \(\operatorname{Var}(X_i)=\sigma^2<\infty\). Secara independen dari sampel, definisikan \(R_n=n\) dengan peluang \(1/n^2\) dan \(R_n=0\) selainnya. Bandingkan
untuk menduga \(\mu\) di bawah kerugian kuadratik.
- Hitung bias, varians, MSE, dan risiko kuadratik kedua penduga.
- Buktikan bahwa \(U_n\to_P\mu\).
- Tentukan limit \(E(U_n)\) dan \(E(U_n^2)\). Apakah \(U_n\to\mu\) dalam \(L^2\)?
- Nyatakan syarat ekor tambahan yang dapat menghubungkan konvergensi probabilitas dengan konvergensi momen.
Petunjuk 1
Gunakan \(E(R_n)=1/n\), \(E(R_n^2)=1\), dan independensi \(R_n\) dari \(\bar X_n\).
Petunjuk 2
Meskipun nilai tak nol \(R_n\) membesar, peluangnya \(1/n^2\) menuju nol. Untuk momen kedua, peristiwa langka itu tetap menyumbang satu satuan.
Jawaban singkat
sedangkan
Walaupun \(U_n\to_P\mu\) dan \(E(U_n)\to\mu\),
sehingga tidak ada konvergensi \(L^2\). Kontrol integrabilitas seragam (uniform integrability) pada kuadrat diperlukan untuk menukar limit dan momen kedua.
Solusi lengkap
Penduga \(T_n\) tak bias, mempunyai varians \(\sigma^2/n\), dan karena kerugiannya \((t-\mu)^2\), risikonya pada nilai parameter \(\mu\) sama dengan MSE:
Untuk gangguan langka,
sehingga \(\operatorname{Var}(R_n)=1-1/n^2\). Independensi memberi
Dekomposisi bias–varians menghasilkan
LLN memberi \(\bar X_n\to_P\mu\), sedangkan untuk setiap \(\varepsilon>0\) dan \(n>\varepsilon\),
Jadi \(R_n\to_P0\), dan Slutsky memberi \(U_n\to_P\mu\). Secara eksplisit, peluang penyimpangan dapat dibatasi oleh jumlah peluang penyimpangan \(\bar X_n\) dan peluang \(R_n\ne0\).
Momen pertama memang konvergen: \(E(U_n)=\mu+1/n\to\mu\). Namun
Karena \(E(U_n-\mu)^2\to1\), konvergensi \(L^2\) gagal. Contoh ini memperkuat peringatan kontrol ekor pada Solusi lengkap: konvergensi probabilitas ditambah integrabilitas seragam dari barisan \(U_n^2\), misalnya batas seragam momen \(E|U_n|^{2+\delta}\) untuk suatu \(\delta>0\), akan memungkinkan konvergensi momen kedua. Syarat itu justru gagal karena peristiwa ekor yang langka menghasilkan nilai sebesar \(n\).
Masalah 5 — kecukupan, minimalitas, kelengkapan, statistik aksesori, dan Basu (10 poin)
Misalkan \(X_1,X_2\) iid eksponensial dengan laju \(\lambda>0\), dan definisikan
- Nyatakan ukuran dominan dan himpunan dukungan bersama, lalu gunakan teorema faktorisasi untuk membuktikan bahwa \(T\) cukup bagi \(\lambda\).
- Gunakan kriteria rasio fungsi kemungkinan untuk membuktikan bahwa \(T\) minimal cukup.
- Buktikan kelengkapan \(T\) melalui keunikan transformasi Laplace.
- Turunkan hukum bersama \((T,A)\), buktikan bahwa \(A\) aksesori dan independen dari \(T\), lalu jelaskan tepat bagaimana Basu berlaku.
Petunjuk 1
Fungsi kemungkinan gabungan adalah \(\lambda^2e^{-\lambda(x_1+x_2)}\) pada kuadran positif. Untuk minimalitas, bandingkan fungsi kemungkinan pada dua titik data.
Petunjuk 2
Gunakan invers \(x_1=at\), \(x_2=(1-a)t\), dengan Jacobian mutlak \(t\). Distribusi \(T\) adalah Gamma dengan parameter bentuk 2 dan parameter laju \(\lambda\).
Jawaban singkat
Model didominasi oleh ukuran Lebesgue pada himpunan dukungan bersama \((0,\infty)^2\). Statistik \(T\) cukup dan minimal cukup, serta lengkap karena transformasi Laplace \(E_\lambda h(T)=0\) untuk semua \(\lambda>0\) memaksa \(h=0\) hampir di mana-mana. Transformasi memberi
jadi \(A\sim\operatorname{Uniform}(0,1)\), bersifat aksesori, dan independen dari \(T\). Semua asumsi teorema Basu terpenuhi.
Solusi lengkap
Ukuran dominannya adalah ukuran Lebesgue dua dimensi dan himpunan dukungan esensial \((0,\infty)^2\) sama untuk setiap \(\lambda>0\). Densitas gabungan dapat difaktorkan sebagai
dengan \(h\) bebas parameter. Asumsi dominasi dan himpunan dukungan bersama untuk faktorisasi telah diperiksa, sehingga \(T\) cukup.
Untuk dua titik \(x,y\) pada himpunan dukungan,
Rasio ini konstan terhadap \(\lambda\in(0,\infty)\) tepat ketika \(T(x)=T(y)\). Karena densitas positif pada himpunan dukungan bersama, kriteria rasio yang dipakai pada Solusi lengkap berlaku dan membuktikan kecukupan minimal, bukan sekadar kecukupan.
Selanjutnya \(T\sim\operatorname{Gamma}(2,\text{laju }\lambda)\), dengan densitas \(f_T(t)=\lambda^2te^{-\lambda t}\) untuk \(t>0\). Andaikan \(E_\lambda|h(T)|<\infty\) dan \(E_\lambda h(T)=0\) untuk setiap \(\lambda>0\). Maka
Keunikan transformasi Laplace, di bawah integrabilitas yang baru dinyatakan, memaksa \(h(t)t=0\) hampir di mana-mana. Karena \(t>0\), \(h(t)=0\) hampir di mana-mana, sehingga \(T\) lengkap.
Transformasi \((x_1,x_2)\mapsto(t,a)\) mempunyai invers \(x_1=at,x_2=(1-a)t\), Jacobian mutlak \(t\), dan domain \(t>0,0<a<1\). Jadi
dengan \(f_A(a)=1\) pada \((0,1)\). Hukum \(A\) tidak memuat \(\lambda\), jadi \(A\) aksesori; faktorisasi densitas bersama juga membuktikan independensi secara langsung. Teorema Basu berlaku karena \(T\) telah dibuktikan cukup dan lengkap bagi keluarga yang sama dan \(A\) telah dibuktikan aksesori. Tanpa kelengkapan, sifat aksesori dan kecukupan saja tidak menjamin independensi; bandingkan pemeriksaan asumsi pada Solusi lengkap.
Masalah 6 — metode momen, MLE global, dan batas parameter Pareto (10 poin)
Pertimbangkan model Pareto
dan data \((2,2,4,4)\).
- Verifikasi normalisasi dan tentukan kapan \(E_\alpha X\) hingga. Bahas apakah metode momen berbasis rataan terdefinisi pada seluruh model, lalu hitung solusi formalnya pada submodel \(\alpha>1\).
- Turunkan MLE pada model penuh \(\alpha>0\) dan buktikan bahwa ia maksimum global.
- Ulangi optimisasi pada submodel terbuka \(\alpha>1\) dan submodel tertutup \(\alpha\ge1\). Bedakan maksimum, supremum, dan titik ujung.
- Gunakan invariansi untuk parameter \(\psi=1/\alpha\), termasuk pada dua submodel tersebut.
Petunjuk 1
Gunakan \(E_\alpha X=\alpha/(\alpha-1)\) hanya ketika \(\alpha>1\). Untuk data, \(\bar x=3\) dan \(S=\sum_i\log x_i=6\log2\).
Petunjuk 2
Hingga konstanta data, \(\ell(\alpha)=4\log\alpha-\alpha S\). Periksa kelengkungan dan kedua batas, bukan hanya akar skor.
Jawaban singkat
Momen pertama hanya hingga untuk \(\alpha>1\); pada submodel itu solusi MM adalah \(\widehat\alpha_{\rm MM}=3/2\). Pada model penuh,
adalah maksimum global. Pada \(\alpha>1\), supremum didekati ketika \(\alpha\downarrow1\) tetapi tidak dicapai, jadi MLE tidak ada; pada \(\alpha\ge1\), MLE berada di batas \(\alpha=1\). Untuk \(\psi=1/\alpha\), MLE penuh adalah \(3\log2/2\), sedangkan kasus terbuka tetap tidak mempunyai MLE dan kasus tertutup memberi \(\widehat\psi=1\).
Solusi lengkap
Normalisasi mengikuti
Momen pertama adalah
hanya untuk \(\alpha>1\); integral divergen untuk \(0<\alpha\le1\). Karena itu MM berbasis momen pertama bukan prosedur yang terdefinisi pada seluruh model \(\alpha>0\). Jika model terlebih dahulu dibatasi ke \(\alpha>1\), persamaan \(3=\alpha/(\alpha-1)\) memberi \(\widehat\alpha_{\rm MM}=3/2\).
Untuk data yang diberikan,
Fungsi log-kemungkinan, termasuk suku data yang tidak memengaruhi optimisasi, adalah
Skor dan kelengkungan adalah
Akar tunggal persamaan skor adalah \(4/S=2/(3\log2)\approx0{,}9618\). Karena \(\ell\) cekung tegas, \(\ell(\alpha)\to-\infty\) ketika \(\alpha\downarrow0\) dan ketika \(\alpha\to\infty\), sebab \(S>0\). Jadi akar itu maksimum global pada model penuh.
Pada submodel \(\alpha>1\), maksimum tak berkendala berada di luar ruang. Lebih konkret, \(S=6\log2>4\), sehingga \(\ell'(1)=4-S<0\), dan skor makin kecil untuk \(\alpha>1\). Fungsi kemungkinan menurun pada seluruh submodel: supremumnya didekati ketika \(\alpha\downarrow1\), tetapi 1 tidak termasuk ruang, sehingga MLE tidak ada. Jika ruang ditutup menjadi \(\alpha\ge1\), titik ujung \(\widehat\alpha=1\) menjadi maksimum berkendala. Mengganti akar yang berada di luar ruang dengan 1 tanpa menyebut penutupan ruang akan mengubah model.
Peta \(\psi=1/\alpha\) satu-ke-satu pada model penuh, sehingga invariansi MLE memberi
Submodel \(\alpha>1\) bersesuaian dengan \(0<\psi<1\): supremum didekati saat \(\psi\uparrow1\), tetap tidak tercapai. Submodel tertutup bersesuaian dengan \(0<\psi\le1\) dan memberi MLE 1. Invariansi mentransformasi maksimum yang ada; ia tidak mengubah supremum tak tercapai menjadi penduga. Audit global ini sejalan dengan pemisahan akar skor dan maksimum pada Solusi lengkap serta kegagalan momen pada Solusi lengkap.
Masalah 7 — informasi, batas bawah Cramér–Rao, pivot eksak, dan Wald (10 poin)
Misalkan \(X_1,\ldots,X_n\) iid eksponensial dengan parameter skala \(\mu>0\):
- Turunkan skor, informasi Fisher sampel, dan batas bawah Cramér–Rao (CRLB) bagi penduga tak bias untuk \(\mu\). Nyatakan asumsi teorema yang dipakai.
- Tunjukkan bahwa \(\bar X\) mencapai CRLB.
- Untuk \(n=3\) dan \(S=\sum_iX_i=6\), bentuk selang kepercayaan eksak 95% bagi \(\mu\) dari pivot \(2S/\mu\sim\chi^2_{2n}\). Gunakan \(\chi^2_{6,0.025}\approx1{,}237344\) dan \(\chi^2_{6,0.975}\approx14{,}449375\).
- Bentuk selang Wald 95% dengan \(z_{0.975}\approx1{,}96\), lalu audit perbedaannya dari selang eksak.
Petunjuk 1
Skor satu observasi adalah \((X-\mu)/\mu^2\). Himpunan dukungan data tetap, tetapi CRLB juga memerlukan ketakbiasan target dan pertukaran diferensiasi–integral.
Petunjuk 2
Selesaikan \(\chi^2_{6,0.025}\le2S/\mu\le\chi^2_{6,0.975}\) dengan hati-hati karena \(\mu>0\). Galat baku Wald substitusi adalah \(\bar X/\sqrt n\).
Jawaban singkat
Rataan sampel tak bias dan variansnya \(\mu^2/n\), jadi mencapai batas. Untuk data, \(\widehat\mu=2\). Selang eksak adalah
sedangkan selang Wald kira-kira \([-0{,}2632,4{,}2632]\), yang bahkan keluar dari ruang parameter.
Solusi lengkap
Logaritma densitas satu observasi adalah \(\ell(\mu;X)=-\log\mu-X/\mu\). Maka
Karena \(E_\mu X=\mu\) dan \(\operatorname{Var}_\mu(X)=\mu^2\), skor berharapan nol dan
CRLB untuk target \(g(\mu)=\mu\) memberi \(\operatorname{Var}_\mu(T)\ge[g'(\mu)]^2/I_n(\mu)=\mu^2/n\). Asumsi pokoknya adalah dominasi Lebesgue dengan himpunan dukungan bersama \([0,\infty)\), \(\mu\) titik interior \((0,\infty)\), diferensiabilitas dan dominasi yang membolehkan pertukaran turunan–integral, informasi hingga dan positif, serta penduga \(T\) tak bias dengan momen yang diperlukan. Tanpa syarat itu, nama CRLB tidak cukup.
Rataan sampel memenuhi
sehingga mencapai batas dalam kelas tak bias yang dicakup teorema. Ini tidak menyiratkan keunggulan terhadap semua penduga bias di bawah semua fungsi kerugian, sesuai pembatasan pada Solusi lengkap.
Jumlah \(S\) berdistribusi Gamma dengan parameter bentuk \(n\) dan parameter skala \(\mu\), sehingga \(Q=2S/\mu\sim\chi^2_{2n}\) secara eksak. Untuk \(n=3,S=6\),
Membalik ketaksamaan positif memberi
Cakupan 0,95 berasal dari hukum Gamma eksak dan memerlukan model iid eksponensial yang benar, tetapi tidak memerlukan \(n\) besar.
MLE skala adalah \(\widehat\mu=\bar X=S/n=2\). Wald memakai normalitas akar-\(n\) dan galat baku berbasis taksiran \(2/\sqrt3\), sehingga
Selang ini hanya aproksimatif; perhitungan informasi Fisher yang eksak tidak menjadikan aproksimasi Normal eksak. Titik ujung negatif memperlihatkan pelanggaran domain pada sampel kecil. Pivot menjaga positivitas dan cakupan eksak, meskipun selangnya lebar karena hanya tiga observasi. Perbedaan ini merupakan gejala sampel berhingga, bukan kontradiksi dengan ekuivalensi asimtotik.
Masalah 8 — delta, bootstrap, cakupan, dan kasus nonreguler (10 poin)
Misalkan \(X_i\sim N(\mu,1)\) iid, \(n=100\), dan \(\bar x=0{,}4\). Parameter sasarannya \(\psi=e^\mu\), dengan penduga \(\widehat\psi=e^{\bar X}\). Sebuah bootstrap nonparametrik yang sudah dijalankan memberi kuantil \(q^*_{0.025}=1{,}21\) dan \(q^*_{0.975}=1{,}82\) bagi \(\widehat\psi^*\).
- Turunkan galat baku delta substitusi dan selang Wald berbasis delta 95%.
- Hitung selang bootstrap persentil dan dasar, lalu jelaskan distribusi yang didekati bootstrap.
- Pada audit cakupan dengan 40.000 kumpulan data independen, cakupan teramati adalah \(0{,}943\) untuk cakupan nominal \(0{,}95\). Hitung MCSE substitusi, skor selisih, dan selang Monte Carlo kira-kira 95%.
- Jelaskan mengapa metode delta dan bootstrap biasa tersebut tidak dapat diterapkan secara mekanis pada parameter sasaran \(h(\mu)=|\mu|\) ketika \(\mu=0\).
Petunjuk 1
Turunan \(g'(\mu)=e^\mu\), sedangkan \(\operatorname{Var}(\bar X)=1/n\). Selang dasar memantulkan kuantil: \([2\widehat\psi-q^*_{0.975},2\widehat\psi-q^*_{0.025}]\).
Petunjuk 2
Gunakan \(\sqrt{0{,}943(0{,}057)/40000}\) untuk MCSE substitusi. Pada target absolut di nol, \(\sqrt n|\bar X|=|Z|\), tetapi \(|\cdot|\) tidak dapat didiferensiasikan di nol.
Jawaban singkat
\(\widehat\psi=e^{0{,}4}\approx1{,}4918\), galat baku delta \(0{,}14918\), dan selang Wald berbasis delta kira-kira \([1{,}1994,1{,}7842]\). Selang persentil adalah \([1{,}21,1{,}82]\), sedangkan selang dasar kira-kira \([1{,}1636,1{,}7736]\). MCSE cakupan adalah \(0{,}001159\), selisihnya sekitar \(-6{,}04\) MCSE, dan selang Monte Carlo sekitar \([0{,}9407,0{,}9453]\). Pada \(h(\mu)=|\mu|\) di nol, distribusi limitnya adalah Normal terlipat dan bootstrap terpusat biasa mempunyai limit kondisional yang bergantung pada data, sehingga syarat keteraturan gagal.
Solusi lengkap
CLT (bahkan kenormalan eksak bagi \(\bar X\)) dan metode delta dengan \(g'(\mu)=e^\mu\ne0\) memberi
Dengan substitusi,
Jadi
Selang ini menggunakan aproksimasi linear pada fungsi halus; kenormalan \(\bar X\) tidak menjadikan \(e^{\bar X}\) Normal tepat.
Selang persentil langsung memakai kuantil bootstrap:
Selang dasar adalah
Bootstrap mengganti distribusi populasi dengan distribusi empiris dan mendekati distribusi pengambilan sampel dari galat penduga, secara kondisional pada data; kuantilnya bukan probabilitas posterior bagi parameter. Konstruksi kedua selang mengikuti Solusi lengkap.
Jika indikator cakupan dari 40.000 kumpulan data independen diperlakukan sebagai Bernoulli, MCSE berbasis taksiran adalah
Skor selisih terhadap cakupan nominal adalah
dan selang Monte Carlo sederhana
Di bawah asumsi replikasi independen, implementasi yang benar, serta model dan nilai parameter audit yang ditetapkan sebelum simulasi, selisih ini terlalu besar untuk dijelaskan sebagai galat acak Monte Carlo biasa dan menunjukkan cakupan di bawah nominal pada titik audit tersebut. Hasil ini belum membuktikan kekurangan cakupan seragam pada semua parameter; MCSE mengukur ketidakpastian Monte Carlo akibat replikasi, bukan bias prosedur, sesuai pemisahan pada Solusi lengkap.
Untuk \(h(\mu)=|\mu|\) di \(\mu=0\), fungsi tidak dapat didiferensiasikan. Karena \(Z_n=\sqrt n\bar X\sim N(0,1)\),
bukan limit Normal linear. Dalam bootstrap biasa, jika \(Z^*=\sqrt n(\bar X^*-\bar X)\) mendekati Normal baku secara kondisional, maka galat terpusat berbentuk
Hukum kondisionalnya bergantung pada nilai acak \(Z_n\) dan tidak konvergen ke satu hukum tetap yang sama dengan \(|Z|\). Jadi hipotesis diferensiabilitas delta dan syarat keteraturan bootstrap \(n\)-dari-\(n\) gagal; selang persentil/dasar tidak memperoleh jaminan cakupan dari argumen reguler tadi. Kegagalan ini disebabkan nondiferensiabilitas, bukan contoh turunan pertama nol.
Masalah 9 — ukuran uji, nilai-p, daya, ukuran sampel, dan inversi (10 poin)
Misalkan \(X_1,\ldots,X_n\) iid \(N(\mu,4)\), dengan varians diketahui. Uji dua sisi \(H_0:\mu=0\) melawan \(H_1:\mu\ne0\) memakai \(Z=\sqrt n\bar X/2\) dan nilai kritis eksak \(z_{0.975}=1{,}9599639845\ldots\approx1{,}96\).
- Buktikan bahwa ukuran uji tepat 0,05. Untuk \(n=25\) dan \(\bar x=0{,}9\), hitung statistik dan nilai-p.
- Turunkan fungsi daya dua sisi. Hitung daya pada \(\mu=1\) ketika \(n=25\).
- Cari ukuran sampel bulat terkecil yang memberi daya sedikitnya 0,90 pada \(|\mu|=1\). Gunakan \(z_{0.90}\approx1{,}282\) dan verifikasi kandidat di sekitar pembulatan.
- Inversikan keluarga uji beraras 0,05 untuk membentuk selang kepercayaan 95% dan hitung selang data tersebut.
Petunjuk 1
Di bawah \(\mu\), \(Z\sim N(\delta,1)\) dengan \(\delta=\sqrt n\mu/2\). Daya adalah jumlah peluang pada dua ekor terhadap ambang \(\pm z_{0.975}\); gunakan 1,96 hanya untuk perhitungan numerik dengan pembulatan.
Petunjuk 2
Untuk perencanaan, syarat ekor dominan adalah \(\sqrt n/2\gtrsim z_{0.975}+z_{0.90}\); gunakan 1,96 dan 1,282 sebagai pendekatan numerik. Setelah membulatkan, hitung daya dua ekor pada \(n=42\) dan \(n=43\).
Jawaban singkat
Dengan nilai kritis eksak \(z_{0.975}\), ukuran uji tepat 0,05; angka 1,96 yang dicetak sendiri akan memberi ukuran uji \(0{,}0499958\). Pada data, \(Z_{\rm obs}=2{,}25\) dan \(p\approx0{,}02445\). Fungsi daya adalah
Pada \(n=25,\mu=1\), daya sekitar \(0{,}7054\). Ukuran sampel minimum adalah 43: daya pada 42 sekitar \(0{,}89980\), sedangkan pada 43 sekitar \(0{,}90637\). Selang hasil inversi adalah \([0{,}116,1{,}684]\).
Solusi lengkap
Di bawah \(H_0\), varians diketahui dan kenormalan tepat memberi \(Z\sim N(0,1)\). Karena distribusi kontinu dan \(z_{0.975}\) adalah kuantil Normal baku eksak,
jadi ukuran uji tepat, bukan asimtotik. Jika 1,96 dipakai sebagai nilai kritis literal, ukuran ujinya \(2\{1-\Phi(1{,}96)\}\approx0{,}0499958\); sepanjang solusi ini 1,96 hanya pendekatan numerik untuk kuantil eksak. Untuk \(n=25\),
Nilai-p adalah peluang ekor di bawah hipotesis nol bagi statistik yang setidaknya sama ekstremnya dengan data, bukan peluang hipotesis nol benar dan bukan daya.
Di bawah parameter \(\mu\), \(Z\sim N(\delta,1)\) dengan \(\delta=\sqrt n\mu/2\). Karena itu
Untuk \(n=25,\mu=1\), \(\delta=2{,}5\), sehingga
Untuk target daya 0,90 pada efek positif 1, ekor atas dominan. Syarat konservatif yang hampir eksak adalah
atau
Kandidat bulat adalah 43. Pemeriksaan dengan rumus dua ekor penuh memberi \(\beta_{42}(1)\approx0{,}89980<0{,}90\) dan \(\beta_{43}(1)\approx0{,}90637\), sehingga 43 memang minimum. Simetri Normal memberi daya sama pada \(\mu=-1\). Pembulatan tanpa pemeriksaan dapat memilih ukuran yang gagal tipis, seperti 42.
Nilai \(\mu_0\) tidak ditolak tepat ketika
Menyelesaikan terhadap \(\mu_0\) memberi selang yang dual terhadap uji,
Pada data, dengan \(z_{0.975}\approx1{,}96\),
Nol tidak berada di selang, selaras dengan nilai-p di bawah 0,05. Ukuran uji, daya, dan dualitas ini eksak karena sampel Normal, varians 4 diketahui, dan ukuran sampel ditetapkan; mengganti varians dengan estimasi memerlukan pivot \(t\), seperti dibedakan pada Solusi lengkap.
Masalah 10 — audit terpadu model geometrik (10 poin)
Misalkan \(X_1,\ldots,X_5\) iid geometrik dengan
Data teramati adalah \((1,1,2,3,3)\), sehingga \(S=\sum_iX_i=10\). Sebuah laporan menyatakan:
- “Akar skor \(\widehat p=1/2\) otomatis maksimum global dan tak bias.”
- “\(S\) cukup; banyaknya observasi bernilai satu, \(A=\sum_i\mathbf1\{X_i=1\}\), bersifat aksesori dan karena itu independen dari \(S\).”
- “Informasi Fisher membuat selang Wald 95% eksak.”
- “Untuk \(H_0:p=0{,}4\) melawan \(p>0{,}4\), nilai-p adalah peluang ekor \(P_{0.4}(S\ge10)\).”
Audit keempat klaim. Turunkan fungsi kemungkinan dan tentukan maksimum global, termasuk kasus batas \(S=5\). Untuk membahas bias pada seluruh ruang sampel, definisikan penduga perluasan pada penutupan ruang parameter, \(\widetilde p=5/S\), yang bernilai 1 saat \(S=5\), dan bedakan ia dari MLE model terbuka. Buktikan kecukupan dan kecukupan minimal; periksa sifat aksesori; hitung selang Wald; hitung nilai-p eksak yang benar; dan inversikan uji satu sisi untuk memberi batas bawah kepercayaan 95%.
Petunjuk 1
Fungsi kemungkinan umum adalah \(p^5(1-p)^{S-5}\). Untuk bias penduga perluasan, gunakan kekonveksan tegas \(s\mapsto1/s\) dan \(E_pS=5/p\); jangan menyebut nilai batasnya sebagai MLE pada model terbuka.
Petunjuk 2
Nilai \(p\) besar menghasilkan waktu tunggu kecil. Peristiwa \(S\le10\) setara dengan memperoleh sedikitnya lima sukses dalam sepuluh percobaan Bernoulli.
Jawaban singkat
Untuk data, \(\widehat p=5/10=1/2\) adalah maksimum global. Pada model terbuka, MLE hanya ada ketika \(S>5\); jika \(S=5\), supremum berada di \(p\uparrow1\) dan tidak dicapai. Penduga perluasan \(\widetilde p=5/S\) terdefinisi pada semua sampel dan berbias ke atas karena \(E_p(\widetilde p)>p\). Statistik \(S\) cukup dan minimal cukup. Namun \(A\sim\operatorname{Binomial}(5,p)\), sehingga bukan statistik aksesori. Informasi Fisher pada \(\widehat p\) adalah 40 dan selang Wald kira-kira \([0{,}1901,0{,}8099]\), hanya aproksimatif. Nilai-p eksak yang benar ialah
Batas bawah eksak menyelesaikan \(P_L\{\operatorname{Binomial}(10,L)\ge5\}=0{,}05\), yaitu \(L\approx0{,}22244\), sehingga selangnya \([L,1)\).
Solusi lengkap
Terhadap ukuran hitung pada \(\{1,2,\ldots\}^5\), himpunan dukungan bersama tidak bergantung pada \(p\). Fungsi kemungkinan adalah
dan untuk \(S>5\),
Jadi titik stasioner \(\widehat p=5/S\) unik. Ketika \(S>5\), fungsi log-kemungkinan menuju \(-\infty\) pada \(p\downarrow0\) dan \(p\uparrow1\), sehingga titik tersebut maksimum global. Untuk data, \(S=10\) memberi \(\widehat p=1/2\). Jika \(S=5\), semua waktu tunggu bernilai satu dan \(L(p)=p^5\) meningkat; supremum didekati saat \(p\uparrow1\), tetapi tidak dicapai dalam \((0,1)\). Jadi laporan harus membedakan kasus interior \(S>5\) dari ketiadaan MLE pada ruang parameter terbuka. Karena peristiwa \(S=5\) berpeluang \(p^5>0\), tidak ada peubah acak MLE yang terdefinisi pada seluruh ruang sampel model terbuka.
Agar bias tetap merupakan pertanyaan yang terdefinisi, tetapkan penduga perluasan pada penutupan ruang parameter, \(\widetilde p=5/S\). Ia sama dengan MLE model terbuka pada \(S>5\), tetapi mengambil nilai batas 1—bukan MLE—pada \(S=5\). Karena \(S\) tak degenerat untuk \(0<p<1\), fungsi \(1/s\) konveks tegas dan Jensen memberi
Jadi penduga perluasan \(\widetilde p\) berbias ke atas pada sampel berhingga; tidak sah menyebut ini bias MLE model terbuka karena MLE itu tidak ada pada \(S=5\). Kecekungan fungsi kemungkinan dan ketakbiasan adalah pertanyaan yang berbeda.
Faktorisasi \(p^5(1-p)^{S-5}\) pada himpunan dukungan bersama membuktikan bahwa \(S\) cukup. Untuk dua titik data \(x,y\),
Rasio konstan terhadap \(p\in(0,1)\) tepat ketika \(S(x)=S(y)\), jadi kriteria rasio membuktikan kecukupan minimal. Sebaliknya, setiap indikator \(\mathbf1\{X_i=1\}\) adalah Bernoulli\((p)\), sehingga
Hukumnya bergantung pada \(p\); \(A\) bukan statistik aksesori. Distribusi kondisional konfigurasi data dengan syarat \(S\) memang bebas parameter, tetapi sifat kondisional itu tidak mengubah hukum marginal \(A\) menjadi bebas parameter. Karena sifat aksesori gagal, tidak ada dasar memakai Basu untuk menyatakan independensi.
Skor satu observasi adalah
Dengan \(\operatorname{Var}_p(X)=(1-p)/p^2\),
Pada \(\widehat p=1/2\), \(I_5(\widehat p)=40\), jadi galat baku Wald \(1/\sqrt{40}\approx0{,}15811\) dan
Ini selang asimtotik. Perhitungan informasi Fisher yang eksak tidak menjadikan MLE tepat berdistribusi Normal; untuk sampel berukuran lima, penduga perluasan diskret dan miring, sedangkan logitnya tak hingga ketika semua waktu tunggu satu—tepat pada sampel tempat MLE model terbuka tidak ada.
Untuk alternatif \(p>0{,}4\), waktu tunggu cenderung lebih pendek, sehingga nilai \(S\) yang kecil—bukan yang besar—lebih ekstrem. Peristiwa keberhasilan kelima terjadi paling lambat pada percobaan ke-10, \(S\le10\), tepat ketika sedikitnya lima sukses muncul dalam sepuluh percobaan Bernoulli. Maka
Hipotesis nol tidak ditolak pada taraf 5%. Menginversi seluruh keluarga uji berekor bawah memberi batas \(L\) yang memenuhi
Solusi numeriknya \(L\approx0{,}222441\), sehingga selang satu sisi adalah \([0{,}222441,1)\) untuk ruang parameter terbuka. Karena distribusinya diskret, prosedur hasil inversi mempunyai cakupan sedikitnya 95% dan umumnya konservatif, sejalan dengan mekanisme pada Solusi lengkap. Audit terpadu ini memisahkan himpunan dukungan, optimisasi global, bias pengambilan sampel, reduksi melalui statistik cukup, sifat aksesori, aproksimasi Wald, dan ekor eksak alih-alih menyimpulkan semuanya dari satu akar skor.
Rubrik penilaian — total 100 poin
Setiap masalah bernilai 10 poin. Nilai penuh mensyaratkan derivasi yang dapat diperiksa, asumsi pokok teorema, dan diagnosis mekanisme kegagalan. Jawaban numerik tanpa alur penalaran tidak memperoleh poin derivasi. Menyebut hasil bootstrap atau aproksimasi tanpa hukum pengambilan sampel dan domain tidak memperoleh poin validitas.
Rubrik Masalah 1 (10 poin)
- 2 poin: ruang 20 himpunan bagian, \(P(B)\), dan peluang bersyarat benar.
- 3 poin: momen indikator serta kovarians \(-1/20\) diturunkan.
- 3 poin: harapan dan varians \(Y\), termasuk seluruh suku kovarians.
- 2 poin: harapan bersyarat membedakan dua kelas label dan menyebut ketergantungan tanpa pengembalian sebagai mekanisme utama.
Rubrik Masalah 2 (10 poin)
- 2 poin: transformasi ke Seragam dan hukum statistik urutan bersama diturunkan.
- 3 poin: Jacobian, dukungan segitiga, dan densitas \((L,M)\) benar.
- 3 poin: kedua marginal serta faktorisasi \((R,M)\) benar.
- 2 poin: peluang dan momen benar, dengan asumsi kontinuitas (sehingga tidak ada nilai kembar) dan domain transformasi dinyatakan.
Rubrik Masalah 3 (10 poin)
- 3 poin: kejadian Binomial, cakupan \(119/128\), dan selang peringkat benar.
- 3 poin: pivot maksimum dan selang titik ujung numerik benar.
- 2 poin: transformasi selang ke median parametrik benar.
- 2 poin: membedakan asumsi kontinuitas/median unik dari model Seragam serta menyebut dukungan yang bergantung pada parameter dan laju konvergensi yang bukan berorde \(\sqrt n\) sebagai kegagalan Wald.
Rubrik Masalah 4 (10 poin)
- 2 poin: momen \(R_n\) dan bias \(U_n\) benar.
- 2 poin: varians, MSE, dan risiko kedua penduga benar.
- 3 poin: bukti konsistensi dan perhitungan dua limit momen lengkap.
- 3 poin: diagnosis kegagalan \(L^2\) serta syarat integrabilitas seragam atau kontrol momen seragam dinyatakan; independensi gangguan tidak diabaikan.
Rubrik Masalah 5 (10 poin)
- 2 poin: dominasi, himpunan dukungan bersama, faktorisasi, dan kecukupan benar.
- 2 poin: kriteria rasio membuktikan kecukupan minimal.
- 3 poin: bukti kelengkapan memakai hukum Gamma, integrabilitas, dan keunikan Laplace secara sah.
- 3 poin: transformasi \((T,A)\), sifat aksesori, independensi, dan semua asumsi teorema Basu benar; kegagalan bila kelengkapan hilang disebutkan.
Rubrik Masalah 6 (10 poin)
- 2 poin: normalisasi, keberadaan momen, dan solusi MM bersyarat benar.
- 3 poin: fungsi kemungkinan penuh, akar, kelengkungan, dan audit maksimum global benar.
- 3 poin: submodel terbuka versus tertutup membedakan supremum, ketiadaan, dan titik ujung.
- 2 poin: invariansi \(\psi\) benar serta tidak dipakai untuk menyembunyikan kegagalan pencapaian maksimum.
Rubrik Masalah 7 (10 poin)
- 2 poin: skor dan informasi Fisher benar.
- 2 poin: CRLB, pencapaiannya, dan kelas penduga tak bias benar.
- 3 poin: pivot, arah inversi, serta selang eksak numerik benar.
- 3 poin: Wald dihitung dan dibandingkan; himpunan dukungan tetap, parameter interior, diferensiabilitas, serta kegagalan domain/akurasi sampel kecil dinyatakan.
Rubrik Masalah 8 (10 poin)
- 2 poin: metode delta, galat baku berbasis taksiran, dan selang numerik benar.
- 2 poin: selang persentil/dasar dan makna kondisional bootstrap benar.
- 3 poin: MCSE, skor, selang cakupan, dan interpretasi cakupan di bawah nominal memperhitungkan replikasi independen serta galat acak Monte Carlo.
- 3 poin: limit Normal terlipat dan kegagalan diferensiabilitas/bootstrap terpusat dijelaskan tanpa memakai contoh turunan nol.
Rubrik Masalah 9 (10 poin)
- 2 poin: ukuran uji eksak, statistik, dan nilai-p benar.
- 2 poin: fungsi daya dua ekor dan nilai pada alternatif benar.
- 3 poin: perencanaan ukuran sampel, pembulatan, dan verifikasi 42 versus 43.
- 3 poin: inversi uji dan selang benar, dengan asumsi Normal, varians diketahui, serta ukuran sampel tetap disebut sebagai dasar eksak.
Rubrik Masalah 10 (10 poin)
- 2 poin: fungsi kemungkinan, maksimum global untuk \(S>5\), ketiadaan MLE pada \(S=5\), serta bias Jensen yang dinyatakan hanya untuk penduga perluasan.
- 2 poin: kecukupan/kecukupan minimal serta kegagalan sifat aksesori \(A\).
- 3 poin: informasi, galat baku, selang Wald, dan alasan ia tidak eksak.
- 3 poin: arah ekor, nilai-p eksak, persamaan inversi, batas bawah, dan konservatisme diskret semuanya benar.