統計学Part15at MATH
統計学Part15 - 暇つぶし2ch550:132人目の素数さん
14/01/27 19:05:08.02 .net
F分布のことかな?

それ、正規分布になると思うよ?
レヴィ分布は右に裾を引く分布だね。金融工学とかで使ってるよ。

551:535
14/01/27 21:21:13.51 .net
F分布ですか。母比率についてF分布にしたがう統計量あってびっくりです。
正規分布の比の分布はコーシー分布、正規分布の二乗和の分布はカイ二乗分布みたいな、狭義レヴィ分布の説明ってありますか?

552:132人目の素数さん
14/01/27 21:42:55.63 .net
パラメタ不明のn個の正規分布{N(μ_i, σ_i^2) | i ∈ [1,n]}から
それぞれm個ずつ独立に値をサンプリングして、
そのmn個の値をもとに平均の和(Σμ_i)の信頼区間を作りたいのですが、良い方法はありますか?

n個の分布に従う変数の和の分布を考えれば、標本数=mのt検定ができることは分かるのですが、
そこまで情報を捨てないで済むものを探しています

n=2の場合は片方を符号反転してWelchのt検定でよさそうなんですが、
一般の場合にも似たような手法が使えるのでしょうか

また、分散が一部共通の2n個の正規分布{N(μ_i_j, σ_i^2) | i ∈ [1,n], j ∈ [1,2]}の標本から
(Σ(μ_i_1 - μ_i_2))の信頼区間を作りたい場合に良い方法はありますか

553:132人目の素数さん
14/01/28 05:01:20.79 .net
標本数?

554:132人目の素数さん
14/01/28 05:48:14.24 .net
すいませんsample sizeのつもりでした

555:132人目の素数さん
14/01/28 09:09:10.97 .net
sample size mのt検定はないでしょ。

556:132人目の素数さん
14/01/28 11:13:27.30 .net
>>543
正規分布の再生性 じゃダメ?
それに平均の和(Σμ_i)の表記はΣX_iとかにすべきじゃ。もし
パラメータの信頼区間を求めたいなら別だけど。

557:132人目の素数さん
14/01/28 12:39:05.56 .net
>>542
レヴィ分布は確率過程や確率解析の本を見たら乗ってると思う。
統計より確率論の話。

558:132人目の素数さん
14/01/28 15:41:50.93 .net
こんなとこで聞かないで図書館行って調べろよ
何でもかんでも人に聞く癖を直せ
大学生なら最終的には教授に聞け

559:132人目の素数さん
14/01/28 21:27:49.76 .net
>>547
再生性を使うより良い方法があるかと思って質問したのですが、無理そうでしたか
ありがとうございます

>それに平均の和(Σμ_i)の表記はΣX_iとかにすべきじゃ。もし
>パラメータの信頼区間を求めたいなら別だけど。
パラメータの推定が目的なので、パラメータの信頼区間を求めたいです

560:535
14/01/28 23:20:40.64 .net
>>548 PRMLとかですか?
どうりで入門書でも数理統計の本で見なかったと思いました。

561:132人目の素数さん
14/01/28 23:22:14.09 .net
prmlは確率過程じゃなかった

562:132人目の素数さん
14/01/29 04:16:50.94 .net
統計学をやろうとおもうのですが、高校数学の平面図形の知識は必要ですか。

重点的にやっおいたほうがいいという分野がアレばお願いします

563:132人目の素数さん
14/01/29 06:28:53.08 .net
統計学をやればいいと思います

564:132人目の素数さん
14/01/29 07:51:02.21 .net
必要になる度に復習せえ
とんでもない量になって結局、高校数学全て見直す娘とになるがな

565:132人目の素数さん
14/01/29 08:17:42.21 .net
確率は見直しとくとスムーズ

566:132人目の素数さん
14/01/29 09:57:22.23 .net
機械学習と統計学の違いは何?
どっちが難しい?
どっちが実用的?
統計学が最強の~では機械学習はあまり触れられていませんでしたが。

567:132人目の素数さん
14/01/29 10:04:44.07 .net
>553
一変数の微積と高校程度の確率の話が分かってれば大体なんとかなる

568:132人目の素数さん
14/01/29 10:12:04.76 .net
>>557
かぶる部分も多いけど、統計の方が難しい。
統計家は機械学習できるけど、情報屋は数理統計学で詰む。

実用的なのは機械学習。
ビッグデータでも使えるし。
従来の頻度論統計学はデータ量が多いと使えない。

569:132人目の素数さん
14/01/29 11:43:49.36 .net
>>559
どうもです。機械学習のほうが難しいのだと思っていました。
統計学よりも数学的知識を前提にしているようですし。
データ量が多いと統計学が使えないのは初めて知りました。
統計学はデータ量が多いほど分析が簡単になるのでは?

570:132人目の素数さん
14/01/29 13:56:10.22 .net
統計学の本来の目的って、標本から母集団を推定したり・検定することにある。
標本が1000とか1万とかのデータ数だと、それはもう母集団といえる規模。
推定は一致し、検定は有意な差しか出なくなる。

ビッグデータに古典的な推定や検定を使ってたら、分析者を殴っていい。

571:132人目の素数さん
14/01/29 17:51:50.00 .net
>>561
どこまでを統計学というの?
また、ビッグ・データとは何?

572:132人目の素数さん
14/01/29 18:06:18.39 .net
>>543
解決しました
検定統計量を
√(Σ(s_i^2/m))
(ただしs_iは標本標準偏差)とし、実効自由度を
(Σ(s_i^2/m))^2/(Σ((s_i^2/m)^2/(m-1)))
としたt検定でいけるようです

573:132人目の素数さん
14/01/29 20:31:10.73 .net
>>562
明確な定義はない。

574:132人目の素数さん
14/01/30 14:57:27.25 .net
>>561
有意な差がでるのは良くないことなんですね。つまり
有意な差がでやすい大きな標本を統計学では使うべきではない、
ということですね。わかりました。

575:132人目の素数さん
14/01/30 21:55:20.32 .net
釣られてあげようか?

576:132人目の素数さん
14/01/30 22:10:41.80 .net
>>565
そうだよ。
推測統計ではデータが少なすぎるのも問題だけど、多すぎるものに使うのも問題。

577:132人目の素数さん
14/01/30 22:12:01.89 .net
多すぎると何が問題なんですか?

578:132人目の素数さん
14/01/30 22:17:32.41 .net
ベイズ統計スレを新たに建てたら?

579:132人目の素数さん
14/01/30 22:32:32.04 .net
>>567
例えば、データ数が1000の相関係数が0.06だった場合、普通は相関無しと思うが、
相関係数の検定をすると有意差が生まれる。

これは、検定がもともとデータ数が少ない場合に使うことを前提にして作られたから起きる問題。

URLリンク(www.urano-ken.com)

580:132人目の素数さん
14/01/31 03:31:41.68 .net
そのpdf,「きわめて小さな差でも“(統計的には)有意である”という結果になる可能性が
高まります。」と書いてるけど、それで何が問題なのかわからないです。。

むしろ極めて小さな差でもデータ数が多ければ、その差が偶然出ないことがハッキリして
よかったね、というふう好意的に解釈してしまいました。

581:132人目の素数さん
14/01/31 06:47:42.46 .net
適切な標本数って母集団の大きさと目標とする誤差で変わってくるんでは
政府統計だと標本数10万人規模だったりするし

582:132人目の素数さん
14/01/31 08:30:10.36 .net
標本数

583:132人目の素数さん
14/01/31 08:45:25.91 .net
標本の大きさというべきでありました・・・

584:132人目の素数さん
14/01/31 12:11:15.00 .net

結局データ数が多い場合には極めて小さな差でも有意にできるのは問題なん?
問題ないん?どっち?

585:132人目の素数さん
14/01/31 12:55:36.73 .net
問題無い

586:132人目の素数さん
14/01/31 18:45:32.96 .net
>>570
問題の意味が分らない。誰か説明して。

587:132人目の素数さん
14/01/31 19:09:28.32 .net
>>575
問題ありだろ。

例えば、イケメン度合い(y)を2chに書き込んだ回数(x)で回帰分析する場合を考える。
普通この2変数に相関はないだろう。
しかし、「2chに書き込めばイケメンになれるんだということを世間に知らしめたいとする」
その場合、標本数を1000以上とってくる。
そして、回帰モデルの検定を行う。
すると、p値に有意差が生まれて、このモデルは統計的に意味のあるモデルと言うことが出来る。

ただ、正の相関か負の相関かは標本次第w

588:132人目の素数さん
14/01/31 19:13:06.08 .net
基本的に思考停止な検定を始める奴は統計学に向いていない

589:132人目の素数さん
14/01/31 20:41:22.58 .net
質問です。
ここにいる皆さんは仕事をするときに統計学をがっつり使っていますか?
現在就活中で大学で統計学を専攻しているのでそれを活かせる職業を探しています。
因みに私立文系でプログラミングは出来ません。
よろしくお願いします。

590:132人目の素数さん
14/01/31 20:43:07.34 .net
>>580
大学はどこ?

591:132人目の素数さん
14/01/31 20:50:17.70 .net
>>581
早慶です

592:132人目の素数さん
14/01/31 21:10:32.93 .net
基本的にプログラミングの知識を使わないで統計の知識だけ使うってことはほとんど無いよ
新卒なら入社してから覚えさせられることになるし、
現時点でバリバリプログラミングが出来る必要はないけど、
そういう仕事やりたいんならちょっとかじるくらいではプログラミングに触れておいたほうがいいかも

593:132人目の素数さん
14/01/31 21:11:29.97 .net
↑自己アピールができる、という意味でね

ただ入社以降もプログラミングには触れたくない!って言うのならおすすめはしない

594:132人目の素数さん
14/01/31 21:25:45.95 .net
>>582
早稲田は文系でも統計の研究室いくつかあるけど、そこ出身かな?!

マーケティングの統計職ならあまりプログラミングはないと思うけど。

595:132人目の素数さん
14/01/31 21:29:12.16 .net
なんで学生課に行かずにここで聞くのかな

596:132人目の素数さん
14/01/31 22:33:48.65 .net
Rぐらいでも十分じゃないかなあ。
自分でコーティングは、しないでしょ。

597:132人目の素数さん
14/01/31 23:20:36.36 .net
手段として統計を使う仕事はいくらでもあるが
目的として統計を使う仕事はほとんどない

手段に秀でているだけの人材は下請けで間に合う

598:132人目の素数さん
14/01/31 23:22:38.72 .net
大学の教授に聞けよ
なんでもかんでも他人に丸投げしないで自分から動け

599:132人目の素数さん
14/01/31 23:27:55.18 .net
私大の文系だと数Ⅲもできないだろうし理屈から始めるにはもう遅いかもな

600:132人目の素数さん
14/01/31 23:34:11.44 .net
統計学専攻なら文系でも線型代数とか簡単な解析学ぐらいはやるだろう

601:132人目の素数さん
14/01/31 23:43:19.97 .net
統計専攻って言うくらいだから、数理統計学はやってるだろう

602:132人目の素数さん
14/01/31 23:45:03.51 .net
文系なら技術屋になるより、そいつらを使う側に回った方が良い気がするけどな。

603:535
14/02/01 00:29:28.40 .net
私大文系だけど、今日の統計のテスト、カイ二乗検定とt検定しかなかったわ

604:132人目の素数さん
14/02/01 00:30:19.31 .net
名前まちがえた

605:132人目の素数さん
14/02/01 00:46:55.27 .net
皆さんありがとうございます。
>>580です。

ここにいる人達が普段のお仕事の中で統計学をいかに使っているのかを知りたかったので、質問しました。
とりあえず、明日就職課に聞いてみます。

606:132人目の素数さん
14/02/01 01:35:49.77 .net
>>596
統計を人を騙す道具として使ってる企業多いから気をつけてね。

例えば、製薬とか被験者の取り方でいくらでも効く薬や副作用の少ない薬作ることが可能だから。
まともな人は病むかも。
マーケティングや調査会社も如何わしい。お客さんが喜べば何しても良いと思ってる。

そういう意味では、事業会社の統計職が良いかもね。いろんな部署と協力して出来るし。

本当に統計が好きなら、統計の大学教授になることだよ。一番まともに統計使って、さらに作ってる人たち。

607:132人目の素数さん
14/02/01 01:43:00.44 .net
伸びてるから面白い話題かと思ったのに

608:132人目の素数さん
14/02/01 06:30:20.07 .net
やっぱり有意という言葉が良くないと思う。代わりに標準偏差と推定量だけ、
t統計量もp値も各自で計算して、有意という言葉は廃止にした方がいい気がス。つかってていいこと一つもないし。

609:132人目の素数さん
14/02/01 12:07:08.15 .net
質問させてください。完備統計量はどういう意味があるんでしょうか?
E[h(T)]=0ならばh(t)=0が定義なのですが、なぜこんな量を求めるのかが
よくわかりません。

それに妙に線形


610:代数の線形結合の定義と似ている気もするのですが関連があるのでしょうか。



611:132人目の素数さん
14/02/01 13:14:56.94 .net
良く使った最小自乗法は、統計的推定と称するけど統計を使ってる意識はないなー

612:132人目の素数さん
14/02/01 13:21:22.05 .net
>>600
その成分だけで全部決まるという意味だからベクトル空間の基底と同じ性質だわな

613:132人目の素数さん
14/02/01 13:46:06.42 .net
>>597
日本の企業で統計使うって品質管理分野ばかりなんだけどね。

614:132人目の素数さん
14/02/01 14:47:18.07 .net
>>603
そんなことはありえない。

だって、統計関連学会で知り合う人はメーカーから製薬、金融まで幅広いぞ。

615:132人目の素数さん
14/02/01 15:25:06.33 .net
>>603-604
は?

616:132人目の素数さん
14/02/01 15:34:29.86 .net
>>602
どうもです。ということはコレは線形結合の場合に係数c1,c2,,,cnが一意的に決まる
のと同じと考えていいんですね。
例えばE[h(T)]=12のような値になる場合必ずh(T)=1/4Tに一意的にきまる、というふうに。

617:132人目の素数さん
14/02/04 13:49:50.04 .net
ちょっと統計学から離れちゃうかもしれないけど、
積率って元々どんな学問分野で、どんな目的で産まれた概念なの?

618:132人目の素数さん
14/02/04 17:48:53.04 .net
梃子じゃない?

619:132人目の素数さん
14/02/04 17:54:37.65 .net
疑問に思っちゃんだ、どうしてかな?

620:132人目の素数さん
14/02/04 18:39:57.94 .net
数理統計学の本読んでいたら
「離散確率変数Xの分布の積率は次のように用意に定義できる」
っていう記述が出てきたんだけど、なんか突飛に感じたから。

結果的には積率っていう道具を導入することで、
分布の記述に利があるということはわかるんだけど、
そもそも積率そのものの意味がよくわからないから、なんとなくもやもやした。

それで、積率というものが元々どんな分野のどんな要件を満たすために産まれた概念なのかがわかれば、
なんでここで積率を導入するのか、しようと思ったのかが理解しやすいかな、って思ったから聞いてみた。
スレ違いだったらごめん。

621:132人目の素数さん
14/02/04 23:12:14.41 .net
「利」があることが分かってんなら十分だろ

622:132人目の素数さん
14/02/04 23:30:40.14 .net
お前は学問向いてないな

623:132人目の素数さん
14/02/04 23:51:44.35 .net
統計学の課題を出されたのですが、まったく解らず困っています。
誰か考え方だけでも教えてもらえないでしょうか。
よろしくお願いいたします。

624:132人目の素数さん
14/02/05 04:57:32.20 .net
確か積率母関数の積率がモーメントのことで実際テイラー展開すると
モーメントの線形結合がわんさか出てくるから母関数だとマセマに
書いてあったよ。

625:132人目の素数さん
14/02/05 23:55:03.57 .net
キュムラント展開か、統計で役にたつのかな、物理なら分かるが

626:132人目の素数さん
14/02/06 21:53:36.67 .net
誤差付きのデータの扱いに関して質問があります。
誤差付きのデータの平均をとるときにエラーの大きさに応じて重みを付けるのはわかるのですが、
データの標本分散を求めるときには重みってつけなくていいのでしょうか??
Xってパラメータの標本があったとして(それぞれ誤差σがついてる)、X_iのデータの重みをw_i = 1/σ_i^2とすると分散は
V=sum(w_i*(<X>-X_i)^2)/sum(w_i)
にした方がいいのかなと考えたのですが見当違いですか?sum()が()内の総和で、<X>はXの加重平均です。
調べても加重平均の標準偏差しか出てこなくて誤差のついた標本の分布全体の標準偏差ってのが出てこなくて困った挙句物理板で聞いたらここを紹介されました。
どなたか教えていただけないでしょうか

627:132人目の素数さん
14/02/06 22:31:27.90 .net
標準偏差を求めるために標準偏差で規格化したら意味が無かろう

628:132人目の素数さん
14/02/06 23:51:35.27 .net
>>617
ごめんなさい、なんか自分がわけのわからないことをしようとしていたことに気付いたかもです。
なんか異なるいくつかの母集団それぞれの平均と標準偏差からそれら全体を母集団とする集団の平均と標準偏差を求めようとしてたんですけど、もともとそれぞれ違うものなんだから重み付けるのがそもそも間違ってるような気がしてきました。
例えると、蟻、犬、芋虫、猫、人、象って種の体長とその標準偏差をそれぞれ求めて、じゃあそれらの動物全体の平均体長とそのばらつきをそこからそれぞれの標準偏差で重み付けて求めようとしてました。
この場合、重みをつけるべきではないですよね?

629:132人目の素数さん
14/02/07 08:49:08.24 .net
正規化すればいいんじゃない?

630:132人目の素数さん
14/02/10 11:29:37.40 .net
1分に1回事件が起こるってポワソン分布に従って、乱数で件数を返す関数Aがあったとして
それを60回足し合わせたら
60分に60回ってポワソン分布に従って件数を返す関数Bと同じようなものになるの?
初学者なのでヘンテコな質問になってるかもしれないが

631:132人目の素数さん
14/02/10 16:41:47.30 .net
せめて確率変数と言ってはどうか
1分に平均で1回の~確率変数を60個足し合わせると60分に平均で60回の~になる

632:132人目の素数さん
14/02/10 18:08:40.15 .net
すまんなトンクス
うまいことできてんなぁ

633:132人目の素数さん
14/02/12 03:12:16.12 .net
1個のサイコロを600回投げたら1の目が118回出た。
このサイコロは正常ではないか、有意水準5%で推定せよ
↑この問題から、z=1.84<1.96 よって、正常でないとは言えない
この答の出し方がわからないんだが、どういう考え方でやってるんだ?

634:132人目の素数さん
14/02/12 03:18:55.59 .net
2行目、推定じゃなくて検定か
平均E=100,偏差σ=9.13を出して、
E-1.96*9.13 , E+1.96*9.13で有効な範囲出すだけじゃダメなんかな

635:132人目の素数さん
14/02/12 04:10:27.21 .net
標準化するんでしょ?
しかし問題合ってるか?これ

636:132人目の素数さん
14/02/12 05:15:13.90 .net
やっぱり問題(答え?)が間違ってるのかな?
(118-100)/9.13 >1.96
よって、正常ではない

やりかたはこれであってるのかな?

637:132人目の素数さん
14/02/12 23:13:56.67 .net
>>597
> 統計を人を騙す道具として使ってる企業多いから気をつけてね。

お前が人を騙しているんだろうがクズが。
詐欺師のくせに数学板にくるんじゃない馬鹿が!

638:132人目の素数さん
14/02/17 00:40:42.15 .net
execel2007の分散検定で「繰り返しのある分散検定」というのがありますが、
「対応のある分散検定」と同意でしょうか?

639:132人目の素数さん
14/02/19 02:42:00.85 .net
洋書の教科書を買いたいのですがオススメはなんでしょう?
unbiased, efficient, precise estimatorについて述べてあるもので

640:132人目の素数さん
14/02/23 00:46:19.69 .net
私立文系のアホですが統計やる事になり困ってます
中高の数学だと何の単元が統計学には必要でしょうか?

641:132人目の素数さん
14/02/23 01:24:40.92 .net
記述統計なら、数学よりむしろエクセル勉強。

推測統計なら、場合の数(数学A)、確率(数学A)、数列(数学B)、積分(数学Ⅱ)かな。
あと多分ならってないだろうけど、統計とコンピュータ(数学B)、確率分布(数学C)、統計処理(数学C)
は、目を通しとけば。

642:132人目の素数さん
14/02/23 02:24:09.41 .net
四則演算を覚えたら後は大学の統計を勉強すればよい

643:132人目の素数さん
14/02/23 11:37:51.64 .net
>>631
詳しくありがとうございます

644:132人目の素数さん
14/02/23 13:25:11.13 .net
大学で習う統計学を、高校数学の教養無しで学ぶのは無理じゃね。

645:132人目の素数さん
14/02/23 14:17:35.69 .net
自分の場合中学数学からやる必要があるorz

646:132人目の素数さん
14/02/23 21:07:40.18 .net
文型の統計学なら、理論より実践的なものを学ぶんじゃね。
経済統計とか社会統計とかさ。
調査票のとり方とか、そういうのかもよ。
確率分布とか、そういったものじゃない気がする。
経験者俺。

647:132人目の素数さん
14/02/25 13:35:48.53 .net
中学数学だとどこら辺の単元をやる必要がありますか?

648:132人目の素数さん
14/02/25 19:41:34.40 .net
ちょいと教えていただきたい
選挙みたいなやつの出口調査と実際の結果がどの程度一致するものなのか調べてみたいんだが
そういう場合は全候補者にそれぞれの得票数でχ二乗検定をすればいいのか
それとも単に順位相関を求めればいいのか
どうも何をどう適用すればいいか十分には理解してなくて

649:132人目の素数さん
14/02/25 22:58:28.19 .net
明日の16時39分頃に気をつけて下さい。
日本にも世界にも巨大地震が起きませんように。
皆さんも一緒に祈って下さい。

太陽フレアのXが発生しました。
太陽黒点数の100越えが24日間継続しているようです。

650:132人目の素数さん
14/02/26 23:33:48.35 .net
中学レベルの数学からやり直すのは、良いことかも知れんが。
正直その勉強が直接統計学に役立つようには思えないんだが。

とりあえず、「エクセルで学ぶ統計学」みたいな本でパソコンに打ち込んでいけば?

651:132人目の素数さん
14/02/27 21:06:41.09 .net
>>640
偏微分が理解できる様にしておけと言われていますが
正直偏微分が何が何だか状態です

652:132人目の素数さん
14/02/27 22:02:08.39 .net
あきらめろ。
中学の3年間で数学の初歩を学び、高校で2年目でやっと基本の微積を学ぶ。
5年もの時間をかけて身につけるものを、数日で理解できるわけがない。

653:132人目の素数さん
14/02/27 22:34:48.01 .net
確率変数をlogXと変換するのと、Xの確率密度関数にlog xを代入するのって何が違うの?前者は確率密度関数に1/xがつくのは知ってはいるけど

654:132人目の素数さん
14/02/28 02:02:37.78 .net
>>629におねがいします

655:132人目の素数さん
14/02/28 05:34:14.71 .net
偏微分は最小二乗法で使うからかな?
あれぐらいならすぐにわかる

656:132人目の素数さん
14/02/28 20:35:57.10 .net
>>642
猶予としては1年間くらいあります

657:132人目の素数さん
14/03/01 04:30:58.21 .net
来年から統計学を学ぶんだけど、標準偏差って二乗するよね?
たとえば、
1、2、3、4、5は平均3で、標準偏差は√10になると思うんだけど、
0、3、3、3、6は平均3で、標準偏差は√18になるよね?
平均とのズレの合計は同じ6なのに下の例の方が標準偏差が大きいけど、つまり同じ平均とのズレでも、差が大きいものを抱えている方が標準偏差が大きくなるってこと?
だから二乗するの?

658:132人目の素数さん
14/03/01 04:47:30.82 .net
分散「」

659:132人目の素数さん
14/03/01 19:44:10.76 .net
>>647
>差が大きいものを抱えている方が標準偏差が大きくなるってこと?
そだよ~
>だから二乗するの?
そりゃ関係ないよ~
数学では、絶対値を付けた差をとって計算するより
二乗して計算すれば計算が楽だから。楽というのは、そういう計算の
やり方が昔からしっかりと証明され、そろっているという意味。
ということで、二乗する事情はそういう事情。
二つの隔たりとかそういうのを数学的に計算しやすい。

平均だって、ふつうの平均(算術平均)もあれば、幾何平均なんてのも
あるでしょ。距離を計算するときにだって単なる差だけじゃ~ないのよ。

なにしろ、犬がお父さんやる時代だからね。

660:132人目の素数さん
14/03/01 23:05:09.21 .net
でも二乗しないと大きい差を持つほど大きくならないよね?
絶対値だけでやったら、差が大きいものがあるほど大きくならないと思うんだけど!

661:132人目の素数さん
14/03/02 00:42:06.62 .net
絶対値より二乗の方がいいのは、計算が簡単だからというのと、
二乗にルートをとった標準偏差σの1σがちょうど標準正規分布の転換点にあたるから、
って訊いたことがある。

662:132人目の素数さん
14/03/02 03:46:30.05 .net
二乗するのは、平均より離れた数値を持っているとより標準偏差が大きくなるからですよ
絶対値だと、平均との差の和が同じなら、例を挙げれば
2、2、3、4、4(平均3、平均との差の和は4)
1、3、3、3、5(平均3、平均との差の和は4)も同じになってしまいますが、
二乗したものを足せば、上が4、下が8になります。
つまり下の方が、ばらつきが大きいということなのです。

663:132人目の素数さん
14/03/02 06:03:58.55 .net
>>651
標準正規分布は、その前にすでに偏差平方和の考えがあるから
出てきてるんじゃないのかな?
だから、転換点に当たるからというのは、後からの話という
ことになる気がするぞ。ちがうかな?

計算が簡単とよく言われるけど、その簡単というのは何を言っているんだろう
といつも思う。単純に考えると絶対値をとってしまえばあとはなにも難しくないと思う。
したがって、簡単という意味は、もっと別な意味を持っていると思うんだけど
それってなんだろう?

大昔の数学者たちがいろいろやって、その中で >>642 の形が最もうまく
差を表せるということになって、偏差平方和ととる方向になっていった
という形なのかな?

664:132人目の素数さん
14/03/02 06:06:52.65 .net
>>653で訂正

その中で >>642 の形が最もうまく
⇒ その中で >>652 の形が最もうまく

665:132人目の素数さん
14/03/02 09:52:39.40 .net
>>653
絶対値の計算って難しいだろ。

666:132人目の素数さん
14/03/02 10:01:35.48 .net
絶対値にしてしまったら、
そのあとの難しさってなに?

667:132人目の素数さん
14/03/02 10:09:07.91 .net
計算済みの絶対値にしてしまえないからみんな面倒、難しいっていってんだよ。
どこでもドアがあったら簡単にハワイに行けますねと言ってるようなもの。

668:132人目の素数さん
14/03/02 10:24:50.87 .net
MAEが既知の分布の和のMAEとか計算したら発狂する

669:132人目の素数さん
14/03/02 10:35:02.82 .net
>>657
>計算済みの絶対値にしてしまえないからみんな
絶対値をとること自体、難しい部分ってある?

なんども質問で申し訳ない。いやみで聞いてないから、お願い。

670:132人目の素数さん
14/03/02 10:45:45.49 .net
なぜ聞いているかというと、知っている人間に聞いても
「絶対値の計算は大変だから」
という言葉で終わって、そのあとどうして大変なのか
ということを聞いても、答えが出てこないもので。
私も、聞かれたときにどうこたえていいかがわからない。
という経緯があります。

671:132人目の素数さん
14/03/02 10:53:29.91 .net
私なりには、単に差分をとったり分散や標準偏差にかかわらず、
その後の処理で、最小二乗など数学的枠組みが現在の
統計解析以前に確立していたので、その枠組みをつかう
ことが可能なため、というのが背景にあったためなのかな。
と思うんですが。間違いでしょうかね?
そもそも、>>652 のように、単なる差分だとうまく表せない
という問題がありますけど。

672:132人目の素数さん
14/03/02 10:55:18.05 .net
統計勉強すれば分かるよ
その程度の知識では無理

673:132人目の素数さん
14/03/02 11:09:24.42 .net
そうかなー
そもそも差分の枠組みでやることなく
既存の枠組みで覚えてゆくので、じゃあどこか問題かという
こと自体を考えることもないと思うんだけど。

674:132人目の素数さん
14/03/02 11:12:39.03 .net
問題を感じてないなら無理に知る必要もないだろう
微積を知らなくたってたいていの人は生きていける
>>658みたいな例も出てるけど意味が分からんのだろ?

675:132人目の素数さん
14/03/02 11:19:32.02 .net
>>660
自分で計算しても楽だったのなら
キミは数学の天才だからそれていいんじゃないだろうか。

676:132人目の素数さん
14/03/02 11:24:01.05 .net
>>664

>>658の例は、それで大変に良いと思う。
要は説明時に、どこでも「絶対値の扱いは面倒なので」という言葉
だけで飛ばしてしまっている。
分かっている人には良いが、入り口の人たちからすると、
コンピューターの発達した今では、絶対値をとって計算なんか
簡単じゃないか。どうしてなんだ。という考えが出てくる。
そこで、絶対値をとった場合、次に出てくる問題は何か、だから
二乗して使っている。
というような流で説明ができないものかと。

>>647 のような質問は、そういうことが前段階にあるために
出てくる問題じゃないかと思っている。

677:132人目の素数さん
14/03/02 11:31:51.78 .net
絶対値のついた関数の微分とか微分不可能な点ばかりでコンピューターどうのこうのという問題ではないんじゃ
よく知らんけど

678:132人目の素数さん
14/03/02 11:56:49.57 .net
前人が分布関数という考えに至った時
その段階で数学の枠組みを利用するためには
絶対値ではできないから
というのが背景にありそうですね。

統計解析の発展の歴史のような書物をみても
どういう経緯でそこに至ったかがうまく書かれた
ものが見つからなかったので。

679:132人目の素数さん
14/03/02 11:59:58.64 .net
y=|x|のグラフを書いて、
この関数が式のあっちこっちに埋め込まれて簡単だと言えるのならやはり天才だ。

680:132人目の素数さん
14/03/02 12:23:09.31 .net
コンピュータ時の昨今ではモンテカルロ法がもてはやされたりもするしな
やりたいことをやれるようにやった結果が現状だと言ってしまえばそれまでだ

681:132人目の素数さん
14/03/02 12:34:00.71 .net
>>669
X自体を正として扱えば
そういうグラフにすること自体ないだろ

682:132人目の素数さん
14/03/02 12:39:59.52 .net
その論法では足し算は簡単ですと言っているだけなのだが

683:132人目の素数さん
14/03/02 12:46:25.79 .net
絶対値を理解していないっぽいな
絶対値の否定か?

684:132人目の素数さん
14/03/02 12:47:53.40 .net
だって二乗しているのも正にするためが
理由の一つでしょう。
だからそれが本質じゃないだろう

685:132人目の素数さん
14/03/02 12:57:19.21 .net
>X自体を正として扱えば
これどういう意味なんだろうか

686:132人目の素数さん
14/03/02 13:09:27.36 .net
サンプルと母集団の違いとか統計量に対する演算とか
そういったことを気にしない世界ならいいんじゃないの

値を計算するだけならマンハッタン距離でもレーベンシュタイン距離でも
小学生レベルの簡単な計算だからね

687:132人目の素数さん
14/03/02 13:59:23.83 .net
共分散とかどうすんのかね
分散共分散行列とかもあるし

688:132人目の素数さん
14/03/02 18:10:20.83 .net
>>676
ありがとうございます。
分布を考える世界への導入を想定したときに
出てくるということですね。
なんかすっきりです。

>>677
それは既存の数学的枠具があることが前提なので
単純な差分からの場合は、そもそもそういうものに
発展し得るのか(別な考え方がでてくるかもしれないけど)
どうかさえ分からないですから、まあ心配無用でね。

あくまで、統計始めた人から、そういう質問が出てきたとき
どう答えたらスッキリしてもらえるか?という悩みでしたので。

689:132人目の素数さん
14/03/02 18:41:57.97 .net
分散や標準偏差の概念が見つかるずっと前に解析学や線型代数は発達してたから
その利用をしようと思うのは当然だと思うがなんか変なこと言ってるかな?

690:132人目の素数さん
14/03/02 18:46:01.77 .net
うん

691:132人目の素数さん
14/03/02 19:02:23.29 .net
>>679
それはその通りでおかしくない。

それを前提に考えたからこそ二乗するという手段を使用した。
そういう風にはっきりと説明することで理解してもらえる
ことにつながります。

692:132人目の素数さん
14/03/02 20:03:36.55 .net
どれが>>652かさっぱり分からん

693:681
14/03/02 20:08:12.09 .net
>>682

最初の質問者のことなら
>>652じゃなく>>647でしょ

>>647は出てないと思うけど。
おれは、>>647をみて、そういえば初めに統計を学ぶ人に似た
ようなことを聞かれる場面有るな~とおもって、
さあ、どう答えたらいいのかと思い、いろいろみんなに聞いた。

694:132人目の素数さん
14/03/02 20:15:59.02 .net
答えは簡単
偏差E(|x-m|^α)のメリット、デメリットを議論すればいいだけ
>>647にそれをいっても無駄、わからんだろう

695:132人目の素数さん
14/03/02 20:41:02.08 .net
二乗するのは差が大きいほど大きくするためだって先生に聞いたけど
まさにその通りでしょ
絶対値だと1、2、3、4、5も0、3、3、3、6も同じになるという前に言ってる人がいるのと同じ

696:132人目の素数さん
14/03/02 20:44:07.24 .net
1.馬鹿は引っ込んでろ
2.半年ロムれ
3.過去ログ読めよ
好きなの選べ

697:132人目の素数さん
14/03/02 20:45:17.11 .net
>>684
私は理解させられませんという告白になっちゃうよ

698:132人目の素数さん
14/03/02 20:46:51.94 .net
>>687
馬鹿には無理 FAQ

699:132人目の素数さん
14/03/02 20:51:08.74 .net
>>688
じゃあなく、あなたの告白ということ

700:132人目の素数さん
14/03/02 20:52:23.67 .net
とりあえずのりで突っ込みました、たいがいこれでだいじょうななはず、てかー

701:681
14/03/02 21:03:18.90 .net
お、その後も変な風に続いてるな。

>>685 それで、そっかーと思ってくれる相手であれば、なんも問題ない。

ともかくどうしようもなく素人が統計入門の際にわかりやすく。
そーだよねーと、思って通り過ぎてもらえばいい部分なんで
その説明方法であればよかったので、とりあえず俺は終了。

702:132人目の素数さん
14/03/02 21:04:30.06 .net
意味負は去った

703:132人目の素数さん
14/03/02 21:12:30.48 .net
そして忘れ去られる質問たち

704:132人目の素数さん
14/03/02 21:16:08.03 .net
[訂正]
意味負は逃走

705:132人目の素数さん
14/03/02 22:11:20.47 .net
>>685
こいつの言うとおりじゃね
大体あってると思う

706:132人目の素数さん
14/03/02 22:13:52.97 .net
>>685
こいつの言うとおりじゃね
大体あってると思う

707:132人目の素数さん
14/03/02 22:23:42.86 .net
大きくしたいならガンマ関数がお勧め

708:132人目の素数さん
14/03/02 23:37:25.87 .net
統計の最初は、分散や標準偏差を習うもんな。
そのとき、絶対値じゃだめなの?って当然思うわな。

709:132人目の素数さん
14/03/03 00:13:05.67 .net
うん

710:132人目の素数さん
14/03/03 03:20:51.62 .net
>分かっている人には良いが、入り口の人たちからすると、
>コンピューターの発達した今では、絶対値をとって計算なんか
>簡単じゃないか。どうしてなんだ。という考えが出てくる。
こんな考えなかなか出てこないと思うわw
高校1年以上なら絶対値=面倒くさいというのが普通だろう

>X自体を正として扱えば
>そういうグラフにすること自体ないだろ
ここはもうめちゃくちゃ

711:132人目の素数さん
14/03/03 05:32:22.09 .net
自分も似たような感想を持った
そもそも二乗したら2→9、3→9と実際の差よりも大きくなってしまって何も論理的に語れなくなるんじゃないかと思ったんだけど
どうなの?

712:132人目の素数さん
14/03/03 05:49:22.15 .net
最近話題の緑本だけど何故対数変換がダメなのか、それと
なぜ割り算値を説明変数にするのがダメなのかがよくわからなかった。
詳しい人解説おねがいします。

713:132人目の素数さん
14/03/03 07:58:56.37 .net
>高校1年以上なら絶対値=面倒くさいというのが普通だろう
そういうやつは、2乗も面倒じゃないか?

714:132人目の素数さん
14/03/03 08:35:38.28 .net
少なくとも面倒かどうか知らないということは
中高のときに数学をほとんど勉強していないのではないか。
計算経験がほとんどない。

715:132人目の素数さん
14/03/03 08:53:32.01 .net
この場合、単に距離としての扱いだから
別に面倒でもない気がするな

716:132人目の素数さん
14/03/03 09:13:21.27 .net
やはり統計学をきちんと理解するには数学を勉強してないと難しいよ。
距離とか次元とかノルムとか空間とか概念を理解していないと、意味不明な議論になる。
距離といっても、ピタゴラスの定理しか思い浮かばないようだとやはり厳しい。
「微分可能性」だけ考えても、絶対値は不利だということはすぐわかる。
もっとも、記述統計学内の議論ならば、絶対値もありかなとは思う。
推測統計学まがいの議論をするくらいだったらね。

717:132人目の素数さん
14/03/03 09:23:02.40 .net
あ~
前の議論の延長としての話なんで
すれ違ってたね

718:132人目の素数さん
14/03/03 10:08:57.08 .net
住人のレベルが分かる議論

719:132人目の素数さん
14/03/03 11:29:52.62 .net
おまえもなー

720:132人目の素数さん
14/03/03 11:32:54.38 .net
おれのレベルがわかる発言はしていない、ふふふ

721:132人目の素数さん
14/03/03 14:41:44.39 .net
L^1空間よりもL^2空間の方が何かと都合がいい

722:132人目の素数さん
14/03/03 15:02:59.40 .net
>>711
既に書いた
>>684

723:132人目の素数さん
14/03/03 15:04:15.21 .net
そういえば俺も二乗する理由を教わってなかったな。
つまるところどういうことなの?

724:132人目の素数さん
14/03/03 15:09:30.19 .net
>>713
既に書いた
>>662

725:132人目の素数さん
14/03/03 15:21:07.42 .net
流石にその答えじゃ納得せんやろうなあ

726:132人目の素数さん
14/03/03 15:28:26.60 .net
>>715
おまえがどうぞ

727:132人目の素数さん
14/03/03 15:31:46.48 .net
その答えしかないってことね
なら仕方ないか

728:132人目の素数さん
14/03/03 15:34:05.70 .net
>>717
遠慮すんなよ

729:132人目の素数さん
14/03/03 15:37:30.79 .net
あなたに出来ないのなら誰にもできないよ
仕方ないことだ

730:132人目の素数さん
14/03/03 22:32:59.41 .net
支那竹みたいだな

731:132人目の素数さん
14/03/04 03:26:27.60 .net
統計学二乗は確かに難しいな。
誰かここには分かってるやつはいないのか?

732:132人目の素数さん
14/03/04 04:29:48.75 .net
L1って理論値求めるとき大変そう

733:132人目の素数さん
14/03/04 09:42:21.68 .net
じゃ、「計算しやすいから」がここの総意ってことでFA?

734:132人目の素数さん
14/03/04 09:47:56.42 .net
いつまで粘着してんだよ

735:132人目の素数さん
14/03/04 16:49:04.85 .net
計算しやすいだけじゃ何の意味もないのは自明だろ
ユークリッド距離と同型なら同様に自然で蓄積された知識が流用できて都合が良いだけさ

736:132人目の素数さん
14/03/04 17:09:07.98 .net
違うよ。
簡単に言うなら >>685
手法にはフォーカスしてない。

737:132人目の素数さん
14/03/04 17:24:32.46 .net
絶対値>ニ乗>四乗>六乗>八乗てか

738:132人目の素数さん
14/03/04 17:25:47.21 .net
逆だな
絶対値<ニ乗<四乗<六乗<八乗てか

739:132人目の素数さん
14/03/04 20:29:50.26 .net
>>647, 685
>絶対値だと1、2、3、4、5も0、3、3、3、6も同じになる
??
分子のみだけど、
> sum(abs((1:5)-mean(1:5)))
[1] 6
> sum(abs(c(0,3,3,3,6)-mean(0,3,3,3,6)))
[1] 15
そもそも全然違うのだけど。

740:132人目の素数さん
14/03/04 20:39:33.89 .net
おいw

741:132人目の素数さん
14/03/04 20:40:12.36 .net
>>729
なにそれ。

742:729
14/03/04 20:55:18.23 .net
ごめん、やっぱり合ってたわ。タイポした。
> sum(abs(c(0,3,3,3,6)-mean(c(0,3,3,3,6))))
[1] 6

743:132人目の素数さん
14/03/04 21:14:50.53 .net
数学会の世界を揺るがす小保方さん出現か!とおもった。

744:132人目の素数さん
14/03/04 21:19:30.65 .net
このスレのレベルをよく表しているじゃないか

745:132人目の素数さん
14/03/05 08:08:36.75 .net
誰か>>702の解答おねがいしまう

746:132人目の素数さん
14/03/05 08:28:22.52 .net
緑本は知らんが特異点を持つ変換は嫌われる

747:132人目の素数さん
14/03/05 14:33:28.95 .net
いろんな問題集があるんだね

748:132人目の素数さん
14/03/05 16:47:51.75 .net
記述統計の側から眺めていても、
なぜ絶対偏差でなく2乗なのか
なぜ3乗や4乗でないのかの
スッキリした説明は出てこない。

標準偏差の生まれは正規分布のパラメータであって、
標本標準偏差はデータを正規分布からの標本と
見た場合の正規分布の推定量と考えれば、
2乗でなければいけない理由づけができる。

正規分布が登場する理由は、中心極限定理。

749:132人目の素数さん
14/03/05 17:31:04.61 .net
だとすると、
大学で統計入門時によく使われる説明、
「絶対値は扱いづらから」という旧来の説明は
必ずしも正しくないということになるのかな?

750:132人目の素数さん
14/03/05 17:37:10.17 .net
えっ、何がどうして「だとすると」になるの

751:132人目の素数さん
14/03/05 17:54:16.48 .net
上の方で、「絶対値は扱いづらい」からと言っている
流れから。おかしいかな?

752:132人目の素数さん
14/03/05 17:58:31.69 .net
すごくおかしい

753:132人目の素数さん
14/03/05 18:03:32.98 .net
不偏標準偏差でなく標本標準偏差を使う理由とか
計算が楽だからとしか言いようがない部分もあるが、
なぜ2乗か?に必然性を持たせようとするならば、
正規分布を経由したほうが物語性があるだろう。
「歴史的経緯で」じゃ、あまりにもツマラナイし。

754:132人目の素数さん
14/03/05 18:07:35.69 .net
なんで、言葉に、引っかかってるのがわからない。
あなたの言っている通りでしょ。

だから、絶対値は扱いづらい。という言葉で済ますのは良くないし
歴史的経緯で済ますのは良くないでしょ。

どこに引っかかったの?

755:132人目の素数さん
14/03/05 18:13:11.35 .net
>>743
言っていることは正しいと思うんだけど
困ったことに、正規分布は歴史的に後から出てきてるよね。
正規分布にこだわらずなんじゃないだろうか。

756:132人目の素数さん
14/03/05 19:53:37.14 .net
標準偏差だの正規分布だのが
アリガタがられる理由は、
中心極限定理以外に
思いつかないんだがなあ。

757:132人目の素数さん
14/03/05 19:56:29.40 .net
もう諦めて答えを見てはどうか。

758:132人目の素数さん
14/03/05 20:10:58.60 .net
歴史的には標準偏差の方が、正規分布や中心極限定理より後に出てきたらしいが。
正規分�


759:zや中心極限定理は、ド・モアブル、ラプラス、ガウスあたり。 標準偏差はピアソン。



760:132人目の素数さん
14/03/05 21:43:27.00 .net
二乗にも、いろいろ事情があるもんだ

761:132人目の素数さん
14/03/05 22:58:24.62 .net
ざぶとん

762:132人目の素数さん
14/03/05 22:59:49.30 .net
いくつぐらいになったらオヤジギャグに笑えるようになるかという統計データがほしいです。

763:132人目の素数さん
14/03/05 23:55:00.73 .net
ここは
この板のレベルが分かる書き込みだな
だろう

764:132人目の素数さん
14/03/06 00:12:31.79 .net
>>749
数学において難解な二乗は
「愛の事情」
弱ったことにマイナスしか出てこない

765:132人目の素数さん
14/03/06 23:29:11.45 .net
平均値と、中央値、(もしくは最大値、最小値も加えて)から
最頻値mode を推定することができますか?

766:132人目の素数さん
14/03/07 00:42:33.41 .net
無理

767:132人目の素数さん
14/03/07 01:00:44.42 .net
>>754
分布がわかってれば
できることもあるけど

768:132人目の素数さん
14/03/07 01:19:19.24 .net
正規分布でも仮定するんだろ
母集団平均の推定と同じだが

769:132人目の素数さん
14/03/07 01:55:46.82 .net
まさか平均0で標準偏差1の場合だったりして

770:132人目の素数さん
14/03/07 03:18:38.62 .net
>>757
エスパーさんか

771:754
14/03/07 13:02:30.53 .net
ありがとうございます。やはり無理そうですかねえ。
分布は正規分布ではないですが、偏りのある一峰の山のある分布を前提としています。

何故、このようの事を考えているのかといいますと。
Rで計算をしていますが、modeが標準の関数にないということ。(パッケージがあるのは承知しています)
正しくmodeを計算するには、ヒストグラム(度数分布)を求めないといけなくて、サンプルセット数(サンプル数でなく)
が多くて計算量が多くなりすぎること。ビン幅も個別に設定しなければならないこと。

以上のことから、もっと簡易にmodeが求められたらいいのにと思った次第です。
すくなくとも、(最大値-中央値)=Aか、(中央値-最小値)=Bとすると、AかBかの
小さい方の範囲にmodeがあるはずです。
また、平均値と中央値の差が大きければ、modeも中央値より離れていると想定できます。

そのあたり何かアイデアがないでしょうか。

772:132人目の素数さん
14/03/07 14:07:00.02 .net
ヒストグラムなんぞ使うな、累積分布にしとけ
累積分布ならビン幅などいらんぞ
ヒストグラムより本質的な累積分布を軽視するのは教育の欠陥だ

773:132人目の素数さん
14/03/07 18:31:15.29 .net
すきにすればいいだろ

774:132人目の素数さん
14/03/07 19:22:54.06 .net
当然だ、自業自得にすぎん

775:132人目の素数さん
14/03/07 20:09:37.43 .net
>>761質問の意味解っているなら、答えてやれよ。

776:132人目の素数さん
14/03/07 20:32:45.80 .net
これ結構難しいんじゃないの

777:132人目の素数さん
14/03/07 23:01:01.56 .net
様々な一峰の分布を調べて、
(最頻値-中央値) と (中央値 - 平均値) の相関を求めて、相関があるといえるなら、
(最頻値-平均値) ÷ (中央値 - 平均値) を計算しそれをAとする。
求める 最頻値 は、A × (中央値 - 平均値)

でどう?

778:132人目の素数さん
14/03/07 23:35:21.81 .net
>>760
平均値と中央値と最頻値は独立に指定できる

779:132人目の素数さん
14/03/08 00:49:52.87 .net
モードのオンライン更新ってできまいのかな

780:132人目の素数さん
14/03/08 09:38:56.41 .net
例えば1,2,2,1,1,2,2,...みたいにモードが収束しないサンプル列に対して
何らかの意味で効率的なオンライン更新則が作れるか考えてみたらいい

781:132人目の素数さん
14/03/15 07:25:39.51 .net
大学の数学の教科書、あまりの誤植の多さはポアソン分布に従っているとはとてもじゃないけど思えない。
刊行後も出版社のサイトで気軽に正誤表をアップできちゃえるからって、著者も出版社側も書籍作りに対して甘え過ぎだ。

782:132人目の素数さん
14/03/15 13:26:29.01 .net
身内の個人出版感覚なのかもシレン
教授が執筆した小部数書籍に校閲のプロを雇うのは予算的に無理だろうし

783:132人目の素数さん
14/03/15 13:51:50.89 .net
大学数学レベルだと正誤を判断できる人が少ないしなぁ
出版前にミス減らすのは難しいだろう

784:132人目の素数さん
14/03/15 14:57:44.21 .net
>>770
tex使って書いて、校正も自分でやってるんじゃないの?

785:132人目の素数さん
14/03/15 16:10:52.76 .net
大学の数学関係なく、日本の出版は誤植だらけ。
大半がマカーだから仕方がない。

786:132人目の素数さん
14/03/15 22:24:51.54 .net
つめが甘いのは、糖尿病だからだ。
研究職の人は、運動しないから。

787:132人目の素数さん
14/03/16 03:08:27.56 .net
アル中かニコチン中だから集中力が続かないんだよ。

788:132人目の素数さん
14/03/16 22:46:25.66 .net
アルコール中毒と
アルコール依存症は
別のもの。

789:132人目の素数さん
14/03/17 10:34:44.88 .net
比較的易しめな教科書を使って統計学を自習してるんだが、天下り的に書いてあることが、「定理」なのか「法則」なのか「経験的にうまくいく手法」なのか書いて無くてもやもやする。
例えば、「母分散が未知な商標本の推定/検定にはt分布を用いる」と書いてあって、それはt分布はそのような推定を正しく行えるという定理なのか?それともt分布を使うとうまくいくと経験的に知られているということなのか?

数学的に厳密な本を読めばちゃんと書いてあるのかな?

790:132人目の素数さん
14/03/17 10:35:43.41 .net
あ、改行してなかったごめん

791:132人目の素数さん
14/03/17 13:47:43.56 .net
書いてあるわけねー
定理は書いてるだろうが、定理と法則の違いは何だ?

792:132人目の素数さん
14/03/17 18:34:18.60 .net
定理じゃないか

793:132人目の素数さん
14/03/18 00:13:43.73 .net
ちゃんと書いてあるよ

○○が正規分布に従うとき××はt分布に従う
自由度nのt分布はn→∞で正規分布に弱収束する

とかね
予備知識として測度論を仮定するけど

794:132人目の素数さん
14/03/18 00:51:57.22 .net
すっきりしたいならルベーグ積分まで勉強してから吉田朋広の数理統計学を読むといいぞ

795:132人目の素数さん
14/03/19 14:56:35.88 .net
例えば、0~100の範囲の実数を考えます。

Aは、1,5,10,12,40,42,43,70,75,76 (10個)
Bは、2,4,6,10,12,41,43,74(8個)
Cは、5,6,22,23,50,51,52,55,62,63,70(11個)

以上のようなデータがあります。
これらABCのデータの相関関係を調べたいのですが
それぞれのデータ総数はことなっています。

ですのでエクセルでいうところのcorrel関数は
使えません。
だからといって、それぞれ相関がないとも言えません。
AとBの方が、AとCの相関より高い気がします。

こういったデータの数の異なる場合の相関の求め方を教えてください。
または、Rでの関数がありましたらお教えください。

796:132人目の素数さん
14/03/19 15:31:28.09 .net
個数が違うのに相関がある…?
別の分析方法を模索すべきでは

797:132人目の素数さん
14/03/19 15:41:10.68 .net
なるほど、相関とは言えないのですね。
各ABCがそれぞれ似ている度合を調べたいのです。
どういう方法がありますでしょうか?

798:132人目の素数さん
14/03/22 01:24:58.62 .net
似ているとは何か

799:132人目の素数さん
14/03/22 23:51:23.93 .net
>>787
質問に質問返しとな?あほですか。

>>784
とりあえず、ABCの集合について、0から100を10で区切り、
ヒストグラムを求める。
10で区切った分布の数を、ABCで相関係数で求める。
以上。

800:132人目の素数さん
14/03/23 13:07:48.14 .net
>>784
A,B,Cのそれぞれの近さを見るとしたら
分布の類似度を見るということにして
カルバックライブラーあるいはエントロピーあたりの
情報量を利用したほうがいいんじゃないだろうか。

801:132人目の素数さん
14/03/24 15:46:49.50 .net
質問です。
ロジスティック回帰と二項ロジットモデルの違いについて教えてください。
同じ、としているものや微妙に違う、としているものがあって困ってます。

802:132人目の素数さん
14/03/25 00:19:26.68 .net
同じでいいと思う派
あえて言うならロジスティクス回帰の一つに二項ロジットがあるって感じかな

803:132人目の素数さん
14/03/27 21:52:46.28 .net
質問です。

AグループとBグループの2つのグループがあるとします。
それぞれのグループの2種類の要素を抜き出し、
その要素間を比較した際に、ABグループに
有意差があるかどうかを見たいのですが、
正規分布するかどうかは予想できない物として、
どのような検定が見合っているのでしょうか?

設問が抽象的なのでもうちょっと具体的な例示をすると、


和食(Aグループ)と洋食(Bグループ)で、
それぞれ「食事量」「怪我の治る日数」という要素を抜き出し、

「食事量が多いほど、怪我の治りが早い。
 特に洋食グループほうが、やや治りが早い」

というように、ABグループのもつ要因(食事量)が、
最終的に「怪我の治り」に影響するかどうか、
みたいなことを調べたいのです。

804:132人目の素数さん
14/03/28 14:34:03.30 .net
学部1年からやり直しなさい

805:132人目の素数さん
14/03/28 14:48:15.29 .net
>>792
>具体的な例示をすると、
めちゃくちゃ

806:132人目の素数さん
14/03/28 15:27:23.57 .net
めちゃくちゃ、とか書かれても何のヒントにもならないんだけど、
例が悪いってことかな?


じゃあ、別の例を設定すると、

ある遺伝病を持つグループ(Aグループ)と持たないグループ(Bグループ)があり、
ある程度相関認められている第一要因と第二要因について、
特定の治療後に第一要因と第二要因を測定した場合、
Aグループの第二要因の平均改善率のみ高いとする。

この場合に、その上昇を誤差であるのか、有意差であるのかを検定する場合に
どんな検定法が考えられるのか、が知りたいのです。

遺伝病の有無をダミー変数化して、3要因に対してフリードマン検定をかけ、有意差が拾えた場合に多重比較する、という手順であってますか?


上司の論文用のデータを揃えるために統計学を今年から独習し始めたのですが、
完全独習なので周りに先生といえる人が存在せず(上司自体も統計が得意ではない)、
自分のロジックがあっているのかどうかが判断できなくて困ってるんです。

807:132人目の素数さん
14/03/28 17:13:15.83 .net
めちゃくちゃなのは君の上司w

808:132人目の素数さん
14/03/28 19:03:29.63 .net
exactly

809:132人目の素数さん
14/03/29 10:38:04.02 .net
>>792
件数がどれくらいかわからないけど、
クロスとってカイ二乗の値みて、違いの有無を
判断したらどう?
データ件数が、すご~く多いと、なんでも有意になっちゃうけど。

810:132人目の素数さん
14/03/29 10:42:50.93 .net
上司に相談してセミナーに参加するなり、大学の先生を紹介してもらえ
そうしないと今流行の捏造になります、といえば

811:132人目の素数さん
14/03/29 21:16:16.26 .net
>>798
結局、第一要因と第二要因の比率をとり、
A群、B群間の比率を比較することにしました。

ありがとうございました。

812:132人目の素数さん
14/03/29 21:49:47.78 .net
>>800
まあ、同じことですね

813:132人目の素数さん
14/03/31 00:49:09.14 .net
overall standard deviationとwithin standard deviationとの違いを教えてください

814:132人目の素数さん
14/04/01 00:39:27.60 .net
>>802
名詞句と副詞句

815:132人目の素数さん
14/04/01 07:15:16.63 .net
e+πが無理数であることを証明できた!!!苦節5年ううう

816:132人目の素数さん
14/04/01 07:28:53.06 .net
>>802
まさに言葉のとおり

まとめて見るか
グループごとに見るか

817:132人目の素数さん
14/04/01 08:53:52.96 .net
>>804
俺には、むりっすう

818:132人目の素数さん
14/04/01 13:10:38.57 .net
>>804ええ?e+πが無理数であることを証明?eが有理数であろうが無理数であろうが、πが無理数なら足せば無理数なのは自明ではないか?

819:132人目の素数さん
14/04/01 13:21:06.67 .net
無理数+無理数は有理数にもなる

820:132人目の素数さん
14/04/01 13:57:59.68 .net
>>807
e+π:無理数は未だに証明されてないんだ.
たしか証明されているのは,e+π,eπの少なくとも一つは超越数であるということだけ.

821:132人目の素数さん
14/04/01 14:05:17.36 .net
今日はエイプリル・フールということもあり、真に受けない方がいいぞ。
統計のスレで数論の話がいきなり出ることは何か不自然だろ。

822:132人目の素数さん
14/04/01 14:15:02.77 .net
群論から統計に来た先生知ってる

823:132人目の素数さん
14/04/01 14:17:13.06 .net
エイプリル・フールって本当はエイプリルフールという表記でいいのか。
「・」が必要なのかと思ってた。

824:132人目の素数さん
14/04/01 14:22:50.91 .net
>>811
多分、グラフ理論とか組合せ論の間違いだろ。
組合せ論関係なら、有限群関係で大多数の人が組合せ論に移ったという事実がある。

825:132人目の素数さん
14/04/01 14:30:25.95 .net
>>813 中学生の時に通ってた有名高校受験塾でやらされた青チャート数学Ⅰ(現在の赤チャート)で順列組み合わせをやって、面白いパズルみたいだと思ったことがある。

826:132人目の素数さん
14/04/01 14:32:03.82 .net
有名高校受験塾に通ってたんですか
それはようございましたね

827:132人目の素数さん
14/04/01 14:37:03.95 .net
>>814
本格的な組合せ論になると、有限群の表現論とか解析とか用いるようになる。
受験数学とは感覚が全く異なる。
色々なモノを用いる数学というか何


828:というか。



829:132人目の素数さん
14/04/01 17:54:37.06 .net
>>804
エイプリルフールの誤爆でした

830:132人目の素数さん
14/04/02 09:37:15.52 .net
>>811
>>804
エイプリルフールの誤爆でした

831:132人目の素数さん
14/04/02 21:10:24.91 .net
>>412
>最強の「学問」だ・・・・・・・・・・・・・
と、2013年に吹聴した東大医学部卒だが医学科でなく生物統計学専攻とか
のたまう胡散な御仁が、今度は『全国民のための統計解析』を宣教し
始めたようだが、傾聴に値するのかな?
1億人のための統計解析 仮説は最初に立てるな!  2014年3月25日
URLリンク(business.nikkeibp.co.jp)

832:132人目の素数さん
14/04/02 23:22:43.98 .net
医学科にいたら統計なんて下々の学問に手を染めたりしないだろうから
経歴としてはむしろ妥当なんじゃないかと思うが、読むに値するかは知らん。
ビジネス啓蒙書なら整理術とか記憶術とかと同じ枠で考えて判断すれば?

833:132人目の素数さん
14/04/02 23:28:29.86 .net
>>819
医学部だった?学部の時は計数工学あたりかと思ってた。

834:132人目の素数さん
14/04/03 09:35:01.29 .net
>>819
医学部「保健学科」

835:132人目の素数さん
14/04/03 15:32:48.45 .net
>>822
医学部看護学科だよ。

836:132人目の素数さん
14/04/03 19:17:35.95 .net
衛看か、俺の頃は唯一女子学生しか居ないところだったが

837:132人目の素数さん
14/04/03 19:30:48.01 .net
八田ちゃんか

838:132人目の素数さん
14/04/03 22:03:16.05 .net
>>823
東大看護学科卒ということは、八田亜矢子、小正裕佳子同様に理Ⅱ
入学組ということか?

839:132人目の素数さん
14/04/04 09:30:25.66 .net
>>824は多分大昔の話、理?、文?とか別枠で衛生看護学科(4年生)
入学資格女子のみ、ただし最初の2年は駒場で一般教養をやってたから
女性の少ないあの頃の東大生は初恋の相手が彼女達というのが多かった。
詳しくはwikiへ

840:132人目の素数さん
14/04/04 20:37:32.94 .net
そう、大きく変わってるからね。
統計に関しても、国内の一つの柱になってる。

841:132人目の素数さん
14/04/05 07:41:06.63 .net
>>821
あづまぶる東大じゃ応用統計学を、計数工学と称するのか?関西じゃ
耳にせぬ名称だな。すると計量工学もあるのか?京大じゃ数理工学科、
阪大じゃ基礎工応用数学科だったか。

842:132人目の素数さん
14/04/05 09:46:22.65 .net
>>829
「計測+数理」からの造語なんで「計量」の対義語じゃないみたいね。
関西に限らず、たしかに計数工学という科は東大以外あまり聞かないね。
まあ、実務の世界で活躍している人を多数輩出してるので
看板の一つだろうな。 
そういえば工学部自体が世界最古だった

843:132人目の素数さん
14/04/05 18:30:56.35 .net
昔は(50年くらい前、今も?)数学が好きで理学部数学科に行きたいが
数学者になれるかどうか不安、とか親が工学部に行けと言うから、
という安全志向に押されてここに行った学生がかなり居た
実際理数卒より生涯収入は平均多いだろう
それぞれの教授になった連中は収入は同じようなもんだが、居心地はどっちがよかったか
まあ、性格は大分違ったね(後天的かもしれんが)

844:132人目の素数さん
14/04/05 20:39:10.45 .net
工学系は、他人がやっていない新しいことを探し出しやすいので
そういうのが好きな人は楽しいんじゃないかな。
院の生物統計も(医薬・看護系)で西欧は盛んでも


845:日本には専門が 無いということで、計数工学出身の教授が新たに作りたいという 事から始まったから、新しいもの好きに向きなのかも。、



846:132人目の素数さん
14/04/07 22:41:29.72 .net
>>832
生物統計を始めた計数工学出身の医学部教授というのは、
大橋教授のことですね?
東大 医学部健康総合科学科 大橋 靖雄 教授
URLリンク(www.hn.m.u-tokyo.ac.jp)

847:132人目の素数さん
14/04/09 12:12:37.52 .net
すみません、誰か教えてください。

適合度の検定で有意差が出て、どこに差があったのか多重比較を行う場合、
ライアン法を使っても構わないですか?

某オンライン統計サイトでは、自動的にライアン法で多重比較までやってくれますが、
ライアン法は「k×2分割表の比率」のみに使用できる、と書かれている場合もあります。

848:132人目の素数さん
14/04/13 20:51:10.51 .net
独学で統計を学びたいのですが、一冊目におすすめの本を教えて下さい。
スレチだったらすみません。

849:132人目の素数さん
14/04/14 01:16:37.80 .net
完全独習統計学

850:132人目の素数さん
14/04/15 08:49:25.19 .net
誘導されてやってきますた
スレリンク(math板:295番)

851:132人目の素数さん
14/04/15 09:01:31.73 .net
日本の大学で教えている確率・統計学じゃ使いものにならない気がするわ
物理の統計力学とかランダム行列とかまでやらないと

計数工学科は数理科学の工学版みたいなもんだろ
工学向けの数学に関する専門学科って感じだな

852:132人目の素数さん
14/04/15 09:29:35.41 .net
なぜ統計力学が出てくるのか

853:132人目の素数さん
14/04/15 15:54:29.26 .net
言葉が似てるからだろ

854:132人目の素数さん
14/04/16 00:06:46.19 .net
>>835
入門は放送大学つかえば?
ちょうど新学期の放送始まったばかりだから

855:132人目の素数さん
14/04/16 00:21:04.83 .net
>>841
放送大学良さそうですね。
此方まだ高校生なので理解に足りるかわかりませんが、一度みてみます。

856:132人目の素数さん
14/04/16 00:29:59.69 .net
確率・統計 (理工系の数学入門コース 7) 薩摩順吉

これを超える統計学入門書は存在しない。

857:132人目の素数さん
14/04/16 01:27:21.12 .net
放送大学の統計はプロ野球の公式戦でのダルビッシュや松坂の投球内容がやたらとデータ化されて教材として使用されてる

858:132人目の素数さん
14/04/16 23:39:30.73 .net
それは基礎科目の「身近な統計」の方か
専門科目の統計学はラジオなんだな。知らなかった

859:132人目の素数さん
14/04/17 07:34:56.89 .net
区間推定に関して質問です。

正規分布する観測量の平均値を推定するとき、標準化して標準正規分布の数値表から信頼区間を求めますよね。
この時、元になる分布とそれを標準化した標準正規分布の信頼区間が対応するとする根拠はなんでしょうか?

860:132人目の素数さん
14/04/17 12:52:37.51 .net
元側の確率変数に対し、同一の母平均の値を引いて、さらに同一の標準偏差で割ったのが、新しく生成された標準化された確率変数なのだから、
信頼区間内に含まれている標本群の特性は何ら変わらずに、標準化前→標準化後にそのまんま引き継がれていて当然なのでは?

861:132人目の素数さん
14/04/17 18:39:03.63 .net
平均値が最大値と最小値の間にあること。
中央値が平均値の2倍以下であること。(ただしデータは非負とする)
という2題を証明せよ、という問題なのですが、どういう方針で証明すればいいんでしょうか?

862:132人目の素数さん
14/04/17 18:47:21.04 .net
確率変数Xが平均μ分散σ2の正規分布に従うとき、
aX+bは平均μ+b分散a2σ2の正規分布に従う。
これの証明は、簡単で、多くの教科書に載っている。
思弁的な説明は、数学の範囲外にある。哲認定。

863:132人目の素数さん
14/04/17 18:52:51.59 .net
>>848
一行目:最大値と最小値を別々に証明すれば良い
二行目:データの半分は中央値より大きい

864:847
14/04/17 19:07:33.94 .net
>>847
感覚的にはわかるのですが、数学的に厳密な証明を知りたいです。自分で定積分計算しようともしましたができませんでした。

>>849
aX+bは平均μ+b分散a2σ2の正規分布に従うということと、対応する区間内での積分値が一致することが繋がりません

865:132人目の素数さん
14/04/17 19:22:46.16 .net
少しは自分で式を書いてみろ

866:132人目の素数さん
14/04/17 19:23:40.64 .net
>>848
なるほど、わけて考えるんですね。
ありがとうございました。頑張って解いてみます。

867:132人目の素数さん
14/04/17 22:21:55.63 .net
文系の大学生で基礎統計をやるんですけど
文系数学の知識ではできないところってありますか?

868:132人目の素数さん
14/04/17 22:28:23.31 .net
何やるのか知らんが、まともな内容なら、exp(x)ってなあに?だと正規分布すら分からないから無理
たのしいえくせる♪みたいな内容だったら文系だろうが問題ないでしょ

869:132人目の素数さん
14/04/17 22:31:58.40 .net
理系も混じってるからがちだと思う
新世社の入門統計解析ってのが教科書


微分積分の勉強すればいい?

870:847
14/04/17 23:32:36.87 .net
>>852
ん~自分でも式書いて証明こころみてるんですが、単純に積分してイコールになるっていう方法以外思いつかないんですよね。
で、積分するにしても∫[0,a]e^(x^2)dxは手計算では不可能らしいということが分かりましたし。。どうにも厳密な証明にたどりつかないんです

871:132人目の素数さん
14/04/18 00:06:36.61 .net
本当に書いただけだな

872:132人目の素数さん
14/04/18 00:09:47.66 .net
というか母平均を推定するときって標準化するっけ

873:132人目の素数さん
14/04/18 01:51:24.32 .net
>>859
そら正規分布表を読んで得られた数値って、標準正規分布という前提で色々計算された結果なんだし

874:132人目の素数さん
14/04/18 02:10:51.53 .net
意味も考えず計算するという奴か

875:132人目の素数さん
14/04/18 10:28:13.67 .net
うちの教授は統計は理論を理解するより
何度も計算して手続きを覚えろと教えてたな。

876:132人目の素数さん
14/04/18 16:02:24.45 .net
それで済む人はここに来る必要はない

877:132人目の素数さん
14/04/18 20:12:05.19 .net
そんな高度な議論をしていたとは今まで全く気づかなかった。それは失礼した。

878:132人目の素数さん
14/04/19 00:33:31.53 .net
高度だなんて誰が言った?

879:132人目の素数さん
14/04/19 00:47:58.52 .net
いやみ、皮肉でしょ

880:132人目の素数さん
14/04/19 01:05:05.32 .net
いや、おそらく864が863の意味を反対に捉えてしまったんだろう

881:132人目の素数さん
14/04/19 12:54:59.50 .net
どっちの意味でも同じじゃない?

882:132人目の素数さん
14/04/19 13:20:42.61 .net
正規分布って誰が発見したんですか?

883:132人目の素数さん
14/04/19 13:23:12.23 .net
ガウス

884:132人目の素数さん
14/04/19 13:40:05.59 .net
>>870
先生がガウスじゃないって言ってました。
名前は忘れたんですが思い出せなくて。

何人かの数学者が同じ頃に発見していたというように
いってたと思います。

885:132人目の素数さん
14/04/19 13:45:08.74 .net
あっ、そう

886:132人目の素数さん
14/04/19 14:25:54.78 .net
正規分布の意義を研究したからガウス分布と言うのさ

887:132人目の素数さん
14/04/19 14:56:27.60 .net
数学や物理はいつも同時発見が多いのは、発見されることが必然だからさ。

888:132人目の素数さん
14/04/22 11:48:02.43 .net
問題ではないのですが表を作る上でわからないことがあるため質問させて下さい。

点数と順位の表を作り、その内容から何点取れば何位程度になれるかという表を作りたいです。

サンプル数は非常に少ないのですが、例えば
40点 120位
65点 50位
というサンプルがある場合、80点取れば何位程度が想定できるかという表を作りたいです。

これはどのように表にすることが出来るでしょうか。

889:132人目の素数さん
14/04/22 11:49:37.18 .net
引っ越すならここじゃなくてポエムスレだろ

890:132人目の素数さん
14/04/22 15:17:09.10 .net
表とグラフは一応別物だと思っているんだが・・・回帰直線のグラフじゃだめなのかい?

891:132人目の素数さん
14/04/22 18:22:23.30 .net
>>875
スレリンク(math板:351番)

892:847
14/04/24 05:59:52.08 .net
>>846には答えてもらえなそうですかね~証明が載ってる本を紹介してもらうだけでもいいんですが

893:132人目の素数さん
14/04/24 06:38:39.95 .net
単なる変数変換だから
微積分の教科書読むといいよ

894:132人目の素数さん
14/04/24 13:14:10.39 .net
「読者を馬鹿にしてる」と言われそうな本があるんかな
ここで書いても馬鹿にされそうだが

895:132人目の素数さん
14/04/24 16:46:02.27 .net
>>879
まさかaを引いてbで割ったものを、bを掛けてaを足したら同じになる根拠はという質問?
標準化した信頼区間を元になる分布に対して見る場合は当然、bを掛けてaを足して元に戻すんだぞ。

896:847
14/04/24 23:03:33.44 .net
>>882
いえ、aを引いてbで割ったものが違う値になることはわかっています。

ただ、対応する値の間の区間の積分値は一致していなければこの推定は成り立ちませんよね?
たとえば、
f(x)を正規分布する確率変数として、それを標準化したものをg(z)として、
変数xの区間[a, b]に対応する標準化変数zの区間が[z1, z2]だとすると、
∫[a, b]f(x)dx=∫[z1, z2]g(z)dz
が成り立っていなければいけないと思うんです。でもコレの証明を見たことがないということです。
自分で計算しようとしても、どうしても定積分の計算でつまずいてイコールにできません。

897:132人目の素数さん
14/04/24 23:20:39.05 .net
確率変数と確率密度関数の定義もわからないでそんなこと考えてるのか

898:132人目の素数さん
14/04/25 00:20:57.87 .net
積分のとこ変数変換したら成り立たなくないか

899:132人目の素数さん
14/04/25 00:30:57.49 .net
ただ、対応する値の間の区間の積分値は一致していなければこの推定は成り立ちませんよね?

ここなぜそう考えたのかわからないので教えてください

900:132人目の素数さん
14/04/25 01:14:35.74 .net
>>883
そのつまずいたという計算を書いてみ

901:132人目の素数さん
14/04/25 03:45:10.98 .net
>>886
標準化する前も後も結局は同じ式、正規分布関数なのだから、
きっと、∫[(z1-μ)/σ, (z2-μ)/σ] 、∫[z1, z2]を正規分布関数で解けばいいんだよ。同じになるはず。

902:132人目の素数さん
14/04/25 21:24:23.58 .net
これが分からん奴に何を説明しても無駄じゃない?

903:132人目の素数さん
14/04/25 21:37:59.38 .net
数学の基本なしで統計やるとこうなる見本だな

904:132人目の素数さん
14/04/26 18:49:29.43 .net
最低でも数IIICはしないとダメだなという典型例か
今はCないらしいが

905:132人目の素数さん
14/04/26 21:42:21.27 .net
>>888
前半は元に戻すんだから∫[(z1σ+μ, z2σ+μ] だな。
正規累積分布関数なら代入するだけ。(x-μ)/√(2σ^2)の部分に代入するだけで、
簡単に同じ式になることが分る。

906:132人目の素数さん
14/04/29 20:47:00.77 i+jeaL/Iz
条件付き確率分布でf(x|y;θ)とf(x|y,θ)という書き方を両方見る気がする
違いはあるのだろうか

907:132人目の素数さん
14/04/29 20:49:01.01 .net
条件付き確率分布でf(x|y;θ)とf(x|y,θ)という書き方を両方見る気がする
違いはあるのだろうか

908:132人目の素数さん
14/04/29 22:13:14.22 .net
a, b, c という具合に変数やパラメータを並べる際、cだけがaやbとは別種のもののとき、その違いを強調するために a, b; c と書くことがある
云わば「強い区切り」としてセミコロンを使う

909:132人目の素数さん
14/04/29 22:15:42.00 .net
数式にそんな曖昧なルールが本当にあるのか?
単純に処理系の違いじゃないのか。

910:132人目の素数さん
14/04/29 22:18:55.68 .net
コンピュータに入力するわけじゃないんだから、数式の書き方なんて慣習頼みである程度の表記揺れはあるよ
見ればすぐに分かる程度の揺れだが

曖昧というのとは少し違う

911:132人目の素数さん
14/04/30 01:17:19.04 .net
定義は厳密だが表記は人次第

912:132人目の素数さん
14/04/30 10:44:14.86 .net
ニュートンの時代の話?

913:132人目の素数さん
14/04/30 11:13:14.34 .net
>>899
???

914:132人目の素数さん
14/04/30 11:16:19.66 .net
>強調するために a, b; c
ねーよ。

915:132人目の素数さん
14/04/30 13:17:34.48 .net
いや、あるよ
別に数学だけの慣習ではなく、英語一般に通じる話なんだけど>強い区切り

916:132人目の素数さん
14/04/30 16:14:10.89 .net
高校の英語でも習う話だな

917:132人目の素数さん
14/04/30 22:33:27.57 .net
音楽の記号使うか

918:132人目の素数さん
14/04/30 22:51:56.80 .net
>>894
そのケースでは、意味に差の無い
単なる「強い区切り」でしょ、たぶん。
楕円関数なんかだと、区切りの書き方によって
パラメータの表示方法が違ったりするから、
一応、文脈に沿った確認は必要だが、
おそらく >>895 の言うとおり。

919:132人目の素数さん
14/05/01 19:22:50.13 .net
曖昧に強調するためとかいうから勘違いする奴が出てくる。
ならボールド体や斜体表記でもいいだろということになる。

論理的に明確にコンマと区別したいから使うものだろう。
複数の数列とか行列とかコンマだけなら意味が不明確になる場合に。

920:132人目の素数さん
14/05/01 20:33:02.37 .net
アホ現る

921:132人目の素数さん
14/05/09 23:26:45.58 .net
統計についてほとんどわからないのですが、
あるゲームの中のイベントが発生する確率を調べたいと思っています。
例えば1000回試して10回起きたとしたら普通に計算すると発生確率1%になりますが
この結果が偏りではなく、実際の発生確率とほぼ同じかどうかを検証する方法ってありますか?

922:132人目の素数さん
14/05/10 12:44:30.37 .net
無限回試してみればいい

923:132人目の素数さん
14/05/10 13:02:04.24 .net
直感的に無理だと思うが

924:132人目の素数さん
14/05/10 13:07:44.85 .net
じゃあ直感で判断すればいい

925:132人目の素数さん
14/05/10 15:01:28.79 .net
ランダムは偏る場合もあるし、偏らない場合もある。
それは諦めて普通に推定すればいい。ほぼ同じかどうか知りたいんだから、
信頼度99%とかで発生確率を推定すればいいだろう。

926:132人目の素数さん
14/05/10 16:34:37.71 .net
>>912
>信頼度99%とかで・・・・・・・・・・・・・・・・
モンテカルロ法で発生確率>>908をシミュレーションするとして、推定に
適用する信頼水準は、常用する99%でも95%でもなく、常用しない80%とか
60%にすると推定理論上何か問題があるのでしたっけ?

927:132人目の素数さん
14/05/10 19:01:25.62 .net
何の問題もないよ。信頼度を落とせば、信頼区間は狭くなるだけ。
試行回数1000回を1万回にすれば精度もあがる。お好みでどうぞ。

928:132人目の素数さん
14/05/11 06:24:42.58 .net
>>914
お好みでと言われるが、信頼区間幅を狭くして推定精度を上げても
その信頼度が60%なり50%なりだと、2回に1回はその推定値範囲内に
入らないわけで、算出はできるが実用にならないのではないか?

929:132人目の素数さん
14/05/11 12:35:09.39 .net
それこそお好み

930:132人目の素数さん
14/05/11 18:09:00.07 .net
このようなものは、χ^2検定が一般的
発生確率をp、試行回数をNとすると、
期待される成功回数はNpで、これをAと表すことにします。
失敗回数はN(1-p)で、これをBと表すことにします。
そして、実際試してみての成功回数がaで、失敗回数がb(=N-a)の時、χ^2と呼ばれる次の量
χ^2=(A-a)^2/A + (B-b)^2/B
を計算します。期待される量と、実際の回数が等しい場合は0になり、それからずれるほど
大きな値になるものです。これが、ある一定量を超えると、pがおかしいんじゃ無いかといえ、
今回の場合は自由度が1なので、3.84より大きいと危険度5%でおかしいといえるし、
6.63より大きくなると、危険度1%でおかしいといえる。

実際の計測が、1000回中10回ということなので、
発生確率を1%とすると、当然、χ^2=0で、おかしくない。
発生確率を1.5%とすると、χ^2=1.69で、おかしくない。
発生確率を2%とすると、χ^2=5.1で、危険度5%ならおかしいといえるが、危険度を1%にするとあり得る範囲となる。
発生確率を0.5%とすると、χ^2=5.025で、危険度5%ならおかしいといえるが、危険度を1%にするとあり得る範囲となる。
...
と、こんな感じで、危険度をある一定の値で決めれば、それに対応する発生確率の範囲を狭めることができる。

931:132人目の素数さん
14/05/12 17:19:53.25 .net
これはカイ自乗分布に従わないですね。

932:132人目の素数さん
14/05/12 20:35:09.37 .net
>>915
信頼度には、常用される99%か95%を採用すべきだろ。類似ケース例と
比較し易いから。
しかし99%か95%が常用値にされたのは、どういう根拠からなんだろ?
根拠を書いた統計本を、未だ見たことがない。

933:132人目の素数さん
14/05/12 20:53:25.98 .net
キリがいいし、人間の心的傾向による区分だよ。
1%で起こる確率は人はめったにない、めずらしいこととか感じる。
5%ぐらいになると、たまにある、時々あると感じる。
σ=1の中ならだいたいそんな感じ、ふつうにあるみたいな。

934:132人目の素数さん
14/05/12 21:58:23.85 .net
根拠はないだろう
1・5・10はちょうどいいってだけで気にしなくてもいい
目的に応じて調節すれば問題ない

935:132人目の素数さん
14/05/12 22:38:00.70 .net
根拠は明白。きりがいいから。

94.133%とか99.273%とか使う馬鹿はいない。誰が見てもきりが悪い。

936:132人目の素数さん
14/05/13 06:44:07.04 .net
>>921
1・5・10はちょうどいいと、最初に用いたのはピアソンだったっけ?

937:132人目の素数さん
14/05/13 23:09:59.99 .net
その年一番よかった曲を投票で決める際、一人が好きな曲を1位~5位として投票することができる
投票した5曲は1位として選ばれたら10pt、5位なら6pt。と重み付けされて集計されて、
投票が終わったときに全員分のポイントが合計され、合計ポイントが高い順にランキングになる

こういう投票システムで、自分の選んだ曲を上位にするために多重投稿している奴がいてランキングが狂ってしまう場合
これを統計的に見破るにはどうしたらいいだろうか

1.多重投票者は特定の同一曲に複数回投票し、残りの曲をどうでもいい曲で埋める
2.多重投票者は同じ日、あるいはかなり近接した日に連続して投票する
3.多重投票する必要のない曲(多くの人が投票する曲)は多重投票する意味がないので投票されない

等、経験的な分析は考えられるもののいい処理の方法がわからん
何かうまい方法はないだろうか

938:132人目の素数さん
14/05/13 23:13:28.64 .net
系列毎に決めればいいじゃないか。もちろん貢献度を考慮して。

939:132人目の素数さん
14/05/20 06:47:53.93 .net
確率とか統計とか知りたいんですけどwikipediaの正規分布の項を見ても理解できないので
初歩の初歩だけでも教えてほしいのですが

エクセルで(1/6)^x*(5/6)^(1000-x)*COMBIN(1000,x)の式を
x=110~220で計算してこのグラフを作りました
URLリンク(i.imgur.com)
意味としてはサイコロを1000回振った時の1の出る回数の確率分布って感じなんですが
きれいな正規分布のように見えるのですがμとσがここからどう求まるのかが分かりません

このグラフ又は式からμ及びσの求め方を教えてください

940:132人目の素数さん
14/05/20 08:17:46.77 .net
muは1000*1/6
sigmaはsqrt(1000*1/6*5/6)で近似できるだろうね
最尤推定で正規分布なら推定量は
muは標本平均
sigmaは標本標準偏差になるかな

941:132人目の素数さん
14/05/20 08:41:47.56 .net
即レスありがとうございます
計算するとμ=166.7 σ=11.785くらいですね
なんとなくそれくらいなのはわかります
二項分布の公式のようなものが有るみたいですね
少し調べてます

942:132人目の素数さん
14/05/24 01:10:21.31 .net
二項分布の検定で標本数が少なくnp> 5 nq> 5 を満たさない場合の
検定方法を教えてください。

943:132人目の素数さん
14/05/24 08:17:11.20 .net
>>928
>二項分布の公式・・・・・・・・・・・・・・・・・
どういう公式のこと?そもそも正規分布>>926質疑に、何故
二項分布式なのか?

944:132人目の素数さん
14/05/25 00:32:57.06 .net
>>930
すいません、よく理解してないんで変なこと書いちゃいましたかね?
Wikipediaで二項分布の項目に

期待値・分散[編集]
B(n, p)にしたがう確率変数X に対し、X の期待値E[X]は
E[X]=np
であり、分散Var[X]は
Var[X]=np(1-p)
となる。

とあるのが公式なのかなと思いました
nが十分に大きい二項分布は正規分布で近似できるともあるし
(1/6)^x*(5/6)^(1000-x)*COMBIN(1000,x)
はそもそも二項分布式です
>>927でグラフを云々でなく提示式の数字だけ出して答えてくださっていたので
二項分布の公式なんだろうなと>>928に書いたのでした

945:132人目の素数さん
14/05/25 12:11:10.78 .net
平均と分散だけでいいだろ
何が公式なんだよww
頭おかしいんじゃないの?

946:132人目の素数さん
14/05/25 13:32:16.04 .net
頭おかしい扱いされたのですが
公式という語句を使ったのがまずかったのですか?

947:132人目の素数さん
14/05/25 14:06:06.19 .net
どうでもいいよ

948:132人目の素数さん
14/05/25 14:13:57.41 .net
>>934>>932>>930
なんかカチンと来る人ですね
そもそも最初の文章が読めてなかっただけなんじゃないですか?
数学できても日本語できない感じですか?

949:132人目の素数さん
14/05/25 14:36:34.30 .net
すみません、熱くなって見苦しい言葉を書いてしまいました
こちらとしては中途半端な知識で来ているので
間違っている点があればきちんと正していただきたかったのですが残念です
これ以上ここにいるのは誰にとっても不利益だと思うので去ります
スレ汚し失礼いたしました

950:132人目の素数さん
14/05/25 14:57:32.79 .net
漸近分布使うかどうかだろ?
そんなに熱くなることかよ
二度と来ないみたいだからいいけどw

951:132人目の素数さん
14/05/25 17:47:49.47 .net
>>930
二項分布で簡単に解けるからだろ。

952:132人目の素数さん
14/05/25 19:36:35.00 .net
>>926
> このグラフ又は式からμ及びσの求め方を教えてください
定義にあてはめて計算するだけです。
計算そのものは高校の数学Iとか数学IIのレベルです。
以上。

953:132人目の素数さん
14/05/26 17:00:52.04 .net
0点。

954:132人目の素数さん
14/05/26 17:02:09.19 .net
つまりあんたは数学Iすら分かってないわけだ。
あんまり背伸びせずに着実に足場を固める方がいいと思うぞ。

955:132人目の素数さん
14/05/26 17:08:51.75 .net
平常点 -100点。

956:132人目の素数さん
14/05/28 04:48:48.32 .net
>>930 はなぜ知ったかしたのか。

957:132人目の素数さん
14/06/02 03:47:28.41 .net
二項分布の検定で標本数が少なく、np> 5 nq> 5 を満たさない場合の
検定方法を教えてください。

958:132人目の素数さん
14/06/02 13:18:07.01 .net
>>945
URLリンク(www.press.tokai.ac.jp)
統計数学序論 - 東海大学出版会
7.4 百分率の検定
    7.4.2 小標本のとき

959:132人目の素数さん
14/06/02 13:20:32.88 .net
URLリンク(www.amazon.co.jp)

960:132人目の素数さん
14/06/02 21:50:14.20 .net
そもそも何の検定なのかね

961:132人目の素数さん
14/06/03 00:59:49.14 .net
実用数学検定じゃねえの?

962:132人目の素数さん
14/06/04 21:03:43.63 .net
>>919
>しかし99%か95%が常用値にされたのは、どういう根拠からなんだろ?

フィッシャーさんが仕事をしていた所が農業試験場だったから。

963:132人目の素数さん
14/06/04 21:11:11.10 .net
漁師だと思ってたよ。確率的に。

964:132人目の素数さん
14/06/05 07:52:57.07 .net
「フィッシャーの統計理論」に書いてある。
フィッシャーは肥料や田んぼの作り方の効果を研究するだけでなく、
良い方法が見つかったら近所の百姓を説得してそれを実際に使って
もらうことも仕事だった。フィッシャーの得意な説得方法は次の二つ。

方法1:「今までお前らが経験したことのないほど麦がとれるぞ」
 麦は1年に1回、百姓は20歳から40歳までの20年間働く。
だから20分の1以下(5%以下)。

方法2:「百年に1回あるかないかの豊作を経験させてやるぞ」
 百年に1回あるかないかとは100分の1以下(1%以下)。

965:132人目の素数さん
14/06/05 11:47:08.81 .net
田んぼで麦を作ってたのか?

966:132人目の素数さん
14/06/05 20:17:24.22 .net
フィッシャーは人を釣ってたのか

967:132人目の素数さん
14/06/06 02:27:26.96 .net
フィッシャー、確かに釣り師っぽい名前だな

968:132人目の素数さん
14/06/25 22:35:58.88 .net
「特異度」って言葉なんか変じゃね? 意味が逆のような気がすんだけど..

特異度(とくいど)とは、臨床検査の性格を決める指標の1つで、ある検査について「陰性のものを正しく陰性と判定する確率」として定義される値である。
概要
特異度が高い、とは、「陰性のものを正しく陰性と判定する可能性が高い」、あるいは「陰性のものを間違って陽性と判定する可能性が低い」という意味である。

URLリンク(ja.wikipedia.org)

969:132人目の素数さん
14/06/26 21:35:08.87 .net
だから何?

970:132人目の素数さん
14/06/26 21:48:33.26 .net
逆というか・・わからんよな

971:132人目の素数さん
14/06/26 22:52:04.61 .net
1-4群のカテゴリーに分けた説明変数が二値アウトカムに与える影響を知りたいので、
SPSSを用いてロジスティック回帰分析を行いました。
1群を対照にして2群から4群に数字が大きくなるにつれてオッズ比が大きくなるという結果なのですが、
これを傾向があると言うにはどうすればいいか悩んでいます

カテゴリーから多項式対比を利用してみましたがこれでいいのか、そしてよいならば結果の解釈はどうすればいいのか
さっぱりわかりません。統計素人なので罵倒されてもいいですから、私の悩みを解決してください
教えてくれたら脱ぎます。いや、嘘ですけど。

972:132人目の素数さん
14/06/27 19:41:19.97 .net
虎ハンター・小林邦昭スレ

973:132人目の素数さん
14/07/07 22:38:31.18 .net
統計学ってつまらなくね?行列計算をひたすらやるだけじゃん

974:132人目の素数さん
14/07/07 22:44:38.34 .net
つまる/つまらないで学ぶ類のものではない
そうでしょう?

975:132人目の素数さん
14/07/09 09:35:26.53 .net
そう。
学ぶ必要は大きいが、
全くつまらない。

976:132人目の素数さん
14/07/09 10:01:16.08 .net
つまらないかそうでないか統計をとってみないとわかりません

977:132人目の素数さん
14/07/11 13:06:04.05 .net
つまらん統計をやってるんだな

978:132人目の素数さん
14/08/10 23:47:54.27 .net
すみません中卒です
n目のサイコロとo目のサイコロとp目のサイコロを同時に振った時の目の和の標準偏差はどう求めればいいのでしょうか?

979:132人目の素数さん
14/08/13 12:17:41.21 .net
事象が独立ならば、「(A+B)の分散」は「Aの分散+Bの分散」

よって、n目のサイコロとo目のサイコロとp目のサイコロを同時に振った時の目の和の分散は
サイコロを1回降った時の分散の合計なので、これのルートが求める標準偏差

980:132人目の素数さん
14/08/15 07:56:04.05 .net
ありがとう

981:132人目の素数さん
14/08/16 14:55:08.77 .net
ペプシコーラとコカコーラの「どちらがオイシイ?」という味比べの広告、カイ2乗検定とかF検定まで行ってみないことには、全くもって意味がないと思う

982:132人目の素数さん
14/08/18 17:23:24.91 .net
>>968
発想がアホすぎる
「統計的に意味がない」ところに「広告として意味がある」
あえて反論の余地を残すことで、広告倫理やコカコーラ社の反撃といった問題を回避できている

983:132人目の素数さん
14/08/19 06:48:05.68 .net
コカコーラのほうが上手いのは当然だから、検定するまでもなくあれは間違いだよ

984:132人目の素数さん
14/08/19 20:18:00.63 .net
平均の差が有意か調べたいのですが、

{1,2,3,4,5}と{2,3,4,5,6}でP値は0.3466
観測値を1000倍して{1000,2000,3000,4000,5000}と{2000,3000,4000,5000,6000}としてもP値は同じになりませんか。

F1のピット作業時間みたいのは、全部差がないと出るような気がするんですが、どうしたらいいのでしょう?

985:132人目の素数さん
14/08/21 14:38:06.89 .net
>>971
とりあえず計算すれば?

t検定の中身を考えれば自明だが、
{1,2,3,4,5}と{2,3,4,5,6}の比較は、1000倍しようが0.001倍しようがP値は0.3466だよ

986:132人目の素数さん
14/08/23 06:29:24.94 .net
>>954
チームAのピット作業時間のサンプルから平均値を推定
チームBのピット作業時間のサンプルから平均値を推定
両者の間に差がないと仮定すると1%くらいでしか起きないことが発生している→有意差がある
とかそんな感じだと思う

987:132人目の素数さん
14/08/23 15:40:03.95 .net
統計検定2級取ろうと思ってるんですけど
テキストのオススメ教えてください
公式のテキストは評判悪く、しかし試験内容を過不足無く勉強したいので
良いテキストあったら教えて下さい

988:132人目の素数さん
14/08/23 16:39:50.62 .net
2級去年取ったけど、過去問やるだけでいいと思うよ

989:132人目の素数さん
14/08/23 18:18:24.43 .net
過去問を全部無料で見れるサイトありませんか?
1回分だけなら公式ページにありますけど。

990:132人目の素数さん
14/08/23 23:04:08.82 .net
この間の試験で、統計検定2級に受かった者です。
3週間くらいかけて勉強しましたが、過去問以外で役に立ったのは、宮川先生の「基本統計学」でした。
ちょうどいいレベルだと思いました。

991:132人目の素数さん
14/09/02 19:48:48.56 .net
>>970
あの有名なコカコーラの失敗を知らないのか。
過去にブラインドテストで美味しいほうに味を変えたら、アメリカでデモが起きた。
おれたちのコカコーラを返せって。結局、コカコーラは味を戻した。
人の好き嫌いは美味しい不味いじゃないんだよ。

992:132人目の素数さん
14/09/03 00:18:51.11 .net
あれ単にコカコーラクラシックを並行して売るって話じゃなかったの?

993:132人目の素数さん
14/09/06 06:31:37.14 .net
統計検定HPの2級の過去問の問11[1]の解答が2番になってるけど3番の間違いではないか?

994:132人目の素数さん
14/09/08 07:27:36.44 .net
宝くじやTOTOの当選番号って変数が多すぎて過去の当選番号解析したからって当たるわけないと思うんだけど
なんでそんな詐欺まがいの書籍がドヤ顔で売られてるんですか?

995:人目の素数さん
14/09/08 07:50:02.26 .net
六次の隔たりの理論には穴がある
何人目かの知り合いと別の何人目かの知り合いが
結構かぶるので同じ人を何度もカウントする可能性が大きい

996:132人目の素数さん
14/09/08 08:06:12.21 .net
宝くじは売れなかった当たりを公表していない。
ほとんどの解説本は無意味な計算をしている

997:132人目の素数さん
14/09/08 08:12:50.29 .net
ネットワーク上の人は世界人口のうちのほんの一部

998:132人目の素数さん
14/09/08 08:38:15.50 .net
来年経済学部に再入学して(といっても通信ですが)、統計学をやりたいと思っています。
経済学部となると数学の知識が少なからず必要となってくると思うのですが、
もう数学なんて何もかも忘れています。
高校時代も赤点とるほど苦手で、正直中学レベルも怪しいです。
通信なので時間はたっぷりあるのですが、高2程度の数学知識(数IIB)をつければどうにかなりますか?
それとも数IIICレベルまであげないとだめでしょうか?
高校は3年次文系選択して、数学も選択しなかったので、数IIICは一度も触れたことがありません。

999:132人目の素数さん
14/09/08 09:08:29.28 .net
回りくどいことしてないですまっすぐ統計やったほうがええんちゃう
それでわからんとこだけ調べればええやん

1000:985
14/09/08 09:28:45.81 .net
そうしたほうがいいんですかねー。
趣味でプログラムの基礎知識はあるので、
見た感じそういう要素(if文やループ文)が詰まってそうだなというのはわかるのですが、

    1 N
μ = ― Σ xi
    N i=1
とか、
           0,   if n is odd
E[(X - μ)^n] = { n/2
          (Π(2i-1)ο^n, if n is even
           i=1

みたいな見慣れない(昔やったんでしょうけど)数式ばかりなのでビビっていました。
高校の数学の先生が習うより慣れろとよく言ってたのを思い出したので、
資料あさってさっさと入門したいと思います。

1001:132人目の素数さん
14/09/08 10:11:41.18 .net
とりあえず手を動かしまくるのがコツ
紙に数式やらを書きなぐる
あとは実際にデータをパソコンで分析するのも大事

1002:132人目の素数さん
14/09/08 15:13:20.13 .net
>>981
人間が常に合理的な判断をするのでは無いから
または合理性を判断する基準が人や時によって違うから

1003:132人目の素数さん
14/09/08 15:16:37.89 .net
>>985
統計の入門書簡単なのを複数読んで見て
基礎的な概念、用語の定義を身につける
例えば確率変数とか独立試行とか確率密度関数とか目的変数とか
基礎から段階的に進むのがお勧め

1004:132人目の素数さん
14/09/08 23:58:33.67 .net
一番吸収力、理解力のある中高のときに出来なかったものは、
二十歳過ぎたら習得可能性はほぼ絶望的だろう。

1005:132人目の素数さん
14/09/09 01:41:23.38 .net
吸収力理解力があるから中高生が出来るのではなくて
教えてくれる人がいるから中高生が出来る
家庭教師でもつければ中卒50のオッサンでもどうにかなる

1006:132人目の素数さん
14/09/09 08:43:05.99 .net
吸収力というより必要性だろうね。
仕事で目的意識がはっきりすれば40からのPRML本も苦じゃなかったぞ。

1007:132人目の素数さん
14/09/09 12:41:29.87 .net
個々の体験談など統計やってりゃ・・・

1008:132人目の素数さん
14/09/09 13:00:50.75 .net
データがたりぬ

1009:132人目の素数さん
14/09/09 13:08:04.72 .net
グハハ

1010:132人目の素数さん
14/09/09 14:50:12.71 .net
各人の背景事情が様々なら統計で片付けられないでしょ
アホですか

1011:132人目の素数さん
14/09/09 19:28:12.65 .net
30歳(生物学科卒、女、8年間無勉強)でスタートで、
手計算で何でもできちゃう位しっかり習得 とはならなかったが
意味や途中式を理解してExcelを正しく使って求められる にはなったと思う

まったく教えてくれないが父は数学教授
父の部屋に転がってた学年不明の統計入門の期末テストを見たら手計算で全部いけた
3年生のレポートを盗み見たらまったく意味不明だった
そんなレベル

1012:132人目の素数さん
14/09/09 20:29:58.37 .net
>>997
おかしい!! 身長が正規分布する!!!

1013:132人目の素数さん
14/09/09 20:34:12.43 .net
やっぱりアホでした

1014:1001
Over 1000 Thread.net
このスレッドは1000を超えました。
もう書けないので、新しいスレッドを立ててくださいです。。。

1015:過去ログ ★
[過去ログ]
■ このスレッドは過去ログ倉庫に格納されています


最新レス表示
レスジャンプ
類似スレ一覧
スレッドの検索
話題のニュース
おまかせリスト
オプション
しおりを挟む
スレッドに書込
スレッドの一覧
暇つぶし2ch