前回の記事では階乗を求めるユーザー定義関数を経てFisherの直接確率をストアドプロシージャで求めた.今回は四分表から感度と特異度を求めたい.
熱中症の搬送人員と最高気温との相関関係を可視化し閾値をχ二乗検定する
最高気温と熱中症の搬送人数との間に相関関係はあるだろうか.熱中症で救急搬送された人数は総務省の消防庁のサイトにある.これと気象庁のデータを結合してみた.
全国の地方気象台の所在地を調べる
気象庁のサクラ開花日のテキストファイルでは全国の地方気象台の所在地は明らかではなかった.ジオコーディングを始めるには所在地を正確にしておくことが重要だ.手始めに全国の地方気象台の所在地を確認することにした.
多変量解析の前に相関行列を見よう
Excelのピボットテーブルでクロス集計から統計解析まででも書いたが,統計解析の醍醐味は多変量解析にある.単変量解析では変数間の交絡の可能性が否定できず,重要なポイントを見落とすことがある.
統計の専門家ではないので完全に我流の方法であるが,多変量解析における変数選択の参考になるかと思い,記しておく.
過去に査読者とのやり取りの中で,変数選択の方法をかなり具体的に指示され,その通りにしないと通さないぞという言外の圧力を感じたことがある.
その時は違和感を感じつつもその通りにしたら通ったのだが,どうにもその違和感がずっと残っていた.いわく,単変量解析で有意になった変数のみを組み合わせて多変量解析に持ち込む,という手法だったのだが,本当にそれで良かったのだろうか?
Excelのピボットテーブルでクロス集計から統計解析まで
先日の鬼嫁/神嫁 婚前判定用アンケートを実施しますから鬼嫁/神嫁 婚前判定用アンケート結果に至るまでの解析の過程が誰かの役に立つだろうと考えて投稿する次第.ガチの統計手法だから一般社会人はとりあえずこれマスターしとけ.あ,大学で専門的にやってる人は除外ね.多変量解析とかはここでは扱わない.
大まかな流れとしては次のような感じ.今回の投稿はできれば Excel のインストールしてある PC で見てくれ.スマホだと演習問題が解けない.