総務省消防庁の公開している熱中症搬送人員数は都道府県ごとに毎日データを反復抽出しているとも言える.複数の都道府県から繰り返しデータを取るのは独立した反復ではなく,疑似反復と考えられる.このような場合,都道府県単位で差が生じると考えられ,一般化線形混合モデルを用いて回帰係数を推定する必要がある.
今回はRのglmmML()関数を用いて一般化線形混合モデルを用いた回帰係数の推定を行った.
Co-evolution of human and technology
総務省消防庁の公開している熱中症搬送人員数は都道府県ごとに毎日データを反復抽出しているとも言える.複数の都道府県から繰り返しデータを取るのは独立した反復ではなく,疑似反復と考えられる.このような場合,都道府県単位で差が生じると考えられ,一般化線形混合モデルを用いて回帰係数を推定する必要がある.
今回はRのglmmML()関数を用いて一般化線形混合モデルを用いた回帰係数の推定を行った.
以前の記事ではポアソン回帰モデルおよび負の二項分布モデルを用いて熱中症搬送人員数に対する日最高気温と平均水蒸気圧の回帰係数を推定した.
人口10万人あたり何名の罹患者数,というのは割り算値である.総務省消防庁の公開している熱中症搬送人員数は都道府県ごとの搬送数であり,もともと都道府県別人口が異なるのだから搬送人員数を都道府県人口で割った割合のほうが指標として適切なのではないか,という指摘は一理ある.
しかし,割り算値ではなく実数を解析すべきである.変形した観測値を統計モデルの応答変数にするのは不必要であるばかりか,誤った結果を導きかねないからである.割り算値からは確からしさの情報が失われること,変換された値の分布が不明であることから,割り算値は避けるべきである.その代わりに割り算の分母をオフセット項として線形予測子に組み込む手法がある.
熱中症搬送人員数はカウントデータであり,その期待値は集計ゾーンの集計対象人口に依存する.都道府県人口をオフセット項とすることで,都道府県の人口規模の影響を調整した回帰分析ができる.今回は都道府県人口をオフセット項として線形予測子に組み込み,一般化線形回帰分析を行ってみた.
前回の記事では熱中症搬送人員数に対する日最高気温の回帰曲線を描いた.今回はポアソン分布に基づく搬送人員数の95%信頼区間を求める.
前回の記事では熱中症搬送人員数に対する日最高気温と平均水蒸気圧の影響をポアソン回帰モデルまたは負の二項分布モデルを用いて回帰係数を求めた.今回はポアソン回帰モデルの回帰曲線をRで描く.
以前,熱中症搬送人員数は日最高気温と相関関係があり,片対数グラフで直線になると述べた.今回はポアソン回帰モデルおよび負の二項分布モデルで熱中症搬送人員数に対する日最高気温と平均水蒸気圧の回帰係数を推定する.
“ポアソン回帰モデルおよび負の二項分布モデルを用いて熱中症搬送人員数に対する日最高気温と平均水蒸気圧の回帰係数を推定する” の続きを読む