とある件で発表の機会があり,その準備に追われている.弊社の顧客マスターから抽出した郵便番号をジオコーディングし,地図上にヒートマップを作成するという作業を行ったので,備忘録として残しておく.
全国の地方気象台の所在地を調べる
気象庁のサクラ開花日のテキストファイルでは全国の地方気象台の所在地は明らかではなかった.ジオコーディングを始めるには所在地を正確にしておくことが重要だ.手始めに全国の地方気象台の所在地を確認することにした.
PowerPointで消化管の断面・内腔を描く
ある機会があって PowerPoint で腸管の断面をイラストで描いた.その際のチップスを共有したい.
Office365のPowerPointで開発リボンを表示する方法
ちょっとした小技.Office 365 サブスクリプションでは「開発」タブが隠されていて初期状態では見られない.これを出す方法を見つけたので紹介する.
Google Apps Scriptでカレンダーからイベントを抽出する
カレンダーアプリは Google カレンダーに依存している.Google カレンダーから日付とイベント,詳細を抽出する必要が出てきたため,小一時間調べた方法を備忘録として残しておく.
気象庁のサクラ開花日のテキストファイル
4月初旬はソメイヨシノの開花に心が躍る.古い歌にあるように,
世の中にたえてさくらのなかりせば春の心はのどけからまし
あっという間に散っていく様は日本人の心を捉えて離さない.この桜の開花日の予測は気象庁でも行われている.
桜だけではない.生物季節観測の情報では各種の植物,動物を観測しており,過去のデータを公表している.
時節柄,過去の桜開花日をダウンロードして検索しやすいようにしようと考えた.
ファイルは最初に置いておく.好きに使ってくれて構わない.
関連記事
テキストファイルから SQL Server に気象データをインポートする
そのデータ,正規分布してる?
最近データを統計処理している関係で,統計の話題が多くなる.今回はデータが正規分布しているかどうかの検定について.
多変量解析の前に相関行列を見よう
Excelのピボットテーブルでクロス集計から統計解析まででも書いたが,統計解析の醍醐味は多変量解析にある.単変量解析では変数間の交絡の可能性が否定できず,重要なポイントを見落とすことがある.
統計の専門家ではないので完全に我流の方法であるが,多変量解析における変数選択の参考になるかと思い,記しておく.
過去に査読者とのやり取りの中で,変数選択の方法をかなり具体的に指示され,その通りにしないと通さないぞという言外の圧力を感じたことがある.
その時は違和感を感じつつもその通りにしたら通ったのだが,どうにもその違和感がずっと残っていた.いわく,単変量解析で有意になった変数のみを組み合わせて多変量解析に持ち込む,という手法だったのだが,本当にそれで良かったのだろうか?
IPAQガイドラインをクエリで表現するには
今回は泥臭い話になる.どんなプログラミングでも同じだが,一発で意図通りに動くことはまずない.試行錯誤の末,ようやくこんなものかという出来上がりである.SQL においても同じだ.クエリでは NULL の扱いが難しい.そんなところを感じ取ってもらえればと思う.
国際標準化身体活動質問票のデータ処理および解析に関するガイドライン
Google Formで条件分岐するアンケートを作成するで触れたが,国際標準化身体活動質問票は成人の一週間の運動量を半定量的に評価するアンケートである.略して IPAQ ともいうが,これのデータ処理に関するガイドラインを見つけたので紹介しておく.
IPAQ は東京医科大学公衆衛生学分野のサイトに掲載されている.Short 版,Long 版はさらに直近 7 日間と普段の 7 日間に分類され,結局 4 つの質問票があるが,ここでは直近 7 日間の Long 版を扱うことにする.
対象は 15 歳から 65 歳までの成人とされており,小児や高齢者での使用は想定されていない.しかしながら,これに替わる評価法がないのも実情であり,やむを得ず使用している施設もあると考えられる.
データベースにおける具体的なコーディングはIPAQガイドラインをクエリで表現するにはで説明しているので参考にされたい.