行政区域データは Polygon であったが,河川データは Line と Point である.河川端点を表現するのに Point が使われている.
“国土数値情報の河川データをダウンロードして SQL Server 2008 R2 にアップロードできなかった話” の続きを読む
Co-evolution of human and technology
行政区域データは Polygon であったが,河川データは Line と Point である.河川端点を表現するのに Point が使われている.
“国土数値情報の河川データをダウンロードして SQL Server 2008 R2 にアップロードできなかった話” の続きを読む
医療圏のポリゴンデータをアップロードした際には日本語データが文字化けしており,原因も対処法も不明だった.
今回は行政区域データをダウロードし,SQL Server にアップロードしてみたところ,日本語が文字化けしなかったので報告する.
Shape2SQL は以前の記事でも触れたが,ESRI 社の Shape ファイルを SQL Server のテーブルに直接アップロードしてくれるツールである.残念ながら更新は停止しており,最新の SQL Server とは互換性がない.今回,SQL Server 2008 R2 を新規インストールしたところ,アップロードがうまく行ったので報告する.
Excelのピボットテーブルでクロス集計から統計解析まででも書いたが,統計解析の醍醐味は多変量解析にある.単変量解析では変数間の交絡の可能性が否定できず,重要なポイントを見落とすことがある.
統計の専門家ではないので完全に我流の方法であるが,多変量解析における変数選択の参考になるかと思い,記しておく.
過去に査読者とのやり取りの中で,変数選択の方法をかなり具体的に指示され,その通りにしないと通さないぞという言外の圧力を感じたことがある.
その時は違和感を感じつつもその通りにしたら通ったのだが,どうにもその違和感がずっと残っていた.いわく,単変量解析で有意になった変数のみを組み合わせて多変量解析に持ち込む,という手法だったのだが,本当にそれで良かったのだろうか?