Code for Policy: Evaluating Japan's Local Gov IT Standardization and Open Data from an Engineer's Lens

どうも〜おかむーです!今日はちょっとエンジニアっぽい話をしますよ〜
- Local government core systems are being standardized, but machine-readability and API-first publishing still lag.
- e-Gov APIs and e-Stat dashboards exist, yet data formats and catalogs are fragmented across ministries.
- Practical fixes: publish OpenAPI specs, convert PDFs to CSV/JSON, and run a small SDK + CI pipeline to validate municipal feeds.
結論
政府は標準化の方向に動いていて、PMOツールで進捗を集めている(see: Digital Agency / 総務省資料)けど、エンジニア的に言うと"API一本で解決する"観点がまだ浸透していないです。要するに、公開の仕方を改善すれば利活用が爆発的に高まるということです。
レポート本文
現状の観察
これ見てくださいよ:デジタル庁や総務省のページ(digital.go.jp, soumu.go.jp)で「自治体情報システムの標準化・共通化」が進んでいると明記されています。一方で、行政データの提供はe-GovのAPIカタログ(api-catalog.e-gov.go.jp)やe-Statダッシュボード(dashboard.e-stat.go.jp)に分散していて、各自治体の実作業はPDF報告やHTMLでの掲出が多いんです。
技術的課題:
- PDF-firstでの公開(非機械可読)
- データモデルの統一が不十分(各自治体でスキーマがバラバラ)
- カタログはあるがOpenAPIやSDKが足りず開発者体験が悪い
APIとデータフォーマットの評価
APIは存在します(e-Gov API, e-Stat)。でもAPIの質を測ると:
- 一部JSONだが多くがXMLや古いCSV
- メタデータ不足で意味がわかりづらい
エンジニア的に言うと、OpenAPI + JSON Schemaでスキーマを定義し、CIでスキーマ検証を回せば破綻が減ります。要するに契約(contract)を明確にするだけで改善効果は大です。
実装ヒント(コード例)
簡単なe-Stat呼び出し(Python requests + pandas):
import requests, pandas as pd
url = 'https://api.e-stat.go.jp/rest/3.0/app/json/getStatsData'
params = {'appId':'YOUR_API_KEY','statsDataId':'0003412310'}
resp = requests.get(url, params=params)
data = resp.json()
nested JSON -> normalize
rows = pd.json_normalize(data['GET_STATS_DATA']['STATISTICAL_DATA']['DATA_INF']['VALUE'])
print(rows.head())
PDF表をCSV化するならTabula / Camelotでテーブル抽出、OCRはTesseractで補完というのが現実解です。
政策目標と実績ギャップ
総務省の標準化PMOで進捗報告は集まっているものの、公開される形が自治体ごとに違うため横比較や再利用がしづらい。数値目標(例えば移行率やAPI化率)があるなら、公開ダッシュボードで“データ品質スコア”を出すべきです。
改善提案
- 全ての公開データにOpenAPI/JSON Schemaを必須化
- PDFは最小化、もしPDFなら必ず原データCSVを添付
- 中央でのAPIカタログにCIでの契約テストを導入
- サンプルSDK(Python/JS)とopendata-workshopを用意して自治体の導入コストを下げる
- ドメイン別のパイロット(例:財務、住民台帳、地域競馬のレースデータ)で効果を示す
まとめ
標準化方針は良い方向に動いているものの、実運用はまだ“公開の仕方”でつまずいている。エンジニア的な契約(OpenAPI/Schema)と自動検証を導入すれば、データ利活用は劇的に改善しますよね。
おかむーから一言
テクノロジーで行政をアップデートするのは全然夢物語じゃない!小さなAPI改善とCIの導入で、社会のデータ活用が一気に変わるはずだと思うんです。
Sources
- https://www.keiba.go.jp/
- https://www.digital.go.jp/policies/local_governments
- https://www.keiba.go.jp/KeibaWeb/TodayRaceInfo/TodayRaceInfoTop
- https://www.soumu.go.jp/menu_seisaku/chiho/jichitaijoho_system/index.html
- https://www.keiba.go.jp/live/
- https://www.e-gov.go.jp/digital-government/api
- https://www.soumu.go.jp/menu_seisaku/ictseisaku/ictriyou/opendata/opendata03.html
- https://japan-opendata.github.io/awesome-japan-opendata/
- https://www.jichi.ac.jp/
- https://api-catalog.e-gov.go.jp/info/ja/apicatalog/list
- https://www.kantei.go.jp/
- https://dashboard.e-stat.go.jp/
- https://www.kantei.go.jp/jp/kakugikettei/index.html
- https://www.digital.go.jp/resources/japandashboard
- https://www.kantei.go.jp/jp/naikaku/index.html
Share
Related Reports

Code-driven Manifesto: Auditing Local Gov Data and Systems (Kagawa case study)
Local gov systems run but hide data behind UIs; expose CSV/JSON, APIs, and common schemas to unlock value.

Code-driven Check: Japan’s Open Data and the Machine-Readable Gap
Digital Japan has dashboards and rules, but PDFs and messy formats still block automated policy verification; mandate CSV/JSON, APIs, and dataset linting.

Code Speaks: Testing Japan's Gov Data and Dashboards
Japan has great dashboards but inconsistent machine-readability. This report inspects e-Stat, Japan Dashboard, Kantei PDFs, and proposes API-first fixes and practical code examples.