
📚DH(デジタル人文学)ツール情報の自動収集・記事生成システムの構築
X投稿・RSS・GitHub APIから情報を自動収集し、AIで週間まとめ記事を生成するシステムの設計と実装
1134 件の記事があります

X投稿・RSS・GitHub APIから情報を自動収集し、AIで週間まとめ記事を生成するシステムの設計と実装
DH週間トピックス — 2026年3月21日週

iOSアプリのOCRパイプラインで、withThrowingTaskGroupによる認識処理の並列化を行い、検出領域数に応じて1.4〜6.7倍の高速化を得た記録。

ジャパンサーチの画像AI検索機能の内部APIを調査し、3段階のフローで画像アップロード検索が実現されている構造を確認

NDL古典籍OCR-Liteモデルをスマートフォンに載せて、完全オフラインでくずし字を認識するiOSアプリ「KotenOCR」を開発しました。技術構成や開発の背景を紹介します。

Yahoo Newsの記事と動画をローカルに保存する5つの手段(SingleFile、Playwright PDF、ArchiveBox、WARC、yt-dlp)を実際に試し、保存形式・ファイルサイズ・用途の違いを比較した

XCUITestでシミュレータのスクリーンショットを撮影し、PythonのPillowでマーケティング画像を生成、App Store Connect APIでアップロードするまでの全工程をシェルスクリプト1本で自動化する方法を解説します。

国立国会図書館サーチAPIから書誌データを取得し、LoRAにより小型日本語LLMをファインチューニングすることで、書名のみからNDC(日本十進分類法)の第1次区分を推定するモデルを構築する実践的チュートリアル。

researchmapでは科研費と業績の紐付けをAPI・CSVインポートで行えないため、Playwrightでブラウザ操作を自動化するスクリプトを作成した

Cantaloupe IIIFサーバーのキャッシュ設定とパラメータチューニングにより、タイル配信速度を最大7.6倍高速化した手法と効果を共有します。

Contentfulで多言語サイト構築中にPublishボタンがグレーアウトする問題の原因特定と解決方法。Management APIを使った調査手法も紹介。

Claude Codeのworktree機能とagentを活用して、Nuxt.js製のTEIビューアプロジェクトの6件のGitHub Issueを並行して対応した記録です。

Google Search Console で「クロール済み - インデックス未登録」が大量発生。schema.org 構造化データ(JSON-LD)の導入で改善を図った実践記録です。

ハンブルク大学forTextLabが開発したWebベースのテキストアノテーション・分析プラットフォームCATMAの機能と活用方法を紹介します。

Datawrapperは、チャート・地図・表を簡単に作成できるデータ可視化ツールです。20種類以上のチャートタイプやコロプレスマップに対応し、レスポンシブかつアクセシブルなビジュアライゼーションを提供します。

Flourishは、レースチャートやアニメーション地図などのインタラクティブなデータ可視化を作成できるプラットフォームです。30以上のテンプレートを備え、BBCやGoogleでも採用されています。

歴史的文書のクラウドソーシング翻刻プラットフォームFromThePageの概要と、DHにおける活用方法を紹介します。

デスクトップ版Gephiのブラウザ版であるGephi Liteを使ったネットワーク可視化の方法と、デジタル・ヒューマニティーズにおける実践的な活用例を解説する。

Hypothes.isは、W3C Web Annotation標準に準拠したオープンソースのアノテーションツールです。あらゆるWebページにハイライトやコメントを付けられ、教育・研究・ジャーナリズムの分野で活用されています。

世界最大のデジタルアーカイブであるInternet Archiveの概要と、デジタル・ヒューマニティーズにおける活用方法を紹介します。