ファイルや文書から、作成日時・著者・形式などの属性情報を自動的に取り出すこと。
「メタデータ抽出」を星図で探索する →
「メタデータ抽出」とは?意味を解説
デジタルコンテンツに付属する構造化情報(メタデータ)を、自動処理によって検出・抽出する技術。画像のEXIF情報、文書のプロパティ、XMLタグなどから目的の情報を識別して取得する。検索エンジン最適化やデータ管理の効率化に活用される。
例文
- 写真からEXIF情報を抽出し、撮影日時や場所を自動判別できる。
- PDFから作成者や更新日などの属性を抽出するツール。
- Webページのメタタグを抽出してSEOを最適化する。
語源・由来
「メタ」はギリシャ語の「meta(超越・自己言及)」に由来する情報工学用語。「データ」は「データベース」と同じくラテン語「datum」が語源。1990年代のXMLやセマンティックWeb発展に伴い、構造化情報処理の重要性が増す中で一般化した。
英語で言うと
metadata extractionmetadata miningattribute extraction
「メタデータ抽出」との違いを比較する
似た言葉との違い・使い分けを解説しています。
「メタデータ抽出」をもっと知る本
この言葉やそのテーマを深めたい方へ。
語彙の星雲で「メタデータ抽出」を探索する →