1. 定義と概要
セマンティック・ウェブとは、Web上の情報に意味を付与し、コンピュータがその意味を解釈して自律的に情報を収集・処理できるようにする構想です。W3C(Webの標準規格を策定する国際的な団体)のティム・バーナーズ=リーが1998年頃から具体的なビジョンとして語り始めました。2001年に学術誌『Scientific American』へ寄稿した論文『The Semantic Web』によって、この名称と構想が広く知られるようになりました。
従来のWebページはHTML(見た目のレイアウトを記述する言語)で書かれており、内容の意味を解釈するのは人間の役割でした。検索エンジンはキーワードの一致を捉えるのは得意でも、ページが何について書かれているかという「意味」までは理解できません。
この課題に対し、セマンティック・ウェブはRDF(情報を「主語ー述語ー目的語」の組で表現し、データ同士の関係をコンピュータが読み取れるようにする記述の枠組み)でデータの関係を記述します。オントロジー(概念どうしの関係を体系的に整理した仕様)で意味の枠組みを与えることで、コンピュータが情報を横断的に解釈・連携できる状態を目指しています。
W3Cがこれらの仕様の策定を主導し、RDF・OWL(オントロジーを記述するための言語)・SPARQL(RDFのデータを検索する問い合わせ言語)などの技術群がその基盤を構成しています。
2. 試験対策ポイント
G検定では、提唱者と時期の対応関係が重要な論点です。W3Cのティム・バーナーズ=リーが1998年頃から構想を語り始め、2001年の論文『The Semantic Web』で概念が広く知られるようになったという経緯は、人物名とセットで扱われます。
目的の言い換えには注意が必要です。セマンティック・ウェブは「Webページの見た目を整える」技術ではなく、Web上の情報に意味を付与して人間だけでなくコンピュータも内容を解釈できるようにする構想です。見た目のレイアウトを扱うHTMLとの混同は、取り違えやすいところです。
構成技術の役割整理も重要なテーマです。それぞれの技術は、次のように役割が分かれています。
| 技術 | 役割 |
|---|---|
| RDF | 情報を「主語ー述語ー目的語」の組で表し、データ同士の関係を記述する |
| オントロジー | 概念どうしの関係を体系化し、意味の枠組みを与える |
| OWL | オントロジーをコンピュータが処理できる形で記述する言語 |
| SPARQL | RDFで表現されたデータを検索するための問い合わせ言語 |
データの関係を記述するRDFと、概念の関係を体系化するオントロジーの役割の違いが、この整理の起点になります。
LOD(Linked Open Data)とは、様々な組織が公開したデータをRDFの形式で相互にリンクさせ、誰でも再利用できるようにする取り組みです。セマンティック・ウェブという構想の実務的な具体化としてLODが位置づけられ、その先には知識グラフへの展開があるという流れも、あわせて整理しておきたいところです。知識グラフとは、人物・場所・出来事などの概念とその関係をネットワーク状につないだデータ構造のことです。
3. 関連概念との比較・相違点
従来のWeb(人間可読のWeb)との最大の違いは、情報の受け手がコンピュータか人間かという点にあります。従来のWebはHTMLで見た目を記述し、人間が読んで内容を解釈するのに対し、セマンティック・ウェブはメタデータで意味を明示し、コンピュータが解釈できる状態を目指します。検索エンジンがキーワードの一致だけで情報を拾う従来型の限界を超え、内容そのものの意味を扱えるようにする点が、この構想の出発点です。
LOD(Linked Open Data)との関係は、構想と実装形態という軸で整理できます。セマンティック・ウェブが目指す考え方を、RDFの形式で異なる組織のデータを相互にリンクさせて公開するという実務的な取り組みとして具体化したものがLODであり、両者は上位概念と実装事例の関係にあります。構想そのものの理解と、その具体的な取り組みであるLODの理解は、根拠となる知識が異なるため、混同しやすい組み合わせです。
オントロジーとメタデータは、セマンティック・ウェブを構成する要素として並べて語られることが多いものの、担う役割は異なります。オントロジーは概念どうしの関係を体系化した意味の枠組みであるのに対し、メタデータは個々の情報に付与される「情報についての情報」です。セマンティック・ウェブは、この二つを組み合わせて意味処理を実現する構想として位置づけられます。
4. ビジネス・実務での活用シナリオ
検索エンジンの分野では、人物・場所・組織などのエンティティ(データが指し示す個々の実体)を関連付けて検索結果に表示する仕組みの土台に、セマンティック・ウェブ的な意味付与の考え方が使われています。検索結果に人物のプロフィールや関連する事実がまとめて表示される背景には、こうした意味処理の技術があります。
EC・情報発信の分野では、Webサイトにschema.org(検索エンジンなどがWebページの内容を正しく読み取れるよう定めた、共通のメタデータの語彙集)で構造化データを埋め込む取り組みが進んでいます。これにより、外部サービスが商品情報やイベント情報を機械的に読み取れるようになります。商品の価格や在庫、開催日時といった情報を人手を介さずに外部サービスへ伝えられる点が、企業側の利点です。
図書館・学術情報の分野でも、セマンティック・ウェブの考え方が生かされています。図書館が蓄積してきたシソーラス(同じ意味・関連する言葉を体系的にまとめた辞書のようなもの)構築や目録情報の組織化のノウハウをRDFで表現し、異なる機関の情報を機械的に連携・統合する取り組みが進んでいます。
5. 要点まとめ
- セマンティック・ウェブは、Web上の情報に意味(メタデータ)を付与しコンピュータが自律的に処理できるようにする構想で、W3Cのティム・バーナーズ=リーが1998年頃から提唱し、2001年の論文で広く知られるようになりました。
- RDFでデータの関係を記述し、オントロジーで概念の関係を体系化するという役割分担のもと、OWL・SPARQLなどの技術が基盤を構成しています。
- 実務的な具体化としてLODが位置づけられ、その先に知識グラフへの展開があるという流れが、従来の人間可読なWebとの違いと合わせて押さえておきたいポイントです。
6. 確認問題
問1セマンティック・ウェブは、W3Cのティム・バーナーズ=リーによって提唱された構想であり、Web上の情報に意味(メタデータ)を付与することでコンピュータによる自律的な処理を目指す。
解答・解説をみる
○ 正しい
バーナーズ=リーは1998年頃から構想を語り、2001年の論文『The Semantic Web』でこの名称と考え方が広く知られるようになりました。人物名と発表年をあわせて覚えておくと、選択肢の細部まで判断しやすくなります。
問2セマンティック・ウェブは、Webページの見た目を人間にとって読みやすくレイアウトすることを主な目的とした技術である。
解答・解説をみる
× 誤り
見た目のレイアウトはHTMLの役割です。正しくは、セマンティック・ウェブの目的はWeb上の情報に意味を付与し、人間だけでなくコンピュータもその内容を解釈できるようにすることにあります。目的を取り違えた記述です。
問3セマンティック・ウェブを実現する技術には、データの関係を記述するRDFや、概念どうしの関係を体系化するオントロジーが含まれる。
解答・解説をみる
○ 正しい
RDFはデータ間の関係の記述、オントロジーは概念の意味的な関係の体系化という異なる役割を担い、両者はセマンティック・ウェブを支える構成技術として扱われます。

