
2009 年的最後一天,寫了一篇「語意化網站出版技術:OpenCalais 與 Drupal」。當年語意網(Semantic Web)是顯學:透過後設資料的描述,讓電腦理解非結構化資料裡隱含的結構化意義,資訊的搜尋與整合就會更有效。OpenCalais 可以自動幫文章標注人名、地名、組織,我們一群人相信,這是網路出版的未來。
後來的故事大家知道了:語意網沒有等到它的未來。RDFa、微格式這些標準太繁瑣,寫內容的人不想標、標了也沒有立即好處,先有雞先有蛋的僵局一直沒解開。
十六年後,「讓機器讀懂內容」這件事實現了,但路線完全不是當年想的那條。LLM 不需要你乖乖標注語意,它直接把整篇文章讀進去。當年要靠一整套本體論才能回答的問題,現在丟給模型就好。
有趣的是,兜了一圈,語意網的老工具竟然又回來了,換了一副面孔: