Jelölőnyelvek és szövegmodellezés

A jelölőnyelvek jellegzetességei és a jelölések típusai

Ahogy az előző részben is említettük, a jelölőnyelveket arra használják, hogy metaadatokat adjanak hozzá a meglévő adatokhoz. Adat bármi lehet, akár egy számítógépes program beállításai, egy telefonkönyv vagy egy könyvtári katalógus bejegyzései, de prózai szövegek, vagy versek is számíthatnak adatnak. A jelölőnyelvek lehetőséget adnak ezen adatok leírására. A programozási nyelvektől azonban el kell különítenünk a jelölőnyelveket. A jelölés ugyanis önmagában nem képes feldolgozásra, vagy a szöveg stílusbeli igazítására. Ehhez vagy egy programozási nyelvre vagy script nyelvre van szükség, amilyen például az XSLT vagy a CSS.

A HTML esetében például HTML címkéket használnak a szöveg strukturálására (bekezdések, címek, lábjegyzetek stb.), médiumok (képek, hang és videó fájlok), és olyan elemek beépítésére, amelyek lehetővé teszik a szöveg beágyazódását egy HTML oldalba. A böngészők értelmezni tudják ezeket a HTML elemeket és úgy dolgozzák fel a szöveget, hogy az ne csak megjelenjen a monitoron, hanem hiperhivatkozásokkal kapcsolódjon más oldalakhoz, vagy a szövegben lévő képek a megfelelő helyen és méretben jelenjenek meg stb.

A HTML és a LaTeX ábrázolási vagy eljárási jelölőnyelvek. Ezekkel elsősorban azt jelölik, hogy a szövegek és az adatok szoftveres feldolgozásuk során hogyan jelenjenek meg. A HTML fejlesztők például elsősorban arra koncentrálnak, hogy valami hogyan néz ki egy webböngészőben. Ugyanakkor az elmúlt években a HTML5 fejlesztésével, a HTML sokkal inkább a leíró vagy szemantikai jelöléshez vált hasonlóvá. Ez a jelölőnyelv leírja a kódolt adatot, legyen az például egy cím, pizza menü, vagy egy vers. Az ilyen fajta jelölés előnye, hogy olyan szoftverek is képesek kezelni, mint a keresőmotorok. A leírónyelv tipikus példája a TEI (Text Encoding Initiative). Jelölései általában nem láthatók a szöveg olvasója számára, inkább a szöveg feldolgozására szolgáló szoftvereket látja el utasításokkal.