Metodológia
Obsah sa anotuje na úrovni položky (článok, príspevok, video) v siedmich nezávislých vrstvách — faceted anotácia namiesto jedného plochého štítku. Overiteľné (pravdivosť) je oddelené od odvodeného (zámer). Každá hodnota taxonómie má citovateľný akademický zdroj; táto stránka je generovaná priamo z kanonickej JSON schémy (v0.2) a codebooku (v0.3), takže sa nemôže odchýliť od výskumného kánonu.
L0 — Provenance a metadáta
Dopĺňa zberová pipeline, nie anotátor.
| pole | typ | hodnoty |
|---|---|---|
| item_id | text | voľný text / štruktúra |
| url | text | voľný text / štruktúra |
| archive_url | text | voľný text / štruktúra |
| platform | výber (1) |
|
| media_type | výber (1) |
|
| source_id pseudonymizovaný (hash) pre bežných používateľov | text | voľný text / štruktúra |
| published_at | text | voľný text / štruktúra |
| collected_at | text | voľný text / štruktúra |
| language_variety | výber (1) |
|
| reach_snapshot | objekt | voľný text / štruktúra |
L1 — Pravdivosť / typ informačnej poruchy
Wardle & Derakhshan (2017): Information Disorder. Council of Europe.
| pole | typ | hodnoty |
|---|---|---|
| disorder_type disinformation vyžaduje nepravdivosť (L1) AJ indikátor zámeru/škodlivosti (L5/L6). Bez toho misinformation. | výber (1) |
|
| veracity Ak sa tvrdenie nedá overiť len z textu, použiť 'unverifiable' a nízku istotu. Nevyvodzovať nepravdivosť z nesúhlasu. | výber (1) |
|
| content_type Wardle 7 typov + not_applicable (ADR-028: náprotivok k disorder_type=not_applicable). | výber (1) |
|
| check_worthy Obsahuje overiteľné faktické tvrdenie? (filtruje čistý názor) | áno/nie | voľný text / štruktúra |
L2 — Naratív a rámec
EUvsDisinfo (EEAS) — 6 makro-naratívov · Card et al. (2015): Media Frames Corpus — 14 rámcov.
| pole | typ | hodnoty |
|---|---|---|
| meta_narrative EUvsDisinfo 6 makro-šablón. Prázdne pole, ak žiadna nesedí. | multi-label |
|
| frame Card et al. 2015 — 14 rámcov MFC. | multi-label |
|
| primary_topic SK-lokalizovaný seed + emergentné (other). | multi-label |
|
| sub_narrative | text | voľný text / štruktúra |
| narrative_summary 1 veta vlastnými slovami. | text | voľný text / štruktúra |
| euvsdisinfo_xwalk | text | voľný text / štruktúra |
L3 — Manipulačné techniky
SemEval-2023 Task 3 (Piskorski et al., 2023) — 23 persuáznych techník · Da San Martino et al. (2019).
| pole | typ | hodnoty |
|---|---|---|
| techniques Prázdne pole, ak žiadna technika nie je prítomná. | multi-label |
|
L4 — Aktér a správanie
DISARM Framework (T-kódy).
| pole | typ | hodnoty |
|---|---|---|
| source_type ADR-028: doplnené mainstream_media (legitímne/mainstreamové médium) a commentator_influencer (jednotlivý komentátor/influencer bez politickej väzby). Zamietnuté: alternative_media (hodnotiaca, nie štrukturálna kategória). | výber (1) |
|
| origin | výber (1) |
|
| coordination_signals | výber (1) |
|
| disarm_ttp DISARM T-kódy (správanie aktéra/prostredia). Len ak je správanie indikované. | zoznam | voľný text / štruktúra |
| linked_entities Pseudonymizované pre bežných používateľov. | zoznam | voľný text / štruktúra |
L5 — Cieľ a účinok
Nimmo (2015): 4D — dismiss, distort, distract, dismay · DISARM.
| pole | typ | hodnoty |
|---|---|---|
| target_entity | výber (1) |
|
| intended_effect Nimmo 4D = DISARM T0075–T0078, + not_applicable (ADR-028). NIKDY null: null neodlíši 'nemá zmysel' od 'model nevedel'. | výber (1) |
|
| communicative_function | multi-label |
|
L6 — Zámer (odvodené)
Odvodená vrstva — zámer; anotuje sa s nízkou istotou, nikdy nie jediný podklad klasifikácie.
| pole | typ | hodnoty |
|---|---|---|
| assessed_intent_to_harm | výber (1) |
|
| intent_confidence | výber (1) |
|
| intent_rationale | text | voľný text / štruktúra |
L7 — Proces anotácie
Istota, adjudikácia, audit stopa.
| pole | typ | hodnoty |
|---|---|---|
| annotator_id napr. 'A1', 'A2' alebo 'model:claude-...' | text | voľný text / štruktúra |
| annotated_at | text | voľný text / štruktúra |
| field_confidence Mapa pole -> istota pre kľúčové polia (min. L1.veracity, L3, L5, L6). | objekt | voľný text / štruktúra |
| notes | text | voľný text / štruktúra |
| adjudication_status | výber (1) |
|
| gold_label | áno/nie | voľný text / štruktúra |
Meranie spoľahlivosti
Zlatý korpus vzniká nezávislou anotáciou (kódovači navzájom nevidia svoje odpovede; po odoslaní je anotácia nemenná). Spoľahlivosť sa meria Krippendorffovým α per vrstva a per label; medzianotátorská zhoda tvorí empirický strop, voči ktorému sa hodnotí AI klasifikátor — nie ľubovoľné fixné percento.