Inwentarz konkretnych technik perswazji wykrywanych na poziomie fragmentu tekstu. Trzy kanoniczne taksonomie (Da San Martino 2019, SemEval-2020, SemEval-2023 z polskim w korpusie). Stąd bierze się cecha „brak manipulacji”.
Pole zorganizowane jest wokół inwentarza konkretnych technik, nie abstrakcyjnych skal. Trzy wersje, każda będąca rozszerzeniem poprzedniej:
Rubryk decyzyjny: Argument nie dotyczy tematu, lecz uderza w uczestnika (osobowość, doświadczenie, czyny), by podważyć wiarygodność.
Rubryk decyzyjny: Argument = twierdzenie + wyjaśnienie/apel, gdzie to drugie ma uzasadnić pierwsze.
Rubryk decyzyjny: Argument nadmiernie upraszcza problem - przyczynę, skutek lub istnienie wyborów.
Rubryk decyzyjny: Odsuwa uwagę od głównego tematu.
Rubryk decyzyjny: To nie argument, lecz zachęta do działania lub myślenia w określony sposób.
Rubryk decyzyjny: To nie argument, lecz sam dobór słów: nie-neutralnych, mylących, przesadzonych, nacechowanych.
SemEval-2023 wprowadza framing jako osobny wymiar: 14 generycznych ram tematycznych z Card et al. (2015) - Economic, Morality, Fairness and equality, Legality/constitutionality, Security and defense, Quality of life, Cultural identity, Political itd. Framing ≠ technika manipulacji; to wybór, który aspekt problemu uwypuklić - przydatne do profilu posła, nie do oceny uczciwości pojedynczego zdania.
Jednostka analizy: Da San Martino 2019 / SemEval-2020 - minimalny span na poziomie znaków (spany mogą się nakładać, np. doubt niesiony przez loaded language); SemEval-2023 - akapit, zadanie multi-label (świadome złagodzenie, bo span-level był zbyt subiektywny). Format: nie ma skali Likerta - kodowanie kategorialne (technika obecna albo nie), „jakość” mierzy się liczbą i typem wykrytych technik. Rzetelność: Da San Martino użyli miary γ (Mathet et al. 2015); wstępnie γ_spans = 0,34, γ_spans+labels = 0,31 (niskie), dopiero proces dwuetapowy z konsolidatorem podniósł to do 0,74–0,76. Niezgody wynikają głównie z przeoczeń, nie z różnic etykiet. W korpusie dominują loaded language (2 547) i name calling (1 294); reszta rzadka (długi ogon).
Inwentarz jest gatunkowo bliski wystąpieniom parlamentarnym (ad personam, flag-waving, fałszywe dylematy, slogany, whataboutism). Rekomendacja: oceniać na poziomie wypowiedzi/akapitu, multi-label (jak SemEval-2023), używając 6 kategorii gruboziarnistych jako pierwszego poziomu (są stabilniejsze niż 23 techniki), z polskimi definicjami i few-shot oraz obowiązkowym cytatem-dowodem dla każdej techniki. Najbezpieczniej automatyzować: Loaded Language, Name Calling, Flag-Waving, Appeal to Fear („substantial agreement”). Trudne: Red Herring, Straw man, Oversimplification, Obfuscation. Pułapki: przeszacowanie (LLM systematycznie nad-wykrywają, zwł. loaded language/name-calling/doubt); cytat vs. własna teza (poseł cytujący przeciwnika nie stosuje techniki); ironia/sarkazm podbijają exaggeration i name-calling; bias polityczny anotacji (konieczna symetryczna walidacja po obu stronach sceny). Kluczowe: technika ≠ nieuczciwość - to fakt językowy ze źródłem-cytatem, etykietowany jako „technika perswazyjna”, nigdy jako „kłamstwo” czy „red flag”.