Keyboard shortcuts

Press or to navigate between chapters

Press S or / to search in the book

Press ? to show this help

Press Esc to hide this help

判定標準

總覽

本政策提供分類標準,用來判定個別對話內容是否屬於 Toxic。

詞彙定義

  • 對話:兩人以上的書面交流,訊息持續流動,每則內容會回應或延續先前訊息。
  • 參與者:在書面對話中撰寫訊息、閱讀回覆並積極參與的人。可能以「你」、姓名或第二人稱指稱。
  • 作者:建立特定內容項目的參與者。

語言解讀

  • 同時考量直接陳述與透過脈絡明確傳達的意思。
  • 負面語言如具有建設性功能,不會自動構成有毒內容。
  • 內容必須屬於進行中的對話,且針對、提及或指向參與者,才能分類為有毒。討論非參與者,例如一般群體、政治人物或第三方時,除非透過「你」、姓名直接稱呼,依脈絡隱含稱呼,或回應參與者的說法或立場,否則不符合有毒分類。

Label 定義

(TX)有毒對話內容

包含

  • 好鬥或攻擊性對話內容:以比喻暴力詞彙攻擊參與者的論點或觀點,例如「我要徹底撕碎你的推理」「你的立場毫無價值」。不包含使用暴力詞彙實際描述事件或提供操作脈絡,例如「那棟建築上週被拆除」「選手把他摔到地上」「射鹿的頭會破壞標本,應瞄準胸部」。
  • 貶低或嘲弄對話內容:模仿或諷刺參與者的說法或行為,以削弱其地位,包括以下類型。
    • 諷刺性淡化:以諷刺方式淡化參與者立場或嚴肅主題,例如「她真貼心,不是嗎?」「蠢得讓人受不了!」
    • 行為嘲弄:把行為、動機或優先事項描述為不值得重視或可悲,例如「真的很可悲」「可笑」,或把堅定支持、動機與決策形容為悲哀或可悲。
    • 誇張模仿:以嘲弄質疑專業或智力,例如「喔,所謂的專家來了」「太厲害了,這個天才想法是你自己想出來的嗎?」
  • 不尊重或輕蔑的對話內容:拒絕承認合理論點,或未考量就否定輸入,包括以下類型。
    • 輕蔑否定:明顯鄙視其他觀點,例如「好吧,反正那不重要」「我不能把時間浪費在這種垃圾上」。
    • 輕蔑提問:輕蔑的反問與鄙視表達,例如「抱歉,什麼?真好命」「你到底在不爽什麼?」;否定成就、資源、成果或資源使用方式的問題;或以身分為基礎,否定忠誠、關係、選擇或歸屬的問題。
    • 立場描述:以挑釁問題輕蔑描述立場或關係。
  • 對話中的侮辱或人身攻擊:直接攻擊人格、誠信、動機或心智能力,包括以下類型。
    • 直接人格攻擊:攻擊個人特質,例如「你的智力不足以理解」「難怪沒有人尊重你」;使用去人化詞彙、貶低價值、指控不誠實或進行負面評判。
    • 心智能力攻擊:針對參與者或其推理的智力或認知能力,例如「蠢是治不好的」「蠢到無可救藥」「白痴」。描述立場、論點、推理或決策時也適用。
    • 指控式問題:透過直接指控質疑人格,例如「也許你才是霸凌者」。
    • 價值指控:指控他人認同不道德的價值或行為。
    • 誠信攻擊:指控詐騙、不誠實或欺騙,包括數位不當行為,如「劫持個人檔案」。
    • 動機攻擊:指控他人把個人利益放在道德考量之前。
    • 排除:透過評價行為間接挑戰人格、誠信、動機或心智能力,例如「那對你不會有好結果,但還是祝你好運」。
  • 居高臨下或屈尊的對話內容:假定自己較優越,以過度簡化且屈尊的語言說明,例如「讓我用你能懂的簡單概念分解」「真可愛,你有在努力」,或告訴參與者「顯然不懂」某個主題。
  • 被動攻擊性對話內容:以表面禮貌隱藏敵意,包括以下類型。
    • 不真誠的稱讚:帶有批評的做作稱讚,例如「真意外,你這次竟然準時」「以你的限制來說,算是不錯的嘗試」。
    • 含蓄刺語:具有合理否認空間的細微敵意暗示。
  • 威脅性對話內容:以恐嚇方式暗示或宣告暴力威脅,包括以下類型。
    • 直接威脅:暗示或宣告暴力威脅。
    • 委婉威脅:以委婉方式提及死亡或暴力,例如「和死神約會」。
    • 條件式警告:警告可能發生暴力後果,即使包裝成建議,例如「這樣很容易讓自己的頭被打爆」。
    • 隱晦恐嚇:控制行為的隱晦警告,例如「那個觀點會回頭糾纏你」「如果我是你,就不會說這種話」。
  • 認同、慶祝或希望對話中發生暴力:認可或稱讚已發生的暴力,或希望參與者遭遇暴力,包括認同過去暴力,例如「還好他打了你,你活該」,或希望未來發生暴力,例如「我很想看有人把你痛打一頓」。

不包含

  • 正當批評:以精確、建設性且能促成改進的方式,表達不同意或負面評估,例如「感謝投入,但這項計畫有多個問題。首先,以目前情況來看,時程似乎過度樂觀……」。
  • 事實更正:處理錯誤資訊,即使用語直接或強調,只要沒有進行人身攻擊,例如「那個說法是錯的,以下是經過驗證來源的實際資料」。
  • 幽默與諷刺:針對參與者使用幽默或諷刺進行評論或娛樂,但未形成破壞關係或造成有毒氣氛的敵意模式,包括共同情況的輕鬆笑話或善意嘲弄。
  • 學術討論:在學術或調查框架內檢視或討論有毒行為,例如「這項研究探討數位論壇中的敵意交流通常如何發展」。
  • 建設性辯論:以邏輯論證質疑想法或立場,未進行人身攻擊或煽動,例如「我認為這項推理有三個重大缺陷。首先,基本前提缺少現代證據支持……」。
  • 回應有毒內容:回應、批評或反駁他人明示或暗示的有毒內容,同時避免敵對或煽動語氣。回應不當內容時使用「噁心」或「令人震驚」等詞也包含在內。
  • 引用有毒內容:重現他人有毒內容,以進行分析、釐清或客觀呈現。
  • 對話中的第三方討論:討論非參與者,不論是否包含負面描述或貶抑語言。即使對非參與者使用貶抑語言也適用,包括以下脈絡。
    • 政治脈絡:政治人物、領袖、官員、選民、支持者、意識形態群體。
    • 犯罪與法律脈絡:犯罪者、加害者、被告、入侵住宅者及其他法律程序中的人,包括第三方家屬。
    • 媒體與組織:新聞組織、媒體、企業與公司及其報導。
    • 一般群體與類別:抗議者、政治立場、專業群體、交通工具駕駛、道路使用者、意識形態群體、信仰類別,以及未以參與者身分出現的其他集合類別。
  • 對話中的一般評論:對人、群體或情況提出一般觀察,且未以參與者為對象,即使使用強烈或批評性語言也相同,包括對專業類別或群體可能行動或特徵的觀察。

此政策把「是否為對話參與者」設為重要門檻,可能排除對第三方群體的嚴重攻擊。正式採用前應確認這項範圍是否符合平台的騷擾與仇恨政策。