跳到正文
原文
arXiv 自然语言处理· Himarsha R. Jayanetti, Sivakanesan Dhanushkanda, Shuai Hao, Michael L. Nelson, Michele C. Weigle·· 6 小时前AI 评分29

人类、专用工具与 LLM 在社交媒体情感分析上难以达成共识

Nobody Truly Agrees on Sentiment: Humans, Bespoke Tools, and LLMs Struggle with Social Media Texts

AI 导读

一项研究评估了 6 位人类标注者、3 款专用工具(TextBlob、VADER、Twitter-roBERTa-base)及 3 款大语言模型(Qwen3-32B、GPT-OSS-120B、Llama-4-Maverick-17B)在 100 条推文上的情感标注一致性。

来源:arXiv 自然语言处理 · arxiv.org