AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

文本分类

共 3 条相关 AI 资讯
7月14日
12:16
12:16官方账号arXiv cs.LG@Esteban U. Vega Barajas
该研究基于一个此前提出的教学评价反馈分类协议,该协议使用2019年的冻结嵌入在西班牙语语料上取得良好效果。研究者在三个表示世代(稀疏词特征、冻结Transformer嵌入、提示大语言模型)上重新测试,并将情感分类任务迁移到英语(使用45,000条评论的平衡语料与方面标注数据集对比)。结果显示,2026年的前沿模型在西班牙语最难任务上取得最高主题F1分数,但情感任务上没有对廉价模型表现出优势;模型选择成为部署决策而非方法属性。
论文文本分类教学反馈跨语言迁移

推荐理由:这篇论文验证了旧的教学反馈分类协议是否还能用,发现即使用最新的LLM也不一定有优势,选什么模型看预算就行。
原文
7月9日
09:39
09:39官方账号arXiv cs.LG@Ana Schwengber Kelm, Christian Bockermann, Jörg Frochte
该论文将CVE到CWE映射视为文本分类任务,比较了多类(每CVE预测一个CWE)和多标签(允许多个CWE)两种公式。在三个编码器(BERT Base、SecureBERT、CySecBERT)和三个嵌套标签空间(83、47、25类)上评估,多类训练在所有设置中macro-F1更高,但差距从21个百分点缩小至2个百分点。后处理阈值优化在25类设置中弥补了差距。混淆分析显示,主要错误模式遵循CWE层次结构,且三个编码器间高度相关(Pearson r>0.92),表明错误结构主要由分类体系设计而非编码器选择驱动。层次放松评估将macro-F1从约81%提升至约90%,表明严格指标低估了分支级分类质量。CySecBERT在多数设置中取得最强结果。
论文CVECWEBERT

推荐理由:这篇论文用三种BERT模型对比了多类和多标签的漏洞分类效果,发现错误更多来自CWE层次结构而非模型选择,对安全领域做文本分类的人很有参考价值。
原文
5月15日
11:22
11:22官方账号arXiv cs.LG@E. O. Rodrigues, D. Casanova, M. Teixeira, V. Pegorini, F. Favarim, E. Clua, A. Conci, Panos Liatsis
精选
该论文将视觉计算领域的共现矩阵(COM)和游程长度矩阵(RLM)特征改编用于通用字符串(单词、短语、代码、文本)的相似度计算。这些特征纯统计且不依赖语言信息,适用于任何语言或语法结构。实验表明,在合成数据集上,COM和RLM特征优于最长公共子序列、编辑距离等传统统计方法;在3/4的案例中,其统计显著性显著高于基于距离的第二佳方法(P值<0.001)。在真实文本抄袭数据集上,RLM特征取得了最佳结果。
论文字符串相似度共现矩阵游程长度矩阵

推荐理由:做文本相似度、抄袭检测或代码比对的开发者,可以关注这种不依赖语言的新统计特征——它比传统方法更鲁棒,且直接可用。
原文
精选全部日报登录