classification

标签

Cards List
#classification

HNR-DAC:面向科学声明验证的难负样本重排序与分布对齐分类

arXiv cs.CL · 6小时前 缓存

本文提出了HNR-DAC,一种用于引用论文科学声明验证的两阶段框架,结合了难负样本重排序与分布对齐分类。该方法在NLPCC 2026 Task 10 Track 2上表现优异,以最高的Macro-F1位列排行榜第三名。

0 人收藏 0 人点赞
#classification

Recent advances in weakly supervised learning: New supervision paradigms, assumption relaxations, and practical solutions

arXiv cs.LG · 6小时前 缓存

This chapter reviews recent advances in weakly supervised learning, introducing confidence-difference classification, relaxed assumptions for complementary-label learning, and an evaluation framework for partial-label learning.

0 人收藏 0 人点赞
#classification

通过Nyström方法弥合超维计算与核方法之间的差距

arXiv cs.LG · 6小时前 缓存

本文介绍了NysHD,一种通过Nyström近似将超维计算与核方法桥接起来的方法,允许任何正半定相似性函数用作HDC编码。与现有HDC编码方法相比,它在图数据集和字符串数据集上展示了更高的分类准确率。

0 人收藏 0 人点赞
#classification

自动化条目评估:利用LLM生成的评语预测条目的接受与拒绝

arXiv cs.AI · 6小时前 缓存

本文介绍了一种自动化条目评估(AIE)模型,该模型利用微调的DeBERTa分类器,基于原始条目文本和Qwen3生成的评语来预测标准化测试中条目的接受/拒绝状态,取得了中等准确率,并凸显了公平性相关拒绝所带来的挑战。

0 人收藏 0 人点赞
#classification

Task-Conditional Flow Matching for Balanced Multilingual Text Embedding Adaptation

arXiv cs.CL · 3天前 缓存

This paper introduces Task-Conditional Flow Matching (TCFM), a framework for adapting multilingual text embedding models that selectively uses flow matching for translation tasks and other objectives for retrieval/classification. It achieves state-of-the-art results on the Indic Massive Text Embedding Benchmark.

0 人收藏 0 人点赞
#classification

MS-MLB:基于血液的MS分类的开放机器学习基准

arXiv cs.LG · 3天前 缓存

本文介绍了MS-MLB,这是一个开放机器学习基准,利用公开的GSE17048队列,从全血RNA表达数据中对多发性硬化症进行分类。它提供了一个可重复、受泄漏控制的评估流程,并报告梯度提升(Gradient Boosting)为表现最佳的方法。

0 人收藏 0 人点赞
#classification

TS2TabPFN:通过特征提取和表格基础模型进行时间序列分类与外部回归

arXiv cs.LG · 4天前 缓存

本文介绍了TS2TabPFN,这是一个将显式特征提取与TabPFN 2.5表格基础模型相结合用于时间序列分类和外部回归的框架。实验表明,它在TSER任务上优于最先进的模型,并在TSC任务上取得了具有竞争力的结果。

0 人收藏 0 人点赞
#classification

PatTree:一种用于医学分类任务的自动化构建多模态、基于图的患者表示的新方法

arXiv cs.LG · 5天前 缓存

本文介绍了PatTree,一种基于图的多模态患者表示方法,能够自动对异构临床数据进行结构化处理,以用于医学分类任务。在ADNI-1队列上,它达到了最先进的性能,阿尔茨海默病分类的平衡准确率为98.5%。

0 人收藏 0 人点赞
#classification

构建用于检测俄语社交媒体文本中自杀前兆和反自杀信号的大规模数据集的方法学

arXiv cs.CL · 6天前 缓存

本文提出了一种从社交媒体文本构建大规模俄语数据集的方法,用于检测自杀前兆和反自杀信号,包括标注指南和基线分类实验。

0 人收藏 0 人点赞
#classification

构建 n8n AI 支持工作流是容易的部分。以下是我为生产环境测试时学到的经验。

Reddit r/AI_Agents · 6天前

一位开发者分享了构建生产级 n8n AI 支持工作流的经验,强调分类优于生成、基于规则的过滤器以降低成本,以及将响应基于知识库以避免幻觉答案。

0 人收藏 0 人点赞
#classification

LLM词元生成的动力系统可区分性保证

arXiv cs.LG · 2026-08-03 缓存

本文通过将词元嵌入建模为动力系统的轨迹,为区分LLM响应提供了理论保证,证明了误分类概率的指数衰减,并刻画了跨嵌入泛化。

0 人收藏 0 人点赞
#classification

GRU、LSTM和Transformer编码器在自动驾驶系统分类中的敏感性分析

arXiv cs.LG · 2026-08-03 缓存

本文评估了GRU、LSTM和Transformer编码器模型在基于车辆远程信息处理数据对2级自动驾驶系统进行分类时的性能,并引入了一个模拟真实数据损坏的鲁棒性评估框架。

0 人收藏 0 人点赞
#classification

4B模型分类任务上60%-82%的准确率波动:唯一变量是评估框架设计

Reddit r/LocalLLaMA · 2026-07-31

一项针对4B模型分类任务的预注册消融实验表明,评估框架设计(规则位置、证据顺序、轮次结构)使准确率在60%到82%之间波动,说明糟糕的评估框架设计常常被误认为是模型能力不足。

0 人收藏 0 人点赞
#classification

“那不是我说的用AI的意思”——使用AI开发软件的不同方法分类

Reddit r/ArtificialInteligence · 2026-07-30 缓存

一篇文章对使用AI进行软件开发的不同方法进行分类,从传统开发到vibe coding,旨在通过提供共同词汇来澄清争论。

0 人收藏 0 人点赞
#classification

Pangram 4 技术报告

arXiv cs.CL · 2026-07-30 缓存

Pangram Labs 推出 Pangram 4,这是一款最先进的 AI 文本检测模型,AUROC 达到 0.9916,误报率和漏报率极低,并且提高了对对抗性攻击的鲁棒性以及混合作者身份的检测能力。

0 人收藏 0 人点赞
#classification

跨被试运动想象脑电图分类中的贝叶斯完全池化方法

arXiv cs.LG · 2026-07-28 缓存

本文介绍了一项大规模研究,将贝叶斯完全池化模型与频率学派基线方法在跨被试运动想象脑电图分类中进行比较,发现贝叶斯方法在可靠性上略有提升,但计算成本更高,实际收益有限。

0 人收藏 0 人点赞
#classification

AsymVerify在SemEval-2026任务6中的应用:面向政治规避检测的非对称置信门控验证

arXiv cs.CL · 2026-07-24 缓存

AsymVerify是一种面向政治规避检测的置信门控验证系统,在SemEval-2026任务6中取得第二名,宏F1为0.85。它采用非对称双验证器设计来纠正低置信度预测,相比单次分类有所改进。

0 人收藏 0 人点赞
#classification

使用微调LLM识别英国警方事件日志中的脆弱性指标

arXiv cs.CL · 2026-07-22 缓存

本文探讨了使用微调LLM识别英国警方事件日志中的脆弱性指标(精神健康问题、物质滥用、酒精依赖、无家可归),发现虽然LLM能够产生有意义的患病率估计,但需要谨慎的方法学支持,并且不适用于个人层面的决策。

0 人收藏 0 人点赞
#classification

超越输出空间校准:时间序列分类中选择性可靠性估计的频谱证据捆绑

arXiv cs.LG · 2026-07-22 缓存

本文介绍SEB-Cal,一种通过频谱特征(频带能量、熵、峰值主导性、相位稳定性)增强输出空间校准的方法,以改善时间序列分类中的选择性可靠性估计,在多个数据集上实现更高的Corr-AUROC和更低的[email protected]

0 人收藏 0 人点赞
#classification

用于软毛绒伴侣情感触觉分类的轻量级1D CNN设计与验证

arXiv cs.AI · 2026-07-21 缓存

本文提出了一种用于软毛绒伴侣情感触觉分类的轻量级1D CNN框架,采用13.2k参数模型实现了75%的测试准确率,并提出了一种混合启发式-CNN推理流程用于嵌入式部署。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈