deep-neural-networks

标签

Cards List
#deep-neural-networks

CoG引导的权重纠正用于容错深度神经网络

arXiv cs.LG · 2026-07-20 缓存

提出了一种重心引导的权重纠正方法,用于容错深度神经网络,在LSTM和CNN模型上实现了显著的容错性能提升,且无需重新训练。

0 人收藏 0 人点赞
#deep-neural-networks

流形约束的表格深度神经网络

arXiv cs.LG · 2026-07-14 缓存

提出HDE-Net,一种流形约束的深度神经网络,利用双曲空间更好地建模表格数据中的规则型结构,在TALENT-tiny-core基准上取得最先进性能,同时保持高效。

0 人收藏 0 人点赞
#deep-neural-networks

AdaStop:面向DNN测试选择的成本感知提前停止策略

arXiv cs.LG · 2026-07-08 缓存

AdaStop是一个用于DNN测试选择的成本感知提前停止框架,当边际故障发现率低于阈值时,它最优地停止标注,仅使用9%-31%的标注预算就能实现65%-84%的故障发现。

0 人收藏 0 人点赞
#deep-neural-networks

基于可控性-可观测性测试的深度神经网络经验最小实现压缩

arXiv cs.LG · 2026-07-08 缓存

本文提出了一种基于可控性-可观测性的框架,通过减少隐藏状态冗余来压缩深度神经网络,在MNIST和CIFAR-10数据集上实现了显著压缩,且精度损失极小。

0 人收藏 0 人点赞
#deep-neural-networks

鲁棒性遇上不确定性:面向鲁棒选择性分类的证据对抗训练

arXiv cs.LG · 2026-07-07 缓存

本文介绍了一种名为证据对抗训练(EV-AT)的方法,通过结合基于证据的损失与鲁棒证据对齐,改善了分类器的鲁棒性-不确定性权衡,在选择性分类基准上取得了最先进的结果。

0 人收藏 0 人点赞
#deep-neural-networks

@DanKornas: "斯坦福CS229 I 机器学习 I 构建大型语言模型(LLMs)"(斯坦福在线)... 你将学到:…

X AI KOLs Timeline · 2026-06-23 缓存

斯坦福CS229在线课程公告,涵盖构建大型语言模型、深度神经网络、TensorFlow、Keras、OpenCV以及使用spaCy的自然语言处理。

0 人收藏 0 人点赞
#deep-neural-networks

使用XAI分析欧洲电力市场的驱动因素与相互依存关系

arXiv cs.AI · 2026-06-18 缓存

本文应用可解释人工智能技术(SHAP、SSHAP)于深度神经网络模型,分析39个欧洲竞价区域的电价驱动因素,发现尽管太阳能发电份额较低,但太阳能与天然气价格仍是关键驱动因素。

0 人收藏 0 人点赞
#deep-neural-networks

噪声驱动的亚稳态逃逸解释了深度神经网络中的Grokking现象

arXiv cs.LG · 2026-06-17 缓存

该论文提出,深度神经网络中的grokking现象源于一阶L2相变中噪声驱动的亚稳态逃逸,证明了延迟泛化遵循Arrhenius标度,并再现了典型的grokking曲线。

0 人收藏 0 人点赞
#deep-neural-networks

基于多臂赌博机的深度神经网络结构化神经元剪枝

arXiv cs.LG · 2026-06-09 缓存

本文提出了一种新颖的基于多臂赌博机算法的深度神经网络结构化神经元剪枝框架,并在多种任务上验证了其有效性。

0 人收藏 0 人点赞
#deep-neural-networks

通过平滑激活缓解深度神经网络一致收敛中的维数灾难

arXiv cs.LG · 2026-06-05 缓存

本文建立了一个理论框架,表明深度神经网络中的平滑激活可以缓解一致收敛中的维数灾难,提供非渐近保证,并在最坏情况可靠性上优于ReLU网络。

0 人收藏 0 人点赞
#deep-neural-networks

通过马尔钦科-帕斯图尔分布剪枝深度神经网络

arXiv cs.LG · 2026-06-03 缓存

本文提出了一种基于马尔钦科-帕斯图尔随机矩阵的深度神经网络剪枝方法,提供了理论保证,并在 ImageNet 上对 ViT 和 CNN 架构实现了高精度保持,仅需极少的微调。

0 人收藏 0 人点赞
#deep-neural-networks

通过Fisher信息度量模型鲁棒性:谱边界、理论保证与实用算法

Hugging Face Daily Papers · 2026-06-03 缓存

本文提出了一种基于Fisher信息矩阵谱范数的攻击无关鲁棒性度量,为深度神经网络提供了理论边界和可扩展的评估方法。

0 人收藏 0 人点赞
#deep-neural-networks

证据深度学习的变分推断

arXiv cs.LG · 2026-05-27 缓存

提出了一种数学上严格的框架——变分推断的深度证据学习(VI-EDL),通过变分推断重新表述传统深度证据学习,推导出证据下界,建立泛化界,并在视觉和医学数据集上实现了最先进的性能,以解决传统深度证据学习的局限性。

0 人收藏 0 人点赞
#deep-neural-networks

CAFD: 使用VLMs的概念感知DNN故障检测

arXiv cs.LG · 2026-05-26 缓存

本文介绍了CAFD,一种基于学习的DNN故障检测方法,它整合了基于模型、基于距离以及一种新颖的基于概念的特征——概念失败率(CFR),该特征源自视觉语言模型。CAFD在多个数据集和预算下的故障检测率方面持续优于最先进的基线方法。

0 人收藏 0 人点赞
#deep-neural-networks

SoK:神经正切泛化攻击现状的全面分析与研究方向

arXiv cs.LG · 2026-05-14 缓存

本文对用于数据保护的神经正切泛化攻击(NTGA)进行了全面分析,包括相关攻击的分类,并讨论了未来的研究方向。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈