neural-architectures

标签

Cards List
#neural-architectures

认为通过 CoT 追踪就能实现安全是妄想。安全存在于控制机制中,而非思维链。

Reddit r/LocalLLaMA · 2026-09-11

本文主张,依赖思维链追踪来确保 AI 安全是无效的,因为这些追踪可被操纵且无法真实反映模型行为,因此应聚焦于控制机制。

0 人收藏 0 人点赞
#neural-architectures

深度时间序列模型中的记忆

arXiv cs.LG · 2026-09-10 缓存

本文提出了深度时间序列模型中记忆机制的统一分类体系,将方法从内部记忆到外部记忆进行分类,并识别研究空白以解决时间依赖挑战。

0 人收藏 0 人点赞
#neural-architectures

Transformer与状态空间架构中集体动力学的红外普适性

arXiv cs.LG · 2026-08-20 缓存

本文研究Transformer与Mamba架构在其红外光谱中是否表现出类似的集体动力学,发现尽管微观机制不同,两者都发展出近临界慢模动力学。

0 人收藏 0 人点赞
#neural-architectures

神经进化竞技场:跨神经架构的更新与继承机制嵌套生态评估

arXiv cs.AI · 2026-08-12 缓存

这篇预印本介绍了Neuroevolution Arena,一个GPU加速的人工生命平台,通过嵌套生态评估协议,比较跨神经架构的进化与基于强化学习的更新机制。

0 人收藏 0 人点赞
#neural-architectures

关于逻辑门网络的深度可扩展性

arXiv cs.LG · 2026-07-27 缓存

本文指出了逻辑门网络无法从深度增加中受益的两个原因,并提出了输入锚定逻辑门网络(IALGNs),该方法使每一层都基于原始输入进行条件化,实现了超过100层的持续深度精度提升。

0 人收藏 0 人点赞
#neural-architectures

架构影响隐式神经表征中的迁移特异性

arXiv cs.LG · 2026-06-08 缓存

本文研究了SIREN、ReLU MLP和傅里叶特征MLP中隐式神经表征的迁移特异性,发现迁移幅度和特异性依赖于架构,其中ReLU更具选择性,而SIREN广泛重用权重。结果表明,架构选择应考虑显式的控制条件,而不仅仅是迁移幅度。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈