stability

标签

Cards List
#stability

关于次优势(极小极大)超度量的 Hamming-Lipschitz 型稳定性:理论与简单证明

arXiv cs.AI · 6天前 缓存

本文为次优势(极小极大)超度量发展了一套 ℓ0 型稳定性理论,证明了稀疏编辑仅通过最小生成树传播,并导出了变更超度量条目的 Hamming-Lipschitz 界。在深度嵌入图和聚类任务上的实验表明,所得结构评分作为脆弱性诊断具有实用价值。

0 人收藏 0 人点赞
#stability

通过归因可分离性衡量解释器稳定性

arXiv cs.LG · 2026-08-05 缓存

本文引入了一个基于分布的框架,通过量化特征排名的可分离性并识别在随机运行中保持可靠的最大top-k排名,来衡量归因方法(解释器)的稳定性。

0 人收藏 0 人点赞
#stability

雪豹的神话

Hacker News Top · 2026-08-02 缓存

一篇反思性博客文章,驳斥了 Mac OS X Snow Leopard 是完美稳定且精良版本的神话,引用了作者自己的降级经历和其他批评,同时指出为什么“雪豹”版本的理念至今仍能引起共鸣。

0 人收藏 0 人点赞
#stability

CACHE-UK: A Stability-Aware Memory Editor for Sequentially Updated Quantized LLMs in Finance

arXiv cs.CL · 2026-07-31 缓存

Introduces CACHE-UK, a stability-aware memory editing framework for sequentially updating quantized LLMs in finance, reducing knowledge degradation on 4-bit OpenLLaMA-3B while improving generalization rates on a UK financial corpus.

0 人收藏 0 人点赞
#stability

不透明的认知中介:LLM部署配置如何影响伪科学的验证

arXiv cs.CL · 2026-07-27 缓存

本文测试了不同LLM系列在不同时间和界面上如何评估族裔民族主义伪科学,发现认知立场取决于部署配置而非稳定的模型属性,引发了关于认知问责性的关切。

0 人收藏 0 人点赞
#stability

Vellium v1.0.0 发布:安全增强、壁纸主题、JSON 聊天导出及桌面稳定性大幅提升

Reddit r/LocalLLaMA · 2026-07-12

Vellium v1.0.0 已发布,包括安全增强、壁纸主题、JSON 聊天导出以及桌面稳定性重大改进。

0 人收藏 0 人点赞
#stability

4-Bitter的教训:在NVFP4 RL中平衡稳定性与性能

Hacker News Top · 2026-07-10 缓存

本文介绍了一种低精度(NVFP4)强化学习训练的方法,平衡了吞吐量和稳定性,解决了前向和后向传播量化误差的问题。

0 人收藏 0 人点赞
#stability

用Rust重写Bun

Hacker News Top · 2026-07-08 缓存

Bun,这个JavaScript运行时和工具链,正在从Zig重写为Rust,以提高内存安全性和稳定性,解决一系列use-after-free和内存泄漏错误。

0 人收藏 0 人点赞
#stability

软件中的Lindy effect

Hacker News Top · 2026-07-08 缓存

讨论了软件中的Lindy effect,认为经过长时间验证的旧技术通常比新潮技术更可靠且风险更低。

0 人收藏 0 人点赞
#stability

Odin 1.0 Announcement

Lobsters Hottest · 2026-07-07 缓存

Odin编程语言宣布将于2027年1月发布1.0版本(Odin 2027),并公布了完整规范、内联汇编、新标准库等路线图。

0 人收藏 0 人点赞
#stability

Persona Non Grata: LLM角色驱动生成在MCQA中在不同维度上不稳定

arXiv cs.CL · 2026-07-02 缓存

本文研究了大型语言模型在多选题问答(MCQA)任务中角色驱动生成的不稳定性,提出了三个衡量指标来评估模型族、模型规模和问题域的性能、结果和正确性稳定性。研究发现,不稳定性的变化具有一致性,数学和常识问题表现出更大的不稳定性,并且任务提示格式比其他超参数(如温度)引入了更多的不稳定性。

0 人收藏 0 人点赞
#stability

分布偏移下稳定自适应的损失平滑

arXiv cs.LG · 2026-07-02 缓存

损失平滑在自适应过程中在源目标和目标目标之间进行插值,在保留有用特征的同时实现专门化。在监督偏移、强化学习和语言模型微调中的实验显示一致的改进。

0 人收藏 0 人点赞
#stability

Tutorial on the loop transformer architecture (rumored to be the major Mythos improvement; 19 minutes)

Reddit r/singularity · 2026-07-01 缓存

循环Transformer通过直接在架构中设计递归来实现内部推理,避免思维链必须通过生成离散token来模拟迭代的低效性,最新研究表明它在多跳推理上表现出色,并可通过稳定技术和自适应递归进一步提升。

0 人收藏 0 人点赞
#stability

BV-Blend: 不确定性加权历史基线用于可验证奖励下稳定无评论家强化学习

arXiv cs.AI · 2026-06-30 缓存

BV-Blend是一种无评论家的强化学习框架,它将提示本地在线策略统计与来自语义聚类的历史矩相结合,以稳定优势估计,从而提高使用可验证奖励对齐大型语言模型的训练稳定性和性能。

0 人收藏 0 人点赞
#stability

延迟验证破坏多智能体LLM信念:不稳定性阈值与最优校正器放置

arXiv cs.CL · 2026-06-29 缓存

本文建模了多智能体LLM系统中延迟验证的影响,揭示了延迟校正会破坏共识稳定并引发振荡。它推导出闭式稳定性阈值,并提供了一种用于最优校正器放置的贪心近似算法,在五个开放模型上的实验验证了该结果。

0 人收藏 0 人点赞
#stability

@dair_ai:为什么LLM的强化学习训练即使看起来步骤正确却仍然崩溃?来自Qwen背后的阿里巴巴团队的GEOALIGN指出…

X AI KOLs Following · 2026-06-28 缓存

来自Qwen背后的阿里巴巴团队的GEOALIGN指出,LLM强化学习中的不稳定性通常源于少数不良的rollout导致更新方向冲突,并提出了一种基于方向一致性来筛选rollout的轻量级方法,从而提升训练稳定性和性能。

0 人收藏 0 人点赞
#stability

论大型语言模型评估中提示排名的稳定性

arXiv cs.CL · 2026-06-24 缓存

本文系统研究了常见变异来源下,大型语言模型评估中提示排名的稳定性,发现表现最佳的提示经常发生变化。为此,提出了一种基于下置信界的稳定性感知选择策略,以提高鲁棒性。

0 人收藏 0 人点赞
#stability

@MMMusol: 用顶级AI,就像点一碗牛肉粉 第一次看到这句话的时候笑了一下,但现在回头想想, 这可能是我见过最实诚的AI产品描述了。 我是从去年开始重度使用 Claude Code 和 Codex 做开发,官方 API 的价格大家都知道,Opus 级别…

X AI KOLs Following · 2026-06-20 缓存

文章介绍了BeefAPI作为AI API中转服务的实际使用体验,强调了其稳定性、副模型一键配置、额度计算器等功能,并提及端午节优惠活动。

0 人收藏 0 人点赞
#stability

关于循环变换器中残差缩放:稳定性与可迁移性

arXiv cs.LG · 2026-06-18 缓存

本文分析了循环(权重共享)变换器中的残差缩放问题,表明权重共享需要比标准残差网络更强的缩放(1/N),并推导出一种因式参数化方法,使得超参数可以在不同循环次数之间迁移,无需重新调参。

0 人收藏 0 人点赞
#stability

让GHC升级更简单

Lobsters Hottest · 2026-06-17 缓存

GHC团队概述了使GHC升级更简单的进展,重点关注Big Stability Goal和Base Package Goal,以将基础包从编译器发布中解耦。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈