coherence

标签

Cards List
#coherence

长形式多镜头视频生成的多网格后训练

Hugging Face Daily Papers · 5天前 缓存

MovieGrid是一种多网格后训练范式,它将长视频分解为空间排列的块,以提高多镜头的连贯性和效率,在视频生成中实现了最先进的镜头内和镜头间一致性。

0 人收藏 0 人点赞
#coherence

一致性与孤儿实例规则

Lobsters Hottest · 2026-09-01 缓存

本文解释了类型类系统中一致性的概念,并讨论了编程语言中的孤儿实例规则,以Haskell和Rust为例。

0 人收藏 0 人点赞
#coherence

基于大型语言模型的长文本生成中大纲阶段的多框架比较

arXiv cs.CL · 2026-08-28 缓存

本文提出了一个统一基准,用于比较基于大纲的大型语言模型长文本生成框架,独立评估大纲,发现性能随框架与粒度匹配度变化,支持将大纲与写作阶段解耦。

0 人收藏 0 人点赞
#coherence

我认为AI电影制作刚刚跨过了一个重要门槛:在整个序列中保持统一的视觉世界。

Reddit r/singularity · 2026-08-25

作者分享了他们在AI生成视频序列方面的经验,强调了在镜头间保持视觉一致性的挑战,以及AI片段与电影级序列之间差距的缩小。

0 人收藏 0 人点赞
#coherence

面向连贯性的梦境场景可视化

arXiv cs.AI · 2026-08-07 缓存

这篇arXiv论文介绍了梦境场景可视化器(DSV),该系统利用LLM进行叙事拆分,并结合带反馈的文本到图像模型,将书面梦境描述转换为连贯的四面板视觉序列,以确保视觉和语义连贯性。

0 人收藏 0 人点赞
#coherence

AI生成的游戏世界已可供游玩,但程序一致性是否重要?只要看起来酷就行吗?

Reddit r/artificial · 2026-07-11

Google Genie 3 允许用户输入提示词并在 AI 生成的游戏世界中行走,引发了关于程序一致性是否重要,还是仅凭令人印象深刻的视觉效果就足以吸引玩家的争论。

0 人收藏 0 人点赞
#coherence

大型语言模型响应的全面评估:多因素评分系统

arXiv cs.CL · 2026-07-09 缓存

本文提出了一种用于评估大型语言模型(LLM)响应的多因素评分系统,综合了准确性、简洁性、事实一致性、可读性和连贯性。应用于TruthfulQA数据集,揭示了主流模型的优势与局限,提供了一个透明的评估框架。

0 人收藏 0 人点赞
#coherence

UnityShots:基于记忆的多镜头音视频生成与边界感知门控

Hugging Face Daily Papers · 2026-06-19 缓存

UnityShots 是一个基于记忆的多镜头音视频生成系统,通过固定大小的长期记忆槽和短期记忆槽,结合边界条件门控与离散切类型先验,在视频切换中保持主体外观和音频的一致性。该系统在跨镜头一致性指标上优于开源基线,并达到与闭源系统相当的水平。

0 人收藏 0 人点赞
#coherence

学习一致性表征:一种拓扑可解释性方法

arXiv cs.LG · 2026-06-03 缓存

本文介绍了一致性(coherence)这一几何约束,受大脑中网格细胞和头朝向细胞的启发。一致性确保特征响应数据流形上的几何连通区域,从而提升可解释性;作者提出了一个可微分的目标函数(Coh),并在合成数据、旋转MNIST和BERT词元嵌入上进行了验证。

0 人收藏 0 人点赞
#coherence

神经符号交互式叙事中的世界状态转换

arXiv cs.CL · 2026-05-26 缓存

本文探讨如何利用大语言模型(LLM)在基于规则的交互式叙事系统中预测状态变化,旨在提升叙事连贯性与玩家表现力。使用 Llama 3 70B 和 Gemini 1.5 Flash 进行的实验表明,世界状态转换既能维持一致性,又能鼓励玩家进行创造性输入。

0 人收藏 0 人点赞
#coherence

提示-激活对偶性:通过注意力层干预改进激活引导

Hugging Face Daily Papers · 2026-05-11 缓存

本文识别出KV缓存污染是对话中激活引导的一种失败模式,并提出了GCAD方法,该方法从提示贡献中提取引导信号,并应用词元级门控来改进长程连贯性,在多轮基准上取得了显著提升。

0 人收藏 0 人点赞
#coherence

为什么A10b以下的MOE让我像在赌博

Reddit r/LocalLLaMA · 2026-04-22

开发者报告称,像 qwen3.6-35b-A3b 这种“活跃参数量”较小的 MOE 模型,相比稠密的 qwen3.5-27b,一致性更低、需要更多引导,很难直接塞进智能体工作流。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈