distillation

标签

Cards List
#distillation

硅谷在对待中国AI问题上完全分裂

Wired · 18小时前 缓存

Wired报道称,硅谷在对待中国开放权重AI模型方面存在严重分歧:一些初创公司反对禁令,而Anthropic等AI巨头则因担忧知识产权盗窃和缺乏安全护栏而推动监管。

0 人收藏 0 人点赞
#distillation

“蒸馏”的说法本质上就是荒谬的

Reddit r/LocalLLaMA · 昨天

认为指责中国从美国AI模型中进行知识蒸馏在法律上是没有根据的,这不过是保护估值过高的美国AI公司的一种宣传手段。

0 人收藏 0 人点赞
#distillation

面向政治人物简化的LLM蒸馏过程:

Reddit r/LocalLLaMA · 昨天

一篇向政治受众简化LLM蒸馏概念的文章,解释小型模型如何从大型模型学习。

0 人收藏 0 人点赞
#distillation

@Suhail:面对开放权重模型限制的威胁,蒸馏研究将增加10倍。它将引起史翠珊效应…

X AI KOLs Following · 昨天

Suhail预测,对开放权重模型的限制将导致蒸馏研究增加10倍,以此戏弄政府,并可能使AI更高效。

0 人收藏 0 人点赞
#distillation

专家称利用Anthropic的Fable并非Kimi K3如此优秀的原因

TechCrunch AI · 昨天 缓存

专家们对中国公司Moonshot通过蒸馏复制Anthropic的Fable模型来实现Kimi K3的先进能力表示怀疑,理由是时间不足和技术限制。

0 人收藏 0 人点赞
#distillation

荒谬的说法:蒸馏模型性能超越原始模型

Reddit r/LocalLLaMA · 昨天

有说法认为,蒸馏AI模型可以超越其规模更大的原始模型,这有悖常理。

0 人收藏 0 人点赞
#distillation

视觉对比自蒸馏

Hugging Face Daily Papers · 2天前 缓存

VCSD通过使用内容擦除的对照图像产生对比信号,消除了在策略自蒸馏中对外部教师、特权答案或视觉证据的需求,在视觉语言基准测试中持续优于现有方法。

0 人收藏 0 人点赞
#distillation

白宫正在设法应对中国AI

Wired · 2天前 缓存

白宫内部对于如何应对中国快速进步的AI存在分歧,争论焦点在于实施更严格的管控还是制定可行的限制措施,尤其是针对美国模型(如Anthropic的Claude Fable 5)遭受的蒸馏攻击。

0 人收藏 0 人点赞
#distillation

白宫称Moonshot蒸馏了Anthropic的Fable后,美国财政部威胁实施制裁

TechCrunch AI · 2天前 缓存

美国财政部威胁对中国AI公司Moonshot实施制裁,指控其涉嫌蒸馏Anthropic的Fable模型,此举加剧了围绕AI知识产权盗窃和出口管制违规的紧张局势。

0 人收藏 0 人点赞
#distillation

会话自适应正交蒸馏(SAOD)技术将744B(1.5TB)压缩至100GB以下?

Reddit r/LocalLLaMA · 2天前

会话自适应正交蒸馏(SAOD)是一种将7440亿参数模型(1.5TB)压缩至100GB以下的技术,大幅降低存储和推理成本。

0 人收藏 0 人点赞
#distillation

请停止抱怨

Reddit r/ArtificialInteligence · 2天前

评论批评Anthropic和OpenAI声称其封闭模型被中国模型Kimi3破解/蒸馏,质疑这与之前的安全声明不一致。

0 人收藏 0 人点赞
#distillation

❗NEWS❗白宫科技政策办公室前主任兼总统科学顾问表示,Kimi K3是从Anthropic的Fable蒸馏而来的。

Reddit r/singularity · 2天前

前白宫科学顾问声称Kimi K3是从Anthropic的Fable模型蒸馏而来的。

0 人收藏 0 人点赞
#distillation

"我们有信息称月之暗面为开发K3而蒸馏了Anthropic的Fable模型"

Hacker News Top · 2天前 缓存

据称月之暗面AI使用复杂方法蒸馏Anthropic的Fable模型以开发其K3模型,从而规避检测,引发了对AI开发中大规模工业间谍行为的担忧。

0 人收藏 0 人点赞
#distillation

MUX:基于多路复用令牌的连续推理

arXiv cs.AI · 3天前 缓存

MUX 提出了一种无损连续推理的方法,通过将离散推理步骤蒸馏到多路复用的潜在令牌中,这些令牌编码了子词的叠加,实现了更高的带宽,并在语言模型推理任务中支持并行探索。

0 人收藏 0 人点赞
#distillation

蒸馏护城河(6分钟阅读)

TLDR AI · 3天前 缓存

文章认为,AI公司建立在昂贵模型训练之上的竞争护城河很容易被蒸馏(distillation)所削弱——即通过重复API查询来复制模型,行业实践如xAI在OpenAI模型上训练Grok、Anthropic指控中国实验室挖掘Claude等行为都印证了这一点。

0 人收藏 0 人点赞
#distillation

@LangChain: "一旦你找到了智能的形态,你就知道它长什么样。" @enoreyes 来自 @factoryAI 谈为什么他认为……

X AI KOLs Following · 3天前 缓存

@factoryAI 的 @enoreyes 的一句话暗示,蒸馏几乎是不可阻挡的,模型实验室可能已经认识到了智能的形态。

0 人收藏 0 人点赞
#distillation

@0x0SojalSec: 进展中有多少来自蒸馏?图表显示:原创性 vs. 蒸馏。声称中国人工智能…

X AI KOLs Timeline · 3天前 缓存

对输出相似性的分析表明,像Kimi K3、DeepSeek V4和GLM 5.2这样的中国AI前沿模型展现出风格差异,显示出有意义的独立发展,这挑战了其进展严重依赖从美国模型蒸馏的说法。

0 人收藏 0 人点赞
#distillation

基于轨迹的在策略蒸馏用于掩码扩散语言模型

arXiv cs.CL · 4天前 缓存

一篇论文提出了基于轨迹的在策略蒸馏(TOPD),一种教师监督框架,用于将推理能力迁移到掩码扩散语言模型,无需奖励估计,在显著的计算加速下实现了与经过RL训练的模型相当的准确率。

0 人收藏 0 人点赞
#distillation

@GoSailGlobal: 微软刚开源了一个项目,叫 Resource2Skill,还配了篇 arXiv 论文 名字就是它干的事:Resource → Skill 它回答的,是 skill 这件事一直没人正面碰的问题:skill 到底从哪来 以前靠人一个个手写 它把…

X AI KOLs Timeline · 4天前 缓存

微软开源了 Resource2Skill,可从教程视频、文章、代码等人类资源中自动蒸馏出可执行的 agent 技能,并实现网页、PPT、Excel 等实际应用。

0 人收藏 0 人点赞
#distillation

关于Kimi K3:其能力与相关不满(70分钟阅读)

TLDR AI · 4天前 缓存

Kimi K3是Moonshot AI推出的2.8T参数开放模型,基准测试表现强劲,但可能过度优化,且落后顶级闭源模型数月。它从Claude蒸馏而来,其发布可能先于IPO。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈