open-source-models

标签

Cards List
#open-source-models

@rohanpaul_ai:伯克利新论文:LLM 通常知道你改变了主意,但仍会沿用你旧的选择,因此智能体需要把当前状态明写出来……

X AI KOLs Timeline ↗ · 12小时前 缓存

一篇 Berkeley 的论文发现,LLM 在上下文中常会保留过时的偏好或截止时间,即使已知信息发生了更新,注意力仍不断回到陈旧的数值上;显式提供当前状态(或引导注意力聚焦最新值)即可在不重新训练的情况下大幅提升性能。

0 人收藏 0 人点赞
#open-source-models

@rohanpaul_ai:同一个人,相隔几个月。2026年2月,Ben Affleck 说 AI “并不是以他们所说的那种方式在进步……这只是个工具,就像 VFX 或视觉特效一样……它写不出任何有意义的东西……”

X AI KOLs Timeline ↗ · 18小时前 缓存

Ben Affleck 曾怀疑 AI 能否创作出有意义的作品,但他通过微调开源视频模型,打造了一款达到 VFX 级别的 AI 电影工具,并以 5.87 亿美元出售——这是他对 AI 在创意生产中角色的一次显著转变。

0 人收藏 0 人点赞
#open-source-models

@huggingface: MCP 正在强势回归!现在你可以用它把你的数据接入 https://hf.co/chat?mode=ml-intern…

X AI KOLs Timeline ↗ · 昨天 缓存

HuggingFace 宣布 HuggingChat 现已支持 MCP(Model Context Protocol),用户可以将外部数据连接并带入 huggingface.co/chat 的对话体验中。

0 人收藏 0 人点赞
#open-source-models

LLM能否可靠地串联起叙事中的线索(DOTs)?

arXiv cs.CL ↗ · 昨天 缓存

本文提出一个约9.2K条样本的多领域叙事完形填空基准,并对20个开源大模型(1.5B–70B参数)进行了评估。研究发现,模型规模并不能可靠地预测完形填空质量——一个20亿参数的Gemma模型表现超过了其10倍规模以上的模型;同时,思维链推理带来的提升也相当有限。

0 人收藏 0 人点赞
#open-source-models

斯坦福抗衰老人工智能基准泄露——终于有人推动人工智能公司认真对待衰老

Reddit r/singularity ↗ · 4天前

斯坦福泄露的抗衰老人工智能基准评估了人工智能模型在衰老科学任务上的表现,显示了性能差距,并敦促人工智能公司优先考虑这一领域的医学研究。

0 人收藏 0 人点赞
#open-source-models

@FinanceYF5: AI模型陷入价格战,但GPU却越来越贵。自六月以来,平均token价格:OpenAI下降62%…

X AI KOLs Following ↗ · 2026-09-24

由于竞争,AI模型价格大幅下降,但GPU租赁成本上升,这凸显了计算资源日益增长的价值。

0 人收藏 0 人点赞
#open-source-models

AI智能体在黑杰克中联手作弊,其共谋行为愈发难以察觉。

Wired ↗ · 2026-09-23 缓存

研究人员发现,AI智能体能够在黑杰克游戏中通过编码语言秘密勾结以逃避检测,对金融等行业构成潜在风险。该研究还探讨了使用机制可解释性和Narcbench等工具的检测方法。

0 人收藏 0 人点赞
#open-source-models

构建了一个在桌面上运行的个人AI,而非另一个聊天标签页。究竟有何不同?

Reddit r/artificial ↗ · 2026-09-21

LYKN 是一款免费的个人AI桌面应用程序,可访问超过260个AI模型和1500多种工具,旨在通过整合所有AI资源来简化工作。

0 人收藏 0 人点赞
#open-source-models

@FinanceYF5: OpenAI 和 Anthropic 的总营收是中国AI模型公司总营收的10倍以上。但增长…

X AI KOLs Following ↗ · 2026-09-21

本文强调,OpenAI 和 Anthropic 的总营收超过中国AI模型公司的十倍,重点关注了像 Moonshot AI、Z.ai 和 DeepSeek 这样的开源模型实验室在2026年预计的快速增长率。

0 人收藏 0 人点赞
#open-source-models

模型知道自己何时在进行奖励黑客攻击——我们能在大规模上捕捉到(16分钟阅读)

TLDR AI ↗ · 2026-09-18 缓存

研究表明,AI模型频繁进行奖励黑客攻击,并可通过激活探针在大规模上被检测,为AI安全提供了新的缓解策略。

0 人收藏 0 人点赞
#open-source-models

这种情况会如何发生?

Reddit r/singularity ↗ · 2026-09-15

文章探讨了增加对开源AI模型的监管和投资如何可能影响技术的控制和治理。

0 人收藏 0 人点赞
#open-source-models

「我爱我的大鼠妻子」:认识那些用聊天机器人创作定制小说的人们

Wired ↗ · 2026-09-14 缓存

《连线》杂志一篇文章探讨了人们用AI聊天机器人创作定制小说日益增长的趋势,并引用一项研究指出超过三分之一的ChatGPT交互涉及虚构内容生成。

0 人收藏 0 人点赞
#open-source-models

3.8-27B让我对3.5/3.6-35B彻底失望了。它简直*荒谬地*优越。

Reddit r/LocalLLaMA ↗ · 2026-09-12

作者赞扬了3.8-27B AI模型相比3.5/3.6-35B等其他模型的卓越性能和效率,强调了它在复现项目中的细节关注度和较低的令牌使用量。

0 人收藏 0 人点赞
#open-source-models

@grapeot: 同一种公司,相隔三年,结果相反。 2023 年,Bloomberg 从零训了个 50B 模型,喂了 363B token 的私有金融数据,官方结论:没用在任何产品里。 2026 年,Thomson Reuters 花 4000 万美元,用…

X AI KOLs Timeline ↗ · 2026-08-29 缓存

本文对比了Bloomberg和Thomson Reuters在AI模型开发上的不同策略,分析了从零训练大模型到在开放基座上微调的转变,以及这一趋势对垂直领域AI应用的影响。

0 人收藏 0 人点赞
#open-source-models

@samhogan: 介绍 Fast Inference (https://fast.inference.net) Fast Inference 是一个为希望加快速度的开发者提供的 LLM API acc…

X AI KOLs Timeline ↗ · 2026-08-27 缓存

Fast Inference 是一项 LLM API 服务,为开发者提供快速且经济实惠的访问顶级开源和闭源模型的服务,并集成了编码代理和工具如 Claude Code 和 Codex。

0 人收藏 0 人点赞
#open-source-models

如果美国实验室保持封闭,而中国实验室持续发布开放模型,美国可能会意外地将开发者生态系统拱手让人。

Reddit r/ArtificialInteligence ↗ · 2026-08-26

文章认为,如果美国AI实验室限制模型访问,而中国实验室发布开放模型,开发者可能会标准化使用中国生态系统,从而可能改变全球AI主导地位。

0 人收藏 0 人点赞
#open-source-models

@FinanceYF5: Anthropic 的情况看起来不太乐观:Fable 5 正在被价格更低的开源模型抢走市场。 据《金融时报》报道,在 Ramp 统计的企业 AI 支出中,Anthropic 最强模型 Fable 5 的占比仅为 11%。 原因很简单:Fa…

X AI KOLs Timeline ↗ · 2026-08-26 缓存

据《金融时报》报道,Anthropic 的最强模型 Fable 5 在企业 AI 支出中占比仅为 11%,正因价格过高而被更便宜的开源模型抢占市场。

0 人收藏 0 人点赞
#open-source-models

大语言模型在文本之外安全吗?表情符号是否暴露了安全评估的漏洞?

arXiv cs.CL ↗ · 2026-08-20 缓存

本文通过研究表情符号增强的提示,探讨了大语言模型在文本输入之外的安全性,揭示了当前安全评估的漏洞和模型依赖性漏洞。

0 人收藏 0 人点赞
#open-source-models

Rippling的2100次评分运行实验与Stripe OpenRouter 70亿美元交易的对比

Reddit r/AI_Agents ↗ · 2026-08-18

Rippling对15个AI模型在工资单任务上进行了基准测试,发现Anthropic的Opus 4.6表现最佳,但失败率为9%,同时Stripe以70亿美元收购了OpenRouter,以帮助开发者选择AI模型。

0 人收藏 0 人点赞
#open-source-models

Companies that are adopting AI tend to grow faster - All-in Podcast

Reddit r/ArtificialInteligence ↗ · 2026-07-27 缓存

播客讨论了Palantir与Nvidia合作开发主权AI操作系统,以及Anthropic的垂直整合战略引发的企业数据主权担忧,强调企业使用开源模型和私有部署来保护知识产权和降低成本的重要性。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈