model-update

标签

Cards List
#model-update

@_mohansolo:我们已在 Antigravity 上推出了新版的 Gemini 3.5 Flash,它号称更轻量,且在困难任务上持久性更强……

X AI KOLs Following ↗ · 2026-06-02 缓存

新版 Gemini 3.5 Flash 已在 Antigravity 上推出,针对更困难的任务进行了改进,并为所有用户重置了速率限制。

0 人收藏 0 人点赞
#model-update

Claude Opus 4.8:系统卡(阅读时间40分钟)

TLDR AI ↗ · 2026-06-01 缓存

深度分析Anthropic的Claude Opus 4.8系统卡,详细阐述了相较Opus 4.7在能力、安全评估和对齐风险方面的增量改进。

0 人收藏 0 人点赞
#model-update

新版Claude在测试中对“自信地报告错误答案”的症状降为0%。这里有一个提示词可以充分利用这一改进,适用于任何重要事项。

Reddit r/ArtificialInteligence ↗ · 2026-05-31

Anthropic的Claude Opus 4.8更新大幅减少了自信但错误的答案,在报告有缺陷的结果上得分为0%,并提供了一个提示词来利用这一改进进行关键的自我批判。

0 人收藏 0 人点赞
#model-update

@datacurve: Opus 4.8 现已登陆 DeepSWE。在默认高思考投入设置下,其得分比 Opus 4.7 xhigh 高出6%,同时还能降低…

X AI KOLs Following ↗ · 2026-05-30 缓存

Opus 4.8 现已可在 DeepSWE 上使用,得分比 Opus 4.7 高出6%,并降低了每任务平均成本。

0 人收藏 0 人点赞
#model-update

@KarelDoostrlnck:您是否使用英语以外的语言使用 ChatGPT?新更新在您的语言中感觉如何?我们非常希望听到您的……

X AI KOLs Timeline ↗ · 2026-05-29 缓存

OpenAI 发布了新版 GPT-5.5 Instant,在讨好性、事实准确性和多语言性能方面有所改进,并正在寻求用户反馈。

0 人收藏 0 人点赞
#model-update

@FinanceYF5: Claude Opus 4.8上线: 编程更强、agent能力更强、支持数百并行子agent的动态工作流,同价格。 另:据悉Mythos级别模型将在数周内发布。 Anthropic今天的更新不止一个惊喜

X AI KOLs Timeline ↗ · 2026-05-29 缓存

Claude Opus 4.8已上线,编程和agent能力增强,支持数百并行子agent的动态工作流,价格不变。Anthropic还预告数周内将发布Mythos级别模型。

0 人收藏 0 人点赞
#model-update

llm-anthropic 0.25.1

Simon Willison's Blog ↗ · 2026-05-28 缓存

llm-anthropic 0.25.1 新增对 Claude Opus 4.8 的支持、快速模式选项,并更新了默认的 max_tokens 行为。

0 人收藏 0 人点赞
#model-update

@julien_c: 现在告诉我,Opus 4.7 到 Opus 4.8 的权重变化百分比是多少? <1%?

X AI KOLs Timeline ↗ · 2026-05-28 缓存

询问 Opus 4.7 和 Opus 4.8 之间的权重变化百分比。

0 人收藏 0 人点赞
#model-update

活体检测模型能否泛化到从未训练过的合成媒体生成技术?[D]

Reddit r/MachineLearning ↗ · 2026-05-21

本讨论探讨了基于历史深度伪造样本训练的活体检测模型是否能泛化到新的合成媒体生成技术,质疑声称具备深度伪造检测能力的供应商的更新周期。

0 人收藏 0 人点赞
#model-update

MTP PR 已合并!!!

Reddit r/LocalLLaMA ↗ · 2026-05-16

与 LLaMA 模型相关的 MTP(可能指模型训练管道或类似内容)拉取请求已合并,标志着一个里程碑。

0 人收藏 0 人点赞
#model-update

@OpenAI:切换到 Codex 的另一个理由。

X AI KOLs ↗ · 2026-05-13

OpenAI 推广切换到 Codex,强调采用其 AI 代码生成模型的另一个理由。

0 人收藏 0 人点赞
#model-update

@thinkymachines:得益于模型的实时语音交互能力,Horace 最近变得更容易上手了。

X AI KOLs Following ↗ · 2026-05-11 缓存

随着实时语音交互能力的提升,Horace AI 模型现已更易于使用。thinkymachines 对此更新进行了重点介绍。

0 人收藏 0 人点赞
#model-update

@FinanceYF5: 2/ 回答更简洁 这次升级的一个重点,是让回答变得更简洁。 OpenAI 称,这是根据用户反馈重点改进的方向。

X AI KOLs Following ↗ · 2026-05-10 缓存

OpenAI announces an update focused on making model responses more concise, based on user feedback.

0 人收藏 0 人点赞
#model-update

@KyleHessling1:兄弟们,我彻底震惊了。Qwen 3.6 27B 的提升幅度,就像直接从 Qwen 27B 3.5 跨到 Qwen 4。我刚跑完一整套前端设计测试和智能体基准,全部由它完成。结论:效果远超预期,我完全惊呆。

X AI KOLs Following ↗ · 2026-04-22

早期用户反馈:Qwen 3.6 27B 相比 3.5 性能暴涨,在前端设计与智能体基准上表现尤为亮眼。

0 人收藏 0 人点赞
#model-update

Claude Opus 4.6 与 4.7 系统提示的变更

Simon Willison's Blog ↗ · 2026-04-18 缓存

Anthropic 发布了 Claude Opus 4.7,系统提示有显著变化,包括扩展的儿童安全指令、新的工具集成(Claude 在 PowerPoint、Chrome、Excel 中),以及行为调整以减少冗长并提高任务完成度,避免不必要的说明。

0 人收藏 0 人点赞
#model-update

GPT-5.3 Instant:更流畅、更实用的日常对话

OpenAI Blog ↗ · 2026-03-03 缓存

OpenAI发布了GPT-5.3 Instant,这是ChatGPT最常用模型的更新。它改善了对话流畅度,减少了不必要的拒绝,并在高风险领域将幻觉率降低了高达26.8%。该更新基于用户反馈,专注于语气、相关性和实际可用性。

0 人收藏 0 人点赞
#model-update

GPT-5 系统卡片更新:GPT-5.2

OpenAI Blog ↗ · 2025-12-11 缓存

OpenAI 发布 GPT-5 系列最新模型 GPT-5.2,并更新系统卡片以记录安全缓解措施,同时推出 GPT-5.2 Instant 和 GPT-5.2 Thinking 变体。

0 人收藏 0 人点赞
#model-update

GPT-5 系统卡补充文档:敏感对话处理

OpenAI Blog ↗ · 2025-10-27 缓存

OpenAI 在 10 月 3 日发布了 GPT-5 的更新,通过与 170 多名心理健康专家的合作,改进了对心理和情感困扰相关敏感对话的处理,将不充分的回应减少了 65-80%。公司发布了系统卡补充文档和安全评估,对比了新模型与 8 月 15 日的前一版本。

0 人收藏 0 人点赞
#model-update

需要全身控制的任务,配备Gemini Robotics 2

YouTube AI Channels ↗ · 2026-07-30 缓存

Google DeepMind的Gemini Robotics 2将物理AI扩展到全身控制,使类人机器人能够在杂乱空间中执行需要伸展、弯腰和平衡的任务。

0 人收藏 0 人点赞
#model-update

Introducing GPT-5.5 with Databricks

YouTube AI Channels ↗ · 2026-05-08 缓存

OpenAI与Databricks合作推出GPT-5.5模型,在agent框架中错误率降低46%,成为唯一在基准测试中超过50%的模型,解析质量和函数调用能力显著提升。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈