综合热度、重要程度与时效排序的热门资讯。
谷歌DeepMind已开源其最先进的全球天气与气旋预测模型WeatherNext 2,以及之前的模型GraphCast和GenCast,提供代码和预训练权重。
作者反思了AI智能体如何从回答问题转向实际执行工作,这可能使基于AI智能体技术栈的一人公司成为可能,尽管判断力和执行力仍然至关重要。
ComfyUI is an open-source, modular node-based AI engine for generating images, videos, 3D models, and audio, with support for state-of-the-art open-source models and cloud/desktop deployment.
深入探讨 Arch Linux 的 alpm-install-scriptlet 文件和 alpm-hooks,它们的工作原理、在软件包仓库中的使用方式,以及何时使用它们的指南。
一位注册会计师解释了定制AI开发工作如何有资格获得联邦研发税收抵免,并警告各机构在开发开始前应在合同中明确抵免所有权。
本文解释了当前的智能体记忆系统如何存储和检索事实,但无法识别模式,并介绍了 Zep 的 Observations 功能,该功能通过分析知识图谱来得出结构性见解。
Harvey AI 发布了 Harvey LAB,这是一个用于评估 LLM 智能体在真实法律工作中表现的开源基准,包含覆盖 24+ 个业务领域的 1,671 个任务数据集及一个执行框架。
Code-Graph-RAG 是一个开源工具,使用 Tree-sitter 解析多语言代码库,在 Memgraph 中构建知识图谱,并让你用自然语言查询、编辑和优化代码。它支持在统一图模式下的混合语言 monorepo。
作者开源了一个用于编码智能体的执行与上下文层,在GPT-5.6和Claude Opus 5上的配对冒烟测试中,将新鲜模型流量减少了57-85%,同时保持任务成功率,并寻求独立评估和赞助。
一个团队描述了他们的提示注入评估套件如何在发布前发现文档助手的回归问题,并强调了在系统指令与检索数据之间保持严格层级的重要性。
一位交易者下注5000美元,押注美联储9月维持利率不变,这说明了像Kalshi这样的平台如何允许交易经济事件的概率,而不仅仅是结果。
对新兴地缘政治AI格局的分析:美国领导的Pax Silica联盟、欧盟的加入,以及与之抗衡的中国主导的World AI Cooperation Organisation,表明当下呈现的是多极而非两极格局。
一篇博客文章讨论了依赖 GitHub 等集中式托管平台的脆弱性,探讨了分叉(forking)和供应商化(vendoring)作为缓解策略,并质疑谁应该为可靠的源代码可用性买单。
一个潜在的新 GPT-Image 模型(据称为 "Mona-lisa-1")已出现在 LMArena 上,其输出中检测到了 OpenAI SynthID 水印。
作者介绍了如何使用 Mastra 的新预览部署功能,让编码代理自动将更改部署到沙箱,通过 API 和 UI 进行测试,然后开启 PR,从而弥合了验证缺口。
论文《Memory Reward Inflation in Self-Improving LLM Agents》表明,权重冻结的自我改进智能体仍可能因信任有缺陷的LLM生成的记忆分数而退化,模型认可自身31%–54%的错误答案。这种“回声差距”在更强的LLM中依然存在。
文章深入分析大型科技公司巨额表外AI相关承诺,指出将其类比为‘安然’是夸大其词,但循环融资、激进会计处理和‘大市场幻觉’值得警惕,并讨论了英伟达、OpenAI等公司的相互投资与融资风险。