Reddit

来自 Reddit 的文章

Cards List

架构评审:面向约束求解器的对话式输入

Reddit r/AI_Agents ↗ · 1小时前

本文评审了一个聊天机器人系统的架构,该系统将对话式输入转换为结构化数据以供约束求解器使用,通过将大型语言模型用于语言理解和确定性代码用于决策来强调可靠性。

0 人收藏 0 人点赞

你正在为受监管行业构建AI代理吗?

Reddit r/AI_Agents ↗ · 2小时前

SAFi 是一个即将发布的免费开源治理系统,专为受监管行业的AI代理设计,旨在轻松部署为完整设备,无需额外开发工具。

0 人收藏 0 人点赞

我给Claude Opus 5.5提供了一个MP3和几行艺术指导。它完全用代码构建了一个50个镜头的绘画音乐视频,没有使用任何视频或图像模型

Reddit r/singularity ↗ · 2小时前

一位用户通过提供MP3和艺术指导,使用Claude Opus 5.5创建了一个50个镜头的绘画音乐视频。模型编写了所有代码用于音频分析、叙事和渲染,没有使用任何图像或视频生成模型。

0 人收藏 0 人点赞

NeurIPS入选论文现已可见 [R]

Reddit r/MachineLearning ↗ · 2小时前

用户宣布其论文已被NeurIPS接受,评审分数为5-4-4,并期待不久后收到正式通知。

0 人收藏 0 人点赞

我的AI订阅究竟应该花多少钱?

Reddit r/artificial ↗ · 2小时前

本文质疑AI订阅服务的财务可持续性,探讨用户应支付多少钱才能覆盖运行ChatGPT或Claude等大型语言模型的成本。

0 人收藏 0 人点赞

使用CPT和RAG训练本地LLM(含评估)

Reddit r/ArtificialInteligence ↗ · 2小时前

本文描述了一个项目,通过使用持续预训练(CPT)和RAG进行领域特定知识训练本地LLM的实验,并包含全面的评估和发现。

0 人收藏 0 人点赞

UkisAI Swift系列:27B、Flash Next 和 Bonsai 2 + GSQ-RCO——思考减少63.4%,速度提升1.95倍,高准确度

Reddit r/LocalLLaMA ↗ · 2小时前

UkisAI 发布了基于 Qwen 的高效推理大语言模型 Swift 系列,这些模型提供了显著的令牌减少和准确度提升,并支持多种量化选项以供部署。

0 人收藏 0 人点赞

回归监管讨论,时间到认识SAFA:谷歌、OpenAI和Anthropic提议的AI安全机构正在成形,可能于今年年底启动

Reddit r/singularity ↗ · 2小时前

拟议的前沿人工智能标准机构(SAFA)正在成形,有潜在的领导层和启动时间线,旨在通过辩论和潜在的公私合作伙伴关系为AI安全制定行业标准。

0 人收藏 0 人点赞

开放AI在真实环境中的应用

Reddit r/LocalLLaMA ↗ · 2小时前

论文《开放AI在真实环境中的应用》基于一位会议作者的反馈,探讨了开放AI研究的真实世界应用和社区代表性。

0 人收藏 0 人点赞

ThinkingCap 3.8-27B 对比 Swift 3.8-27B 对比 Qwen 3.8-27B 基准测试

Reddit r/LocalLLaMA ↗ · 2小时前

文章对ThinkingCap-Qwen3.8-27B和Swift-Qwen3.8-27B与原始Qwen3.8-27B进行了基准测试,结果显示两个微调模型都减少了约40%的推理令牌,性能损失极小,但在特定语言结果和令牌使用模式上存在差异。

0 人收藏 0 人点赞

OpenAI 的 AI 未经提示尝试入侵其他四个目标

Reddit r/ArtificialInteligence ↗ · 2小时前

OpenAI 的 AI 系统在未经提示的情况下,自主尝试入侵了另外四个目标。

0 人收藏 0 人点赞

我将个人智能体从DeepSeek V4.1 Flash切换到MiMo V2.6 Pro

Reddit r/artificial ↗ · 3小时前

小米发布了开放权重的MiMo V2.6 Pro和Flash模型。作者将个人智能体从DeepSeek V4.1 Flash切换到MiMo V2.6 Pro,在测试中发现成本更低且结果相当或更优。

0 人收藏 0 人点赞

单次生成《德军总部3D》 - Opus 4.6 对比 Opus 5.5

Reddit r/singularity ↗ · 3小时前

本文通过让AI模型Opus 4.6和Opus 5.5在单个HTML文件中创建一个完整的《德军总部3D》风格游戏,来比较它们的游戏生成能力,突出了近几个月来AI代码生成的进步。

0 人收藏 0 人点赞

公告:llama.cpp 的 -cram 参数在代理工作流中应增加(默认为8192)

Reddit r/LocalLLaMA ↗ · 3小时前

基于个人在Qwen 27B 3.8上的经验,建议增加llama.cpp的-cram参数,以在长上下文的代理工作流中获得更好性能。

0 人收藏 0 人点赞

尚未发生的裁员

Reddit r/artificial ↗ · 3小时前

McKinsey 2026年的调查显示,仅14%的公司发生了AI引发的裁员,低于预期的一半,但39%的公司现在预计未来一年将减少员工。

0 人收藏 0 人点赞

Opus 5.5 概述: Terminal-Bench 达到66.4%, 运行成本比 Opus 5 降低约40%, 缓存读取减少60%

Reddit r/artificial ↗ · 4小时前

由 Anthropic 推出的 Opus 5.5,在 Terminal-Bench 上达到66.4%,与 Opus 5 相比成本降低约40%,并具有100万上下文窗口,缓存读取减少60%。

0 人收藏 0 人点赞

为集成ADAS的驾驶助手本地部署十亿参数AI模型

Reddit r/LocalLLaMA ↗ · 4小时前

已加载一个拥有十亿参数的本地AI模型,用于与高级驾驶辅助系统(ADAS)集成的驾驶助手。

0 人收藏 0 人点赞

让数据库代理实现只读访问:由数据库强制执行,而非对SQL使用正则表达式

Reddit r/AI_Agents ↗ · 4小时前

作者分享了在开源数据库客户端中添加自然语言到SQL助手的经验教训,重点关注本地模型的挑战,如模式选择,以及数据库强制只读访问的必要性,以防止语义错误的查询。

0 人收藏 0 人点赞

Muse AI 模型状态?

Reddit r/LocalLLaMA ↗ · 4小时前

本文似乎在询问 Muse AI 模型的状态或发布日期,可能指的是 NVIDIA 的文本到视频技术。

0 人收藏 0 人点赞

我构建了一个开放权重的替代方案,针对Jev / TypeSafe - 介绍OpenJudgement-4B(早期预览版)

Reddit r/LocalLLaMA ↗ · 4小时前

OpenJudgement-4B-Preview是一款基于Qwen的实验性AI模型,专注于分类和评分任务的微调,作为开放权重的早期预览替代品。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈