agent

标签

Cards List
#agent

SR-Fraud: 一个用于非平稳支付欺诈检测的结果监督反思型LLM智能体框架

arXiv cs.LG ↗ · 昨天 缓存

SR-Fraud 是一种针对非平稳支付欺诈检测的结果监督反思型LLM智能体框架,在生产基准测试上相比传统方法提高了检测指标。

0 人收藏 0 人点赞
#agent

我发现这个代理每天能让你免费使用最多20小时的 GLM 5.3 Flash 或 DeepSeek 4.1 Flash,无需提供支付信息!

Reddit r/AI_Agents ↗ · 2天前

一位用户发现了一个代理,提供每天最多20小时免费访问 GLM 5.3 Flash 和 DeepSeek 4.1 Flash AI 模型,对 GitHub 注册和连续使用有额外奖励,无需支付信息。

0 人收藏 0 人点赞
#agent

VideoGen-Agent:增强视频生成智能体

Hugging Face Daily Papers ↗ · 4天前 缓存

本文提出了VideoGen-Agent,一种基于强化学习的多模态智能体,它协调工具进行视频生成,在新的VABench基准测试上显著提升了性能。

0 人收藏 0 人点赞
#agent

@yoheinakajima: (Mark的) (连接器) (平台)

X AI KOLs Timeline ↗ · 5天前 缓存

Mark Zuckerberg 宣布推出 Muse 连接器,使开发者能够将其服务与 AI 代理和浏览器整合,实现无缝的用户交互。

0 人收藏 0 人点赞
#agent

面向Human-LLM对话中用户侧隐式冲突的主动检测

arXiv cs.CL ↗ · 2026-09-18 缓存

本文提出了一种用于主动检测用户侧Human-LLM对话中隐式冲突的方法,引入了一个基准和合成方法来增强轻量级LLM的性能。

0 人收藏 0 人点赞
#agent

Claude Cowork 与 Chat 功能现已合并为统一 Claude 服务

Simon Willison's Blog ↗ · 2026-09-16 缓存

Claude Cowork 与 Chat 功能正逐步合并为统一的 Claude 服务,使其成为更集成的通用智能体。本次更新将首先向 Pro 和 Max 订阅用户推出。

0 人收藏 0 人点赞
#agent

机器人操作中的Agent as Policy

arXiv cs.CL ↗ · 2026-09-14 缓存

本文介绍了Agent as Policy (AGP),这是一个框架,使通用智能体无需针对特定任务训练,即可直接控制物理机器人执行操作任务,在各种现实场景中实现高成功率。

0 人收藏 0 人点赞
#agent

供参考,使用@cloudflaredev 你不仅可以构建网页应用。这是我用Swift和Hono worker制作的原生个人行程规划代理……

X AI KOLs Following ↗ · 2026-09-12 缓存

一位用户展示了一个用Swift和Hono worker构建的原生个人行程规划代理,使用了Cloudflare的服务如Project Think、Browser Run、Durable Objects和R2,展示了Cloudflare在网页应用之外的多功能性。

0 人收藏 0 人点赞
#agent

T1:面向长期任务的终端智能体强化学习

Hugging Face Daily Papers ↗ · 2026-09-10 缓存

T1 是一个拥有122B参数的混合专家模型,通过强化学习训练用于长期终端任务,在Terminal-Bench 2.1等基准测试中达到了最先进的结果,并超越了GPT-5.4和GLM-5.1等模型。

0 人收藏 0 人点赞
#agent

@AI_Jasonyu: 揭秘我全网爆火,几千万播放的AI视频是怎么做出来的? 全程录制制作过程,耐心观看。 这个视频目前在全网保守估计应该几千万播放了,就连在X上搬运我的都已经马上200万播放量了,我也是第一次做AI短剧,这次的5分钟视频,制作时间总共花费也就一…

X AI KOLs Timeline ↗ · 2026-08-28 缓存

这篇文章揭示了如何使用Topview和Agent工具制作出全网播放量达几千万的AI视频,整个过程仅花费约一个半小时。

0 人收藏 0 人点赞
#agent

@RoundtableSpace: Qwen 3.8 27B 在本地 RTX 5090 上运行时,在个人基准测试中击败 Opus 4.8,速度高达每秒200个令牌,无需...

X AI KOLs Timeline ↗ · 2026-08-27 缓存

Qwen 3.8 27B 是一个拥有270亿参数的AI模型,在本地RTX 5090 GPU上运行时,在个人基准测试中超越Opus 4.8,速度高达每秒200个令牌,无需互联网或API访问。

0 人收藏 0 人点赞
#agent

@undefinedKi:Karpathy 从未打算让你全自动化 LLM 知识库。大多数人本末倒置了。他的文件中提到了三个关键点……

X AI KOLs Timeline ↗ · 2026-08-22 缓存

Karpathy 的 LLM 知识库自动化方法强调迭代式源信息导入、将答案归档回知识库,以及定期校对以保持一致性,倡导用户深度参与过程。

0 人收藏 0 人点赞
#agent

是否有兴趣开发一个自托管的开源版本的Manus/Perplexity?

Reddit r/LocalLLaMA ↗ · 2026-08-21

一位开发者就发布一个自托管、开源的AI工具寻求社区反馈,该工具用于研究、文档创建和代理功能,灵感源自Manus和Perplexity。

0 人收藏 0 人点赞
#agent

Blender Agent Bridge

Product Hunt ↗ · 2026-08-16

Blender Agent Bridge 是一款开源的 MCP 桥接工具,旨在将 AI 工作流集成到 Blender 中,通过 AI 工具增强 3D 建模能力。

0 人收藏 0 人点赞
#agent

DeepSeek 高峰/低峰定价更新

Hacker News Top ↗ · 2026-08-14 缓存

DeepSeek 宣布 DeepSeek-V4-Pro 正式发布(GA),包含重大智能体升级、灵活的推理努力等级、原生 OpenAI Responses API 支持,以及更新的 API 定价,引入高峰和低峰费率,低峰期价格降低 50%。

0 人收藏 0 人点赞
#agent

SDAM:面向复杂Text-to-SQL的结构差异感知记忆演化

arXiv cs.CL ↗ · 2026-08-14 缓存

本文提出SDAM,一种基于记忆的复杂Text-to-SQL框架,利用结构差异感知推理、矛盾感知反思和基于模式的记忆演化来改进SQL生成。实验在BIRD-dev和Spider-test基准上展示了适度的性能提升。

0 人收藏 0 人点赞
#agent

dots-studio/dots3-note-prev · Hugging Face

Reddit r/LocalLLaMA ↗ · 2026-08-13 缓存

dots-studio 发布 dots3-note 预览版,这是 dots3 系列中首个开放权重模型:一个拥有 2800 亿参数的多模态 MoE,激活参数为 160 亿,支持 512K 上下文,并能理解文本、图像、视频和音频。

0 人收藏 0 人点赞
#agent

@Saccc_c: 在 Deepseek Harness 的轨迹模式中还可以查看其系统提示词(见图1) 我将其翻译成了中文,感兴趣的朋友可以学习学习(见图2、图3)

X AI KOLs Following ↗ · 2026-08-13 缓存

推文介绍了 Deepseek Harness 的轨迹模式,可以查看 Agent 的思考步骤、工具调用及系统提示词,并附有中文翻译,便于学习。

0 人收藏 0 人点赞
#agent

@Saccc_c: Deepseek harness 的轨迹模式太有意思了,现在完全可以知道 Agent 的工作进展,你的 Agent 员工再也不敢摸鱼了 其具体的思考步骤,调用工具,工具返回结果都清晰可见。最有意思的是,它会用不同颜色区分 AI 执行任务时…

X AI KOLs Following ↗ · 2026-08-13 缓存

DeepSeek Harness 发布了,带有轨迹模式,可以可视化 Agent 的思考步骤、工具调用和返回结果,并用颜色区分不同类型内容。可通过 npm 安装使用,适合开发者观察 Agent 工作进展。

0 人收藏 0 人点赞
#agent

GPT-5.6 开发者指南

OpenAI Blog ↗ · 2026-08-13 缓存

OpenAI 推出 GPT-5.6,这是一个新的模型系列,以极低的成本提供前沿水平的智能体性能,并新增了用于推理持久化、多智能体编排和程序化工具调用的 API 原语。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈