agentic

标签

Cards List
#agentic

@ollama: 使用Ollama运行Ornith:ollama run ornith 编码时,搭配Claude或Pi使用:ollama launch claude --model ornith oll…

X AI KOLs Timeline ↗ · 2026-06-27 缓存

Ornith-1.0是一个专注于agentic编码的开源LLM系列,提供9B到397B MoE的多种大小,可通过Ollama运行,以便与Claude或Pi等工具一起使用。

0 人收藏 0 人点赞
#agentic

@TeksEdge:经过一天的使用,测试 Orinth-1.0-35B 与 Qwen3.6-35B 的表现如何。凭经验来说,它的表现与……

X AI KOLs Timeline ↗ · 2026-06-27 缓存

一位用户报告称,Ornith-1.0-35B 在性能上与 Qwen3.6-35B 相当,但在规划和长任务执行方面更胜一筹,同时开发者宣布开源专门用于代理编码的 Ornith-1.0 系列 LLM。

0 人收藏 0 人点赞
#agentic

预览 GPT-5.6 Sol:下一代模型

Hacker News Top ↗ · 2026-06-26 缓存

OpenAI 预览了 GPT-5.6 系列,包括旗舰版 Sol、均衡版 Terra 和经济实惠版 Luna,具备改进的推理能力、智能体能力以及稳健的安全措施。在更广泛发布前,将进行有限预览。

0 人收藏 0 人点赞
#agentic

Dockerless:面向编码代理的无环境程序验证器

Hugging Face Daily Papers ↗ · 2026-06-26 缓存

本文介绍了Dockerless,一种无环境的代理化补丁验证器,无需执行代码即可评估补丁,性能超越现有开源验证器,并为编码代理实现高效的后训练。

0 人收藏 0 人点赞
#agentic

@MaxForAI: hey!居然有这么一个nb的模型?? Ornith @ornith_ 刚刚开源了一个新的开源模型家族。 包含9BDense、31BDense、和35BMoE以及397B的MoE 而且官方的Benchmark令人印象深刻,甚至可以与 GLM…

X AI KOLs Timeline ↗ · 2026-06-25 缓存

Ornith开源了Ornith-1.0模型家族,包含9B Dense、31B Dense、35B MoE和397B MoE多个尺寸,在编码任务上取得领先性能,甚至能与GLM5.2媲美。

0 人收藏 0 人点赞
#agentic

@anvie:测试了 Ornith-1.0-9B,对于这种规模的模型来说,它令人印象深刻。我不相信这只是一个 9B 模型!

X AI KOLs Following ↗ · 2026-06-25 缓存

Ornith-1.0 是一系列专注于智能体编码的开源 LLM,参数范围从 9B 到 397B,在同等规模的开源模型中达到了最先进的性能。

0 人收藏 0 人点赞
#agentic

@rohanpaul_ai: 又一个精彩的开源发布。DeepReinforce刚刚发布了Ornith-1.0,一个MIT许可的开源智能编码LLM系列…

X AI KOLs Timeline ↗ · 2026-06-25 缓存

DeepReinforce发布了Ornith-1.0,这是一个MIT许可的开源智能编码LLM系列,包含一个397B MoE模型,该模型在SWE-Bench和Terminal-Bench上超越了Claude Opus 4.7,采用了新颖的自我改进训练策略。

0 人收藏 0 人点赞
#agentic

@liquidai:推出LFM2.5-230M:这是我们最小的模型,专为快速运行而设计,可在任何地方(CPU、NPU和GPU)上运行,以实现代理型任务…

X AI KOLs Timeline ↗ · 2026-06-25 缓存

Liquid AI发布了LFM2.5-230M,这是一个拥有230M参数的小型模型,针对CPU、NPU和GPU上的快速推理进行了优化,适用于手机和机器人等设备上的代理型任务。

0 人收藏 0 人点赞
#agentic

在 Gemini 3.5 Flash 中引入计算机使用

Google DeepMind Blog ↗ · 2026-06-24 缓存

Gemini 3.5 Flash 现已原生支持将计算机使用作为内置工具,使开发者能够构建智能体,在浏览器、移动端和桌面环境中进行交互,用于软件测试和知识工作等长期自动化任务。

0 人收藏 0 人点赞
#agentic

Pulse

Product Hunt ↗ · 2026-06-24

Pulse 是一款面向企业的具备权限感知、主动性和自主性的AI大脑,已在 Product Hunt 上线。

0 人收藏 0 人点赞
#agentic

llama.cpp的Web UI现在支持通过Web Workers在浏览器中执行模型生成的JavaScript(可选加入)

Reddit r/LocalLLaMA ↗ · 2026-06-24

llama.cpp的Web UI现在支持通过Web Workers在沙箱iframe中执行模型生成的JavaScript,作为可选功能实现轻量级的代理代码执行。

0 人收藏 0 人点赞
#agentic

@_TobiasLee: 来自字节跳动的 Seed 2.1 在我们两项基准测试中取得了令人瞩目的成绩。Claw-Eval (多模态,https://claw-eval.…

X AI KOLs Timeline ↗ · 2026-06-24 缓存

字节跳动的 Seed 2.1 模型在多模态智能体(Claw-Eval)和长视频理解(Video-MME)基准测试中取得了强劲的结果,尽管在感知和智能体能力之间仍存在差距。

0 人收藏 0 人点赞
#agentic

Autodata:一个用于创建高质量合成数据的智能体数据科学家

Hugging Face Daily Papers ↗ · 2026-06-24 缓存

Autodata是一种方法,通过元优化使AI智能体能够扮演数据科学家的角色,创建高质量合成训练数据,在计算机科学、法律推理和数学任务等领域实现了性能提升。

0 人收藏 0 人点赞
#agentic

@sashimikun_void: 又一天目睹基于智能体的Slack初创公司被清理。我听到创始人说,“别担心,他们没时间去…

X AI KOLs Following ↗ · 2026-06-23 缓存

一位开发者反思AI智能体如何消除Slack初创公司的利基市场,同时ClaudeDevs透露Claude Code现在为他们产品团队编写了65%的代码,包括Claude Tag工具本身。

0 人收藏 0 人点赞
#agentic

@analogalok: gemma-4-12B-agentic-fable5-composer2.5 V2 已发布。对基于 Fable 5 推理训练的模型进行了智能体升级。运行…

X AI KOLs Timeline ↗ · 2026-06-21 缓存

Gemma 4 12B 的一个新微调版本,基于 Fable 5 的推理进行训练,在智能体编码基准测试中实现了显著提升(从15%到55%),并且可以使用 llama.cpp 的自定义分支在 8GB VRAM GPU 上本地运行。

0 人收藏 0 人点赞
#agentic

@maximelabonne: LFM2.5-ColBERT-350M 是一个出奇可靠的智能工具选择器。我们给了它151个工具,它总能把最相关的5个挑出来……

X AI KOLs Following ↗ · 2026-06-18 缓存

LFM2.5-ColBERT-350M 是一个模型,能从151个工具中可靠地选出最相关的工具,节省令牌并提高准确性,非常适合代理型边缘模型。

0 人收藏 0 人点赞
#agentic

为智能体时代打造的Git平台

Hacker News Top ↗ · 2026-06-18

一个专为智能体时代设计的新Git平台,可能针对AI驱动的开发工作流。

0 人收藏 0 人点赞
#agentic

@Saboo_Shubham_: 将你的AI编程代理变成一个自主视频制作工作室。100%开源。

X AI KOLs Following ↗ · 2026-06-18 缓存

一款100%开源的工具,可以将AI编程代理转变为自主视频制作工作室,由@Saboo_Shubham_发布。

0 人收藏 0 人点赞
#agentic

它是否具备足够的代理能力?使用你自己的工具对开放模型进行基准测试

Hugging Face Blog ↗ · 2026-06-18 缓存

这篇博客文章介绍了一种基准测试方法,用于评估开放模型在代理编程任务上的表现,不仅关注准确性,还关注代理过程的效率。它提供了一个使用 pi coding agent 的可定制工具框架,并在不同模型和库版本上进行测试。

0 人收藏 0 人点赞
#agentic

@witcheer:这是我测量到的第一个能提升实际Bug修复的Qwen3.6-27B编码调优(!!!)。 - 质量(MMLU/ARC/HellaS…)

X AI KOLs Timeline ↗ · 2026-06-17 缓存

一个Qwen3.6-27B的社区微调在SWE-bench上提升了实际Bug修复能力,同时保持了质量,这与导致退化的合成蒸馏不同。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈