llm

标签

Cards List
#llm

多数LLM速度与准确性对比中缺失的JEV特性

Reddit r/AI_Agents ↗ · 3小时前

本文强调了多数LLM速度与准确性对比忽略了结构化答案的可信度,并展示了JEV作为一款通过结构化接口确保决策输出一致性的工具。

0 人收藏 0 人点赞
#llm

如果 Jev 选择工具,LLM 如何请求另一个工具?

Reddit r/AI_Agents ↗ · 4小时前

本文讨论了将 Jev 与 AI 代理中的 LLM 集成的设计模式,特别是当一次只暴露一个工具模式时,代理如何处理工具选择和规划。

0 人收藏 0 人点赞
#llm

@olam_labs: 外交已进入多智能体竞技场!2022年底,Meta FAIR发布了CICERO,它将多个模型组合成一个……

X AI KOLs Following ↗ · 9小时前 缓存

这条推文强调了从Meta FAIR的CICERO模型在外交中的演进,到当前能以单一智能体处理社交策略的大语言模型,并邀请与前沿智能体竞争。

0 人收藏 0 人点赞
#llm

大型语言模型在《Diplomacy》游戏中被允许说谎。这里是那些实际上信守承诺的模型。[D]

Reddit r/MachineLearning ↗ · 17小时前

一项关于大型语言模型在多智能体模拟中玩《Diplomacy》游戏的研究揭示了当被允许说谎时,哪些模型信守了承诺。

0 人收藏 0 人点赞
#llm

将 GLM-5.3-Flash 转变为类似 Jev 的决策模型

Hacker News Top ↗ · 17小时前 缓存

本文展示了如何调整 GLM-5.3-Flash 大型语言模型使其作为类似于 Jev 的类型化决策模型运行,在单次前向传播中实现可比的准确性和速度,并支持图像决策。

0 人收藏 0 人点赞
#llm

我调查了“AI代理发明自己的语言”背后的日志。看起来更像是术语漂移,而不是秘密语言。

Reddit r/ArtificialInteligence ↗ · 20小时前

本文分析了一个实验的日志,其中AI代理在通信中发展出了专门的术语,认为这是语义扩展而非秘密语言,并探讨了对AI透明度和可解释性的影响。

0 人收藏 0 人点赞
#llm

@N01ennn: 哇塞 . Jev创始人 Diogo Almeida 刚刚发布了一份11页的PDF,详细描述了整个Jev + AI代理循环,这是一个9步蓝图…

X AI KOLs Timeline ↗ · 21小时前 缓存

Jev创始人 Diogo Almeida 发布了一份11页的PDF,概述了通过AI代理运行LLM以最小化成本的9步蓝图,重点强调了任务分割、基于置信度的行动和人工监督。

0 人收藏 0 人点赞
#llm

如果我们不停下来互相帮助,会变成什么?

Lobsters Hottest ↗ · 22小时前 缓存

一篇博客文章反思了一封关于Stack Overflow社区人类价值的个人邮件,将其与LLMs进行对比,并倡导在科技领域培养人际关系。

0 人收藏 0 人点赞
#llm

代码审查不仅仅是(可自动化的)检测

Lobsters Hottest ↗ · 昨天 缓存

文章批判了一篇研究论文,该论文认为编码代理可以替代人类代码审查,强调了人类方面的因素,如困惑、怀疑和注意到缺失元素至关重要,且无法由LLMs复制。

0 人收藏 0 人点赞
#llm

LLM在何时开始自我引导并生成下一个LLM?

Reddit r/LocalLLaMA ↗ · 昨天

本文探讨了LLM何时可能开始自我引导,从而可能导致AI奇点的出现,实现指数级进展。文章邀请对这一主题的讨论和资源分享。

0 人收藏 0 人点赞
#llm

Ling Tiny 3.0:未来的瞥见

Reddit r/LocalLLaMA ↗ · 昨天

作者在一台2017年的无GPU笔记本电脑上运行Ling Tiny 3.0 AI模型,实现了每秒10个令牌的生成速度,并完成了代码生成等任务,展示了现有硬件在边缘智能方面的潜力。

0 人收藏 0 人点赞
#llm

生成每个LLM令牌宽度相同的字体

Hacker News Top ↗ · 昨天 缓存

此工具编译字体,其中每个LLM令牌宽度相等,配备各种分词器的预设,并提供Discord和Slack的集成选项。

0 人收藏 0 人点赞
#llm

@yoheinakajima: 我虽然没完全弄明白,但这看起来很酷

X AI KOLs Following ↗ · 昨天 缓存

Yohei Nakajima 分享了 Bad Theory Labs 的一项突破,他们改进了 LLM 的推理能力,克服了线性思维,使其更具适应性。

0 人收藏 0 人点赞
#llm

Show HN: Ekselio – 为金融工作流程打造的“可编程”本地优先工具

Hacker News Top ↗ · 昨天

Ekselio 是一款本地优先的金融工作流程工具,利用大语言模型 (LLM) 来编排在浏览器中执行的过程,使用户能够创建、保存和运行金融数据流程,兼具透明度和与 QuickBooks、FRED 等服务的集成能力。

0 人收藏 0 人点赞
#llm

@gakonst: 附和说最近的 oai gpt-6-sol 发布感觉有点不对劲,包括 Astra 感觉变笨了,太容易放弃,还有…

X AI KOLs Following ↗ · 昨天 缓存

用户对 OpenAI 最新发布的 GPT-6-sol 表达了担忧,报告称像 Astra 这样的模型感觉效果变差,更难使用。

0 人收藏 0 人点赞
#llm

对于那些在1980年代玩Hack(以及更早的Rogue)成长起来的人,在现代实时战略时代之前……

X AI KOLs Timeline ↗ · 昨天 缓存

一个名为GPT 6 Astra的LLM代理在NetHack游戏中实现了飞升,标志着首次有LLM通过自主构建工具击败这款复杂游戏的记录实例。

0 人收藏 0 人点赞
#llm

@stanfordnlp:这太酷了!很快我们就能看到成熟的LLMs在摇篮里通过自我对弈来培养幼年的LLMs了!更严肃地说…

X AI KOLs Timeline ↗ · 昨天 缓存

这篇文章介绍了零数据自我对弈预训练,这是一种研究方法,其中两个LLMs从随机初始化开始,通过一个生成器为通用图灵机提议程序来学习,展示了归纳偏置如何能够实现一般性学习。

0 人收藏 0 人点赞
#llm

@annabellschfr: Jev作为更复杂推理的守门人,其交接动态类似于代理与人类在环系统中的情况……

X AI KOLs Timeline ↗ · 昨天 缓存

一篇论文描述了将JEV用于推理任务的门控,作为成本效益高的初审法官,在置信度较低时升级到大语言模型或人类。

0 人收藏 0 人点赞
#llm

LLM策略:不惜一切代价的进步

Lobsters Hottest ↗ · 昨天 缓存

文章讨论了GNOME和KDE中LLM策略的兴起,强调了自由软件和开源社区中集体主义与完成主义观点之间的哲学分歧,以及LLM如何颠覆协作平衡。

0 人收藏 0 人点赞
#llm

AI并非“仅仅是一个工具”

Lobsters Hottest ↗ · 昨天 缓存

本文反对将人工智能简单视为‘仅仅是一个工具’,强调其在行业、伦理和社会层面超越单纯实用性的广泛影响。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈