ai-optimization

标签

Cards List
#ai-optimization

我构建了面向智能体的提示缓存感知无损压缩

Reddit r/AI_Agents · 2026-07-21

一个专为AI智能体设计的提示缓存无损压缩工具。

0 人收藏 0 人点赞
#ai-optimization

Mimo & deepseek 在优化人工智能方面确实非常出色。阅读我链接的官方博客页面,您将深入了解他们如何以 2 到 3 倍的利润实现这种低定价。

Reddit r/LocalLLaMA · 2026-07-07

Mimo 和 DeepSeek 优化了 AI 模型,以 2-3 倍的利润实现了低定价,详情见其官方博客。

0 人收藏 0 人点赞
#ai-optimization

@ba_niu80557: https://x.com/ba_niu80557/status/2073413449930207662

X AI KOLs Timeline · 2026-07-04 缓存

Superpowers 6开源项目展示了AI不仅能写代码,还能自主优化开发流程(如审计、合并任务、减少浪费),这标志着AI开始管理自身工作流,比人类管理者更严谨。文章强调诚实的评估体系(eval)是避免自我欺骗的关键。

0 人收藏 0 人点赞
#ai-optimization

AI推理工程指南(阅读时间约17分钟)

TLDR AI · 2026-06-16 缓存

本指南解释了AI推理工程这一学科,涵盖了预填充和解码阶段的划分、从封闭模型到开放模型的转变,以及针对延迟、吞吐量和成本的优化技术。

0 人收藏 0 人点赞
#ai-optimization

@a1zhang: 好的封装设计可以在信息结构化的前提下绕过极高的 token 成本。真的没必要每次都把……

X AI KOLs Following · 2026-06-15 缓存

讨论如何通过结构化信息而非将所有内容都输入语言模型的上下文来降低 token 成本,并以一个 RLM 代理处理大量日志行但只使用少量活跃 token 为例。

0 人收藏 0 人点赞
#ai-optimization

LLM的最佳使用方式会是什么样?

Reddit r/singularity · 2026-06-12

探讨一种推测性想法:通过适应LLM的原生通信模式(例如使用神经语)来优化人类与LLM的交互,而不是强迫它们适应人类语言。

0 人收藏 0 人点赞
#ai-optimization

@MaxForAI: 田渊栋 @tydsh 的创业团队Recursive @Recursive_SI 发布了一个阶段性的成果:自动化AI研究系统 这个系统里AI能自己完成「提出想法→实现→跑实验→验证→根据结果选下一个实验」这一整套研究循环。 结果表明在目标清…

X AI KOLs Timeline · 2026-06-11 缓存

Recursive团队发布自动化AI研究系统,能自主完成研究循环,在多个基准上超越人类社区已有方案,如在NanoGPT Speedrun中将训练时间从79.7秒压缩至77.5秒,在SOL-ExecBench上将得分提升至0.754。

0 人收藏 0 人点赞
#ai-optimization

@charles_irl: 重写并行是一项重大举措,如果能比我们用CuTe DSL实现的速度更快就好了。FA4是一个非常…

X AI KOLs Following · 2026-06-11 缓存

关于使用CuTe DSL和瓦片编程模型重写并行性以提升FA4 (FlashAttention 4) 内核性能的讨论。

0 人收藏 0 人点赞
#ai-optimization

@TheAhmadOsman: 你并不是在“运行模型”,你运行的是内核。模型只是一个图,推理引擎是调度器/优化器/执行器…

X AI KOLs Following · 2026-06-06 缓存

这条推文解释了运行AI模型实际上是运行优化的内核,推理引擎及其内核实现对于性能至关重要,而不仅仅是模型或硬件。

0 人收藏 0 人点赞
#ai-optimization

@_avichawla: Anthropic. Google. Meta. 每个人都在用来自1990年代的一个想法将LLM推理速度提升2-3倍。在1990年代,CPU设计者…

X AI KOLs Timeline · 2026-05-26 缓存

推测解码受1990年代CPU分支预测启发,现被Anthropic、Google和Meta用于将LLM推理速度提升2-3倍。它使用一个小模型来猜测未来的token,并用一个大模型并行验证它们,从而避免了解码期间GPU空闲时间。

0 人收藏 0 人点赞
#ai-optimization

公司不过是算法的图谱

Hacker News Top · 2026-05-25 缓存

文章认为,公司是算法的集合,AI很快将优化每一个组成部分,从而引发一波由咨询主导的透明化和效率提升浪潮。

0 人收藏 0 人点赞
#ai-optimization

@DeRonin_: Andrej Karpathy: “你 90% 的 AI 编程账单都花在了不需要发送的上下文上” 以下是资深 A…

X AI KOLs Timeline · 2026-05-12

这篇文章总结了 Andrej Karpathy 关于通过优化上下文使用、避免为简单任务使用过于强大的模型以及实施高效的路由策略来降低 AI 编程成本的建议。

0 人收藏 0 人点赞
#ai-optimization

@MaximeRivest: 面向图像的复合 AI 系统被严重低估了。我们需要 gepa、dspy、autoresearch 风格的优化方案,来实现从……

X AI KOLs Following · 2026-05-11

Maxime Rivest 指出,面向图像的复合 AI 系统目前被严重低估,他建议借助 DSPy 和 GEPA 等优化框架,实现涉及 SAM 与分类器的流水线自动化构建。

0 人收藏 0 人点赞
#ai-optimization

@RoundtableSpace: Hermes Agent 观察自身的操作过程,意识到方法不当,并重新改写了技能。2 次迭代。速度提升 3 倍。成本降低 80%。

X AI KOLs Timeline · 2026-05-10 缓存

Hermes Agent 通过观察自身表现、识别低效环节并改写技能,展示了自我改进能力,仅需两次迭代便实现了 3 倍的速度提升和 80% 的成本降低。

0 人收藏 0 人点赞
#ai-optimization

@ivanfioravanti: Apple M5 Max + MLX = 原始算力!看看我正在玩的“FasterLivePortrait-MLX”演示,我从 MPS 开始,但结果不……

X AI KOLs Timeline · 2026-05-09

作者演示了在搭载 M5 Max 芯片的设备上,将 LivePortrait 的实现从 MPS 迁移到 Apple 的 MLX 框架后,性能和速度有了显著提升。

0 人收藏 0 人点赞
#ai-optimization

我们是否在浪费时间基于开源模型构建企业代理?(我对Ling 1T 2.6的经验)

Reddit r/AI_Agents · 2026-05-07

一位企业代理开发者讨论了使用像Ling 1T 2.6这样的开源模型的权衡,强调了相比于专有API,优化和基准测试的高昂开销。

0 人收藏 0 人点赞
#ai-optimization

RunInfra

Product Hunt · 2026-04-19

RunInfra 是一项服务,用户可以通过它描述自己的 AI 模型需求,并获得优化的 AI 模型。

0 人收藏 0 人点赞
#ai-optimization

@smallnest: 我把 @karpathy 的autoresearch 移植到自动化的软件开发上,各种优化后,效果吊炸天了

X AI KOLs Timeline · 2026-04-19 缓存

开发者将Karpathy的autoresearch框架移植到自动化软件开发领域,并进行了多项优化,取得显著效果。

0 人收藏 0 人点赞
#ai-optimization

Gemini 3 Deep Think: Optimizing 2D semiconductor fabrication

YouTube AI Channels · 2026-05-08 缓存

DeepMind's Deep Tank AI system optimizes the growth of 2D semiconductors, achieving 130-micrometer crystals—surpassing the target of 100 micrometers—and significantly accelerating the parameter search process for material fabrication.

0 人收藏 0 人点赞
← 返回首页

提交意见反馈