ai-performance

标签

Cards List
#ai-performance

最佳情况下的 Voice AI 延迟

Reddit r/AI_Agents ↗ · 17小时前

一条推文讨论了关于 Voice AI 系统实现 80ms 延迟的说法,对其使用定制模型和本地部署推理的可行性提出了疑问。

0 人收藏 0 人点赞
#ai-performance

OpenAI 在关键基准测试中仍保持领先

Reddit r/singularity ↗ · 昨天

本文讨论了OpenAI如何在关键AI基准测试中保持领先地位,强调了其在性能指标上的持续主导地位。

0 人收藏 0 人点赞
#ai-performance

@rohanpaul_ai: 19台Unitree人形机器人在10,000多人面前加入120名舞者,上海举办全球最大全尺寸现场人形机器人表演……

X AI KOLs Timeline ↗ · 昨天 缓存

全球最大现场人形机器人表演在上海举行,19台Unitree人形机器人与120名舞者共同展示AI驱动的协调,全球直播。

0 人收藏 0 人点赞
#ai-performance

@yoheinakajima: 在本地将对象检测延迟降低到0.35秒以下

X AI KOLs Timeline ↗ · 2天前 缓存

一位开发者分享了在本地硬件上将对象检测延迟降低到0.35秒以下的成就,突显了人工智能性能优化的进展。

0 人收藏 0 人点赞
#ai-performance

GPT-6 Astra在ZeroBench(一个极其困难的视觉基准测试)上取得了巨大飞跃,在所有三个指标上超越了人类基线。

Reddit r/singularity ↗ · 2天前

GPT-6 Astra在ZeroBench这个极其困难的视觉基准测试上取得了巨大飞跃,在所有三个指标上超越了人类基线。

0 人收藏 0 人点赞
#ai-performance

Qwen 3.8 27B 在 RTX 3060 上使用约 3 BPW:GSQ 与 ByteShape IQ3-XXS 2.88BPW 的比较

Reddit r/LocalLLaMA ↗ · 3天前

本文比较了在 RTX 3060 上对 Qwen 3.8 27B 模型进行 GSQ 和 ByteShape 量化的结果,揭示了尽管 ByteShape 量化声称与原始模型高度相似,但其性能却表现不佳。

0 人收藏 0 人点赞
#ai-performance

Googlebooks 于10月4日发布,起价899美元——以下是今天可以预购的五款型号

Ars Technica ↗ · 4天前 缓存

Google即将推出Googlebooks,这是一款搭载Android系统的新型笔记本电脑,配备高端硬件和AI性能,起价899美元,目前有五款型号可供预购。

0 人收藏 0 人点赞
#ai-performance

@VraserX:Figure的机器人只在零样本家庭测试中完成了56%。这远非我可以在家信赖的产品。我……

X AI KOLs Timeline ↗ · 6天前 缓存

Figure的机器人在零样本家庭测试中达到了56%的成功率,相比没有人类行为预训练的9%有了显著提升,显示出进展但尚未准备好用于消费者使用。

0 人收藏 0 人点赞
#ai-performance

@10xmylife: Tried it out today, and it really works, so we'll go with this plan.

X AI KOLs Timeline ↗ · 6天前 缓存

用户测试Jev模型在游戏《杀戮尖塔2》中的表现,其决策速度极快,仅需0.7秒,远超人类和GPT-6 Astra,令人震惊。

0 人收藏 0 人点赞
#ai-performance

在 RTX Pro 6000 上使用 Ninfer 对 Qwen3.6 35ba3b 进行单请求达到 600 tokens/s。还记得 Comcast 的广告 "stupid fast" 吗?

Reddit r/LocalLLaMA ↗ · 2026-09-17

在 RTX Pro 6000 上使用 Ninfer 在 Qwen3.6 模型上达到每秒600 tokens,尽管不是最先进的模型,但适用于暴力任务。

0 人收藏 0 人点赞
#ai-performance

终于明白了为什么我的编码代理在样板代码上打字快,在新逻辑上打字慢

Reddit r/AI_Agents ↗ · 2026-09-09

作者解释了投机解码如何影响编码代理的速度,样板代码上较高的接受率导致打字更快,并讨论了其他影响性能的因素,如缓存未命中。

0 人收藏 0 人点赞
#ai-performance

@TechByMarkandey: 如果进步不再意味着增加参数数量会怎样?

X AI KOLs Timeline ↗ · 2026-09-07 缓存

MiniCPM5-2B是一款拥有20亿参数的开源语言模型,其极高的智能密度使其非常适合边缘设备部署,并在多项AI性能测试中表现出色。

0 人收藏 0 人点赞
#ai-performance

@Modular: 当人们看到我们的性能数据时,他们会问我们的秘诀是什么。Brendan Hansknecht,AI Performance Engineering Manager,…

X AI KOLs Timeline ↗ · 2026-09-03 缓存

Brendan Hansknecht from Modular 解释说,他们的高性能源于将性能视为一个全栈问题,而不是依赖生产中的零散组件。

0 人收藏 0 人点赞
#ai-performance

有人预测 GPT-6 Astra 会得多少分吗?

Reddit r/singularity ↗ · 2026-09-03

本文询问关于 GPT-6 Astra 模型预期性能评分的预测。

0 人收藏 0 人点赞
#ai-performance

花6万美元买Mac跑本地LLM vs 10美元订阅

Reddit r/AI_Agents ↗ · 2026-08-31

本文讨论了一位YouTube博主的实验,展示了运行LLM的昂贵本地硬件在成本效益上不如经济实惠的云订阅,强调了当前本地AI在日常应用中的实际局限性。

0 人收藏 0 人点赞
#ai-performance

@HannesVonEssen: 我们能让它跑多快?? 我目前的最佳速度是 1.6 米/秒

X AI KOLs Timeline ↗ · 2026-08-30 缓存

一条推文询问一个未指定系统的速度,作者分享了其个人最佳成绩为1.6米每秒。

0 人收藏 0 人点赞
#ai-performance

@0xSero: 在1500美元硬件上运行Qwen3.8-27B。对于大多数人来说,这便是现实的本地AI体验,原因众多,包括…

X AI KOLs Timeline ↗ · 2026-08-27 缓存

该推文探讨了在1500美元硬件上运行Qwen3.8-27B AI模型的可行性,强调了其对大多数人而言的实用性和性价比。

0 人收藏 0 人点赞
#ai-performance

我在想,人们什么时候才能意识到我们需要把这个重新带回来呢?

Reddit r/AI_Agents ↗ · 2026-08-27

作者主张恢复'大海捞针'基准测试来评估AI能力,分享了私人测试结果,显示许多模型在记忆指令方面表现不佳,质疑其在实际任务中的可靠性。

0 人收藏 0 人点赞
#ai-performance

@0xSero: 在家使用Opus,速度超过200 tok/s 我爱ZAI

X AI KOLs Timeline ↗ · 2026-08-26 缓存

用户@0xSero分享在家使用ZAI运行Anthropic的Opus模型,速度超过每秒200个token,并表达了对ZAI的喜爱。

0 人收藏 0 人点赞
#ai-performance

在 Coval 的公开基准测试中运行我们的 Apache 2.0 Gepard TTS,在单个 RTX 4090 上首次音频延迟为 68.7 毫秒。

Reddit r/LocalLLaMA ↗ · 2026-08-26 缓存

本文报告了对 Gepard 1.0 文本转语音模型的基准测试,在单个 RTX 4090 GPU 上实现了 68.7 毫秒的首次音频延迟,在延迟方面优于多个商业 API,同时基于 Apache 2.0 开源。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈