标签
介绍了PEARL,一个用于交互式优化建模的系统,采用求解器在环方法,从自然语言出发迭代改进问题表述,其性能超越了DeepSeek-V3.2-685B等更大规模的模型。
一个后续项目,将GPT-2的32,070个词元可视化为一棵位于庞加莱球中的交互式双曲树,允许用户在嵌入空间中飞越。
一个数据驱动的可视化项目,通过记录的事件重建FIFA World Cup 2026的每一场比赛,呈现完全由数据构建的印象。
本文介绍了SAM-MT,它是SAM2的一个扩展,用于实时交互式多目标视频分割,实现了与目标数量无关的高帧率(FPS)。
ARDY 引入了一个流式生成框架,用于实时、高保真度的 3D 人体运动生成,通过文本和运动学约束进行控制,采用混合表示和两阶段自回归 Transformer 去噪器。
本文介绍了LingBot-World 2.0,一个先进的世界建模系统,具有无界交互范围、实时720p 60fps视频生成、多样化的交互元素(例如攻击、施法),以及通过领航员和导演智能体实现的新型多智能体行为控制,还附带一个共享的多玩家界面。
一条推文推广了一个互动网站,该网站详细解析了人形机器人硬件、成本和供应链,指出材料是瓶颈。
Agent Draw 是一个开源工具,允许AI代理在你演示时在 TLDraw 画布上绘图,基于 TLDraw 的 agent starter kit 构建。它支持排队绘图请求,并测试不同的模型,如 Claude Opus 和 Haiku。
Pattern Collider 是一个开源网页工具,使用多网格方法生成和探索准周期镶嵌图案,例如彭罗斯镶嵌。用户可创建自定义图案,并通过可分享的URL进行分享。
An open-source project that visualizes machine learning algorithms using Jupyter Notebooks, with interactive Marimo notebooks and mathematical derivations, hosted on GitHub.
Vidu S1 是一款实时交互式视频生成模型,支持语音控制数字角色动画,可在消费级GPU上实现无限长度输出和高帧率,达到最先进性能。
ModelMap 是一个基于网页的三维可视化工具,将AI模型测试分数显示为尖峰形状,使用户能够通过交互式三维图形探索和比较模型性能。
Matt Shumer 分享了一个网页应用,用户可以在AI生成的霍格沃茨环境中飞行,该应用使用Claude Fable 5创建,并支持Vision Pro的沉浸模式。