标签
Shopify 重新设计了其管理界面,以改善关键工作流的导航,并集成了 Sidekick 以提供帮助。
GPT-6 Astra 是唯一成功导航自动驾驶课程的人工智能模型,在第二次尝试中完成。
OmniEcho引入了一种空间感知的全模态模型和一个新的基准,用于具身智能体的空间音频-视觉感知和导航,实现了最先进的性能。
宇航员Sophie Adenot和Jessica Meir在国际空间站外完成了一次6小时49分钟的太空行走,用于导航和科学维护,包括安装逆向反射器和更换设备。
MapQuest 因公司拒绝将 Lake Ontario 重命名为 Lake America 而激增,成为 Apple 的顶级免费应用,此举无视了 President Trump 在贸易紧张局势下针对 Canada 的行政命令。
CoMaps,一款自由及开源的导航应用,已与 Gadgetbridge 和 OpenVitals 等其他自由及开源应用集成,以实现智能手表导航和活动跟踪等功能,同时通过权限尊重用户隐私。
UrbanGround评估了多模态语言模型代理是否能在逼真的3D城市复制品中保持可靠的导航和空间推理能力,发现局部感知技能无法组合成扩展的目标导向行为。
这篇文章讨论了 Katherine Dunn 的书《Little Blue Dot》,探讨了 GPS 技术对社会的意外影响,包括它如何改变了导航以及我们与实体地点的关系。
推荐使用 tgzhidao.com 中文 Telegram 导航站,用户可通过关键词搜索频道、群组、机器人和工具资源,避免在 Telegram 中大海捞针。
推荐一个名为TG知道的网站,专门收录中文Telegram频道、群组和机器人,支持分类搜索,方便用户发现优质资源。
本文实证研究了视觉语言模型智能体中的空间记忆过时性问题,发现模型常常忽略矛盾的视觉证据,并且信任过时记忆会增加安全风险。作者提出了审计机制,但表明在记忆-观察冲突下的视觉接地仍是一个重大开放挑战。
介绍了深度研究预训练(DRP),一种离线框架,从引文和超链接证据结构中生成搜索-打开-撰写轨迹。在1B token上预训练的Qwen3-14B模型在深度研究基准测试中优于匹配的无DRP基线,即使使用较少的监督微调数据也是如此。
洛克菲勒大学的一项研究揭示,果蝇通过边缘追踪而非传统的surge-and-cast模型来追踪气味羽流,并使用虚拟现实跑步机来绘制它们的行为。
SCOUT 提出了面向稀疏奖励强化学习的每上下文重置课程,根据每个上下文的学习进度调整辅助移除,在导航和操作任务中优于全局节奏方法。
本文提出了一种基于设计科学研究的适老行人路径规划系统,融入了障碍物、便利设施和安全阈值,并通过与老年人共同开展的实地研究进行了验证。
CodeNib是一个多视图数据系统,通过为每次提交构建可复用的词汇视图、密集视图和结构视图,向编码智能体提供仓库上下文,从而实现更快的更新和高效的上下文服务。
Webcmd 是一个开源工具,它教会浏览器代理一次性学习网站导航并重复使用,从而大幅减少重复任务中的token浪费。它支持99个网站,并可在本地运行。
Robostral Navigate 是一个仅使用单目 RGB 图像进行机器人导航的 80 亿参数视觉语言模型,在 R2R-CE 和 RxR-CE 基准测试中分别以 77.4% 和 75.1% 的成功率达到了最先进水平。