large-scale

标签

Cards List
#large-scale

语义搜索中的高效GPU检索

arXiv cs.AI · 2天前 缓存

本文介绍了针对LinkedIn语义搜索的对齐策略检索框架,利用嵌入向量划分为类别监督分段,并采用两阶段GPU架构以提升召回率和精确率,显著效果在A/B测试中得到验证。

0 人收藏 0 人点赞
#large-scale

@ShreyashJokare: 2000亿参数

X AI KOLs Timeline · 5天前 缓存

推文突出展示了一个拥有2000亿参数的AI模型,表明了机器学习开发的重大规模。

0 人收藏 0 人点赞
#large-scale

据Leo称,OpenAI刚刚完成其下一个超过10万亿的预训练模型"Bel"

Reddit r/singularity · 2026-08-25

据报道,OpenAI已完成其下一个大规模AI模型的预训练,使用超过10万亿token数据,并被称为"Bel"。

0 人收藏 0 人点赞
#large-scale

持续统一数千个智能体的工作

Reddit r/AI_Agents · 2026-07-28

描述了一种方法,用于在并行预测任务中统一数千个智能体的输出,通过后处理和同质任务设计实现一致性和成本效率。

0 人收藏 0 人点赞
#large-scale

@googleaidevs:我们想看看Gemini 3.5 Flash-Lite如何处理大规模、重复性的视觉任务。此演示让模型处理超过100万张…

X AI KOLs Following · 2026-07-27 缓存

Google AI 演示了 Gemini 3.5 Flash-Lite 处理超过100万张目录图片,以低延迟和高效令牌提取结构化数据,适用于大规模工作流。

0 人收藏 0 人点赞
#large-scale

TableVerse:一个具有真实世界基础布局的大规模桌面数据集,用于可泛化操作

Hugging Face Daily Papers · 2026-07-23 缓存

TableVerse 引入了一个完全自动化的 Real2Sim 流水线,将非结构化、野外图像转换为高保真、可模拟的桌面环境,具有精确的度量标准和物理稳定性,同时提供了一个大规模数据集(TableVerse-100K),用于可泛化的机器人操作。

0 人收藏 0 人点赞
#large-scale

面向大规模动态图的可扩展高效联合脉冲嵌入预测架构

arXiv cs.LG · 2026-07-22 缓存

提出 SG-JEPA,一种面向大规模动态图的联合脉冲嵌入预测架构,该架构沿时间维度将节点划分为上下文集和目标集,以学习预测性嵌入,在节点分类上取得有竞争力的性能,同时可扩展到拥有1300万条边的图,并避免了复杂的自监督机制。

0 人收藏 0 人点赞
#large-scale

Anthropic 如何借助 Claude Code 进行大规模代码迁移(11 分钟阅读)

TLDR AI · 2026-07-17 缓存

Anthropic 概述了使用 Claude Code 进行大规模代码迁移的六步流程,重点包括创建规则手册、依赖关系映射以及通过强大的评审模型进行迭代验证。

0 人收藏 0 人点赞
#large-scale

TabLoRA: 面向大规模表格数据的参数高效低秩集成学习

arXiv cs.LG · 2026-07-14 缓存

TabLoRA 提出了一种针对大规模表格数据的参数高效神经集成方法,通过共享公共骨干网络并引入预测器特定的低秩适配,在性能上与 GBDT 和深度学习基线方法相竞争。

0 人收藏 0 人点赞
#large-scale

@samsja19: https://x.com/samsja19/status/2076846033922035818

X AI KOLs Following · 2026-07-14 缓存

PRIME-RL是一个用于大规模异步强化学习的框架,设计上易于定制,可扩展至1000+块GPU,并支持多种模型和环境。

0 人收藏 0 人点赞
#large-scale

通过协同划分优化构建稳健可行的路径

arXiv cs.AI · 2026-07-07 缓存

本文介绍了协同路径构建器(CoRC),这是一个框架,允许独立求解的子问题在优化过程中交换客户和车辆,从而提升大规模容量限制车辆路径问题的可行性和可扩展性。

0 人收藏 0 人点赞
#large-scale

@h100envy: 前伯克利博士,在 xAI 领导 SGLang 团队,解释了如何在 23 分钟内用 10 万块 GPU 为 Grok 提供服务——比价值 2000 美元的……更好

X AI KOLs Timeline · 2026-07-06 缓存

一位在 xAI 领导 SGLang 团队的前伯克利博士,解释了如何使用分离预填充/解码、专家分片以及通信/计算重叠,在 10 万块 GPU 上为 Grok 提供服务,以实现碾压 DeepSeek API 的价格。

0 人收藏 0 人点赞
#large-scale

Miles:用于大规模LLM强化学习后训练的PyTorch原生栈(14分钟阅读)

TLDR AI · 2026-07-01 缓存

Miles是RadixArk推出的一个开源的PyTorch原生框架,用于大规模LLM强化学习后训练,集成了SGLang、Megatron-LM和Ray,以实现高吞吐量的推演和分布式训练。

0 人收藏 0 人点赞
#large-scale

LongCat-2.0,大规模MoE模型,总参数量1.6万亿,激活参数480亿

Hacker News Top · 2026-06-30

LongCat-2.0是一个大规模混合专家(MoE)模型,总参数量1.6万亿,激活参数量480亿。

0 人收藏 0 人点赞
#large-scale

一步梯度延迟并非大规模异步流水线并行LLM预训练的障碍

Hugging Face Daily Papers · 2026-06-29 缓存

本文挑战了异步流水线并行中一步梯度延迟天生不稳定的假设,表明性能下降取决于优化器的选择。研究证明,Muon等优化器对一步延迟具有鲁棒性,并引入了一种基于误差反馈的修正方法以进一步缓解陈旧的梯度问题,在高达10B参数的LLM预训练中实现了接近同步训练的性能。

0 人收藏 0 人点赞
#large-scale

DF3DV-1K:大规模无干扰新视角合成数据集与基准

Hugging Face Daily Papers · 2026-06-18 缓存

介绍了DF3DV-1K,一个包含1048个场景和89924张图像的大规模真实世界数据集,用于无干扰的新视角合成,同时提供了九种方法的基准测试,以及通过微调基于扩散的2D增强器来改进辐射场方法的应用。

0 人收藏 0 人点赞
#large-scale

100万亿+的预训练数据???这是我见过模型训练中最大的数据量。

Reddit r/LocalLLaMA · 2026-06-01

一个新的人工智能模型正在使用超过100万亿个令牌进行训练,是其他模型如Kimi、Mimo和DeepSeek通常使用的27-50万亿令牌预训练数据规模的两倍。

0 人收藏 0 人点赞
#large-scale

@jcjohnss: GPIC 应该成为生成建模的新标准基准。在 GPIC 上训练 1 个 epoch 的成本相当于在 ImageNet 上训练 100 个 epo…

X AI KOLs Following · 2026-05-29 缓存

GPIC 是一个新的大规模图像-文本数据集和生成建模基准,据称比 ImageNet 高效得多,并且是现实世界问题的更好代理,具有完全许可的研究和商业使用许可。

0 人收藏 0 人点赞
#large-scale

@josefchen:在arXiv上发布我们的新论文:我们训练了有史以来最大的多语言食品模型。410万食谱。7种语言。…

X AI KOLs Timeline · 2026-05-26 缓存

新的arXiv论文宣布了最大的多语言食品模型,该模型在7种语言的410万食谱上训练,包含1,790种食材,压缩至2MB。

0 人收藏 0 人点赞
#large-scale

SciAtlas:面向自动化科学研究的大规模知识图谱

arXiv cs.AI · 2026-05-25 缓存

SciAtlas是一个大规模、多学科的知识图谱,包含超过4300万篇论文和30亿个三元组,旨在通过神经符号检索算法为AI驱动的自动化科学研究提供结构化知识。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈