ranking

标签

Cards List
#ranking

最佳智能眼镜排名:Meta、Viture 等(2026)

Wired · 5天前 缓存

《连线》杂志2026年最佳智能眼镜排行榜,涵盖 Meta、Viture、Even Realities 和 RayNeo 的型号,并附有各自的优缺点和规格。

0 人收藏 0 人点赞
#ranking

2025年5月至2026年4月估计网页访问量最高的前20个AI工具

Reddit r/ArtificialInteligence · 6天前

一张图表根据2025年5月至2026年4月的估计网页访问量对前20个访问量最高的AI工具进行排名,显示ChatGPT以647亿次访问量占据主导地位,遥遥领先于Canva、Gemini等。该排名基于对9,531个AI工具的研究。

0 人收藏 0 人点赞
#ranking

@efipm: 2026年全球顶级金融科技公司 - CNBC和Statista年度榜单,8个子垂直领域的40家金融科技公司 https://buff.l…

X AI KOLs Timeline · 2026-07-22 缓存

CNBC和Statista发布了2026年全球40家顶级金融科技公司的年度榜单,涵盖8个子垂直领域。

0 人收藏 0 人点赞
#ranking

超越以相关性为中心的检索:基于评分标准的文档集选择与排序

Hugging Face Daily Papers · 2026-07-22 缓存

本文提出了一种以评分标准为导向的框架,用于评估和优化面向大语言模型的文档集,包括一个新的基准测试和一个无需训练的方法,该方法能提升下游生成性能。

0 人收藏 0 人点赞
#ranking

基于偏好的抗体表达排序:利用大规模弱监督进行扩展

arXiv cs.LG · 2026-07-21 缓存

本文提出了一种基于偏好的学习框架,用于抗体表达排序,将稀缺的定量数据与来自免疫序列的大规模弱正监督相结合。该方法通过引入联合掩码对数似然近似和基于IMGT的比对,将直接偏好优化(DPO)适配到蛋白质语言模型,从而在多样化的内部数据集上实现了改进的排序性能。

0 人收藏 0 人点赞
#ranking

谷歌已完全跌出前15名

Reddit r/LocalLLaMA · 2026-07-20

谷歌在一项重要的科技排名中跌出前15,标志着其竞争地位的显著下滑。

0 人收藏 0 人点赞
#ranking

根据Agent Arena,Kimi K3的排名与opus thinking处于同一水平

Reddit r/LocalLLaMA · 2026-07-20 缓存

Kimi K3在Agent Arena排行榜上获得了与opus thinking同等的排名。

0 人收藏 0 人点赞
#ranking

@karminski3: 接招: 卷我们最擅长了 国模这波直接霸榜了 OpenRouter 上周和本周的 Top6 用量模型. 与去年7月份可以说是两极反转了, 那个时候破圈的只有DeepSeek和Qwen. 现在用量第一的是腾讯混元3的免费版 (可以配置到龙虾里…

X AI KOLs Timeline · 2026-07-14 缓存

中国AI模型在OpenRouter上周和本周用量Top6中霸榜,其中腾讯混元3免费版排名第一,小米MiMo-V2.5和DeepSeek-V4-Flash分别位居前列,反映出国产模型在开源社区的影响力显著提升。

0 人收藏 0 人点赞
#ranking

RUBRIC:面向不平衡分类的实况-效用均衡排序方法

arXiv cs.LG · 2026-07-14 缓存

RUBRIC是一个与生成器无关的过滤框架,用于不平衡分类,通过平衡实况(通过判别器)和效用(基于边界的评分)来选择合成样本,在信用卡欺诈检测等基准上提高了F1宏观和召回率。

0 人收藏 0 人点赞
#ranking

使用确定性真实标签评估长文本生成中的LLM不确定性

arXiv cs.AI · 2026-07-07 缓存

引入SALT,一个具有确定性真实标签的基准,用于在长文本生成中评估LLM在细粒度原子级别的不确定性。对超过50个LLM的分析揭示了关于置信函数、错误传播以及与推理权衡的见解。

0 人收藏 0 人点赞
#ranking

中国超级计算机LineShine登顶全球超算排行榜

Reddit r/singularity · 2026-06-28 缓存

中国超级计算机LineShine夺得全球超算排行榜榜首,标志着高性能计算领域的一项重大成就。

0 人收藏 0 人点赞
#ranking

用统计学方法找到最佳狗零食

Hacker News Top · 2026-06-22 缓存

通过成对比较实验,使用Bradley-Terry模型和Elo评分系统统计确定狗狗最喜欢的零食。

0 人收藏 0 人点赞
#ranking

@onusoz: 我创建了一个基于Hugging Face下载量和点赞数的LLM排行榜,进行了分组、筛选和时间平均。前5名…

X AI KOLs Following · 2026-06-20 缓存

一个基于Hugging Face下载量和点赞数的LLM排行榜,经过分组、筛选和时间平均,突出了Qwen和Gemma等最受欢迎的模型。

0 人收藏 0 人点赞
#ranking

与彼得·蒂尔关联的Dialog俱乐部如何秘密对成员进行排名

Wired · 2026-06-18 缓存

WIRED揭露,彼得·蒂尔旗下的私人俱乐部Dialog依据财富和声望,使用隐藏的A、B、C分级系统秘密对成员进行排名,追踪人际关系并运用算法管理出席和座位安排,依据一份泄露的包含近200位知名人士的数据档案。

0 人收藏 0 人点赞
#ranking

OneRank:面向多任务推荐的统一原生Transformer排序架构

Hugging Face Daily Papers · 2026-06-15 缓存

OneRank提出了一种原生Transformer的多任务排序框架,该框架将特征编码与预测相结合,以减少任务间干扰并提升推荐系统中的排序性能。

0 人收藏 0 人点赞
#ranking

Representation Curriculum: 分阶段训练以实现稳健排序与分配

arXiv cs.LG · 2026-06-10 缓存

本文提出Representation Curriculum (RC),一种训练时干预方法,通过分阶段利用特征来减少对曝光混杂历史信号的过度依赖,并改善排序系统中的冷启动泛化能力。该方法经过了理论分析,并在公开基准和大规模eBay搜索实验中得到了验证。

0 人收藏 0 人点赞
#ranking

TOPSIS-RAD:基于期望的排序

arXiv cs.AI · 2026-06-08 缓存

本文提出TOPSIS-RAD,这是TOPSIS方法的一种改进版本,引入了决策者定义的参考水平(VPL和DPL),以解决与偏好不一致、异常值敏感性和排名逆转等问题。

0 人收藏 0 人点赞
#ranking

将数据驱动预测与分配对齐:一种以决策为中心的生存分析方法

arXiv cs.LG · 2026-06-03 缓存

本文介绍了一种面向决策的生存分析学习方法,该方法通过NDCG优化将预测模型与后续分配决策对齐。应用于美国心脏移植数据后,排名性能提升了50-100%,每年可能带来数千额外生命年。

0 人收藏 0 人点赞
#ranking

@RuiTheBaker: GPT 5.5级别的排名,但快27倍?!@mixedbreadai

X AI KOLs Following · 2026-06-02 缓存

根据早期结果,Mixedbread 的重排序器在 OBLIQ-bench 上达到了 GPT 5.5 级别性能,同时速度快 27 倍。

0 人收藏 0 人点赞
#ranking

云端代理使用量激增

Reddit r/ArtificialInteligence · 2026-05-31

云端代理的token使用量正经历爆炸性增长,其中GitLawb以1640亿个token遥遥领先,标志着代理采用率的回升。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈