model

标签

Cards List
#model

攻击性语言检测的跨域泛化代价

arXiv cs.CL · 2天前 缓存

本文提出了一个用于攻击性语言检测中跨域和跨语言泛化的诊断与优化框架,将性能下降分解为数据集效应和语言效应,并量化了多语言能力与源任务性能之间的权衡。

0 人收藏 0 人点赞
#model

Meta 已确认未来将发布开源模型

Reddit r/LocalLLaMA · 3天前

Meta 确认了未来发布开源 AI 模型的计划,表明其对开源 AI 开发的持续投入。

0 人收藏 0 人点赞
#model

@swyx: Qwen Image 3 宣布推出。这些图片并非截图。全部单次生成。最后一张(图像标注……

X AI KOLs Following · 2026-07-21 缓存

Qwen Image 3,一款新的图像生成模型,宣布推出。它能单次生成图像,可能催生多个教育科技/工业培训初创公司。

0 人收藏 0 人点赞
#model

@VikParuchuri:Marker 由新的 Surya OCR 2 模型驱动(https://github.com/datalab-to/surya…),该模型是在参数量低于 1B 的模型中得分最高的…

X AI KOLs Timeline · 2026-07-21 缓存

Datalab 宣布推出 Surya OCR 2,这是一个 650M 参数的 OCR 模型,在 olmOCR 基准测试中,参数量低于 1B 的模型里取得了最高准确率,同时速度快且支持多语言。

0 人收藏 0 人点赞
#model

openbmb/MiniCPM-RobotTrack

Hugging Face Models Trending · 2026-07-18 缓存

OpenBMB发布了MiniCPM-RobotTrack,这是一个基于MiniCPM4-0.5B构建的紧凑型视觉-语言-动作模型,用于自然语言条件的目标跟踪,在unitree Go2上实现5+ FPS,并采用质量驱动的自进化数据和高效的板载推理。

0 人收藏 0 人点赞
#model

Thinking Machines 的 Inkling 现已成为美国排名第一的开放权重模型

Reddit r/LocalLLaMA · 2026-07-15

Thinking Machines 的 Inkling 模型在美国开放权重模型中排名第一。

0 人收藏 0 人点赞
#model

@gdb: Sol 正在发生一些特别的事情:

X AI KOLs Following · 2026-07-15 缓存

InvincibleHunter 声称 GPT-5.6 Sol 是有史以来最令人印象深刻的模型,在数学和视觉能力上有巨大改进,超越了其他模型。

0 人收藏 0 人点赞
#model

Show HN: 过去10届世界杯,我的模型的两个首选每次都猜中冠军

Hacker News Top · 2026-07-15

一个模型的两个首选准确预测了过去10届世界杯的冠军。

0 人收藏 0 人点赞
#model

@Saboo_Shubham_: 掌控Agent学习循环,租赁模型。私有评估、追踪和记忆是累积的关键。

X AI KOLs Timeline · 2026-07-13 缓存

掌控Agent学习循环并租赁模型;私有评估、追踪和记忆会随时间累积。

0 人收藏 0 人点赞
#model

@jiayuan_jy: Codex 实践下来一个最节省 usage 的配置: - 模型 5.6 Sol - Effort 选择 Extra High 或者 Max - Speed 选择 Standard Ultra 很难用(只是会 spawn 多个 sub ag…

X AI KOLs Following · 2026-07-12 缓存

分享Codex最节省用量的配置:模型使用5.6 Sol,Effort选择Extra High或Max,Speed选择Standard。Ultra Speed效果差,Fast太耗token。

0 人收藏 0 人点赞
#model

@FinanceYF5: Alexandr Wang 表示,Muse Spark 1.1 是一款具备行业竞争力的 Agentic 和编程模型。 在多个 Agentic 评测中,它可以与 GPT-5.5 和 Opus 4.8 相抗衡。 目前已经可以通过新的 Meta…

X AI KOLs Following · 2026-07-11 缓存

Alexandr Wang 表示,Muse Spark 1.1 是一款具备行业竞争力的 Agentic 和编程模型,在多个评测中可与 GPT-5.5 和 Opus 4.8 抗衡,现可通过 Meta Model API 和 Meta AI 使用。

0 人收藏 0 人点赞
#model

prism-ml/Ternary-Bonsai-27B-mlx-2bit

Hugging Face Models Trending · 2026-07-04 缓存

Prism ML 发布了 Ternary-Bonsai-27B-mlx-2bit,这是一个三元量化的 27B 参数语言模型,在约 7.2 GB 内存下实现了 FP16 性能的约 95%,使笔记本电脑能够进行完整推理。

0 人收藏 0 人点赞
#model

Dspark 与 Qwen 3.6 27b?

Reddit r/LocalLLaMA · 2026-07-03

在 Dspark 背景下提及 Qwen 3.6 27b 模型。

0 人收藏 0 人点赞
#model

Goku:百万规模通用数据集与指令驱动视频编辑基准

Hugging Face Daily Papers · 2026-06-30 缓存

本文介绍了Goku,一个百万规模的指令驱动视频编辑数据集与基准,支持多任务和结构性操作。配套的模型Goku-Edit在指令遵循方面比开源模型提升了高达8%。

0 人收藏 0 人点赞
#model

DataClaw0:从原始流中智能裁剪多模态数据

Hugging Face Daily Papers · 2026-06-19 缓存

DataClaw0提出了一种智能数据裁剪范式,利用可学习的数据处理来结构化高熵多模态流,通过在一个新型基准上进行SFT和GRPO实现了稳健的对齐。

0 人收藏 0 人点赞
#model

Alpie Core 32B, 4位:任何真实智能体工作流测试或仅供应商基准测试?

Reddit r/AI_Agents · 2026-06-11

文章质疑了Alpie Core 32B(一个针对低显存和智能体工作流优化的4位推理编码模型)的供应商基准测试的有效性,指出缺乏独立的基准测试复现。

0 人收藏 0 人点赞
#model

@maximelabonne: 我们在@huggingface上火了!说实话,我们低估了这个模型。它在代理任务上的能力远超我的预期。…

X AI KOLs Following · 2026-06-01 缓存

Maxime Labonne分享说,他们的模型在Hugging Face上成为热门,并且尽管只有1B个活跃参数,但在代理任务上出人意料地强大。

0 人收藏 0 人点赞
#model

@LottoLabs: 我很担心Qwen 3.7 27b无法发货

X AI KOLs Following · 2026-05-31

一位用户对Qwen 3.7 27b模型可能无法发货表示担忧。

0 人收藏 0 人点赞
#model

@malikwas1f:1/ Qwen3.6-27B 已悄然成为本地模型——也是 Hugging Face 上整个衍生生态系统的基础(fi…

X AI KOLs Timeline · 2026-05-25 缓存

该推文对 Qwen3.6-27B 的思考模式与非思考模式进行了 300+ 问题的基准测试,揭示了这款热门本地模型及其在 Hugging Face 上的衍生生态系统的惊人结果。

0 人收藏 0 人点赞
#model

OAI研究员谈Erdos问题:“这是迄今为止AI史上最大的成就。到年底时,它看起来会像个小成就。”(系好安全带)

Reddit r/singularity · 2026-05-21

一位OpenAI研究员声称,其模型对离散几何中一个Erdős问题的解决是迄今为止AI领域最大的成就,但预测到年底时这一成就将被超越。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈