@tarat_211: 我制作了一个关于我第一次真正尝试进行机器学习研究的视频。我从一个关于修剪视觉语言模型的简单问题开始…

X AI KOLs Timeline 论文

摘要

一位研究者制作了一个视频,讲述他们首次尝试对视觉语言模型进行修剪的机器学习研究,包含负面结果,并将论文提交至arXiv。

我制作了一个关于我第一次真正尝试进行机器学习研究的视频。 我以一个关于修剪视觉语言模型的简单问题开始,花费数周时间以不同方式破坏Qwen2.5-VL和SmolVLM2,遇到了一系列负面结果,最终将我的第一篇论文提交到了arXiv。https://t.co/berWTRdcvH
查看原文
查看缓存全文

缓存时间: 2026/07/21 01:36

我制作了一段视频,讲述我首次真正尝试进行机器学习研究的过程。我从一个关于剪枝视觉语言模型的简单问题开始,花了数周时间以不同方式破坏Qwen2.5-VL和SmolVLM2,遇到了大量负面结果,最终将我的第一篇论文提交到了arXiv。https://t.co/berWTRdcvH

相似文章

我为前沿 LLM 构建了一套设备优先(device-first)的确定性架构层,相关研究已公开发表。正在寻找能运行一次小范围测试并反馈结果的人。[P]

Reddit r/MachineLearning

作者们发布了一篇关于 IQRAX 的研究论文。IQRAX 是一种以设备为优先的确定性架构层,将概率性的 LLM 推理与确定性的权威判定分离开来,据称可将成本降低 11.5 倍,并将任务完成速度提升 48.3 倍。他们正在邀请社区对长模型对话运行失败检测测试,并提交测试结果。