视觉化AI模型指纹

Reddit r/AI_Agents 工具

摘要

一位开发者正在创建一种方法,通过使用随机矩阵理论分析权重和张量来视觉化AI模型的指纹,并使用QWEN2.5模型的数据,他对开源该工具感兴趣。

好了,所以我做了一些研究。我发现没有模型能力的视觉化表示,只有基准测试的指标,这在实践中并不能说明太多问题。因此,我正在研究一种通过张量扫描和权重评估来检查模型功能的方法。这源于2024年的RMT研究,使用Alpha值映射到模型每个层类型的一个频带。我有来自QWEN2.5 4b bf16、q8km和q4km ggufs的数据。我必须自己编写脚本,因为weightwatch没有任何量化值的数据,也不支持他们的数据集。所以我正在自己深入研究这些数据,并尝试为模型的每一层制作一个使用潜力的热图。这个方法的作用是:首先运行权重,获取它们的值的映射,以对每个张量值进行比对。然后运行每个张量,映射直接存储在权重中的值的利用率。它返回模型在推理过程中每一层和块的Alpha值。它不会启动模型并询问问题。它直接扫描构成模型的矩阵,与驱动其推理的权重进行比对。到目前为止,量化还没有影响模型的Alpha值。这是低参数模型,所以我需要将其与高参数模型一起运行,以验证我在小模型上看到的内容的完整性。但唯一的偏差出现在第31块(最后一块)。作为开源项目,这会是人们感兴趣的东西吗?我做这个主要是为了在我的自定义框架中让我的模型工作得更好,并找出低参数模型中冗长性是如何确定的。如果你感兴趣,你是否有过低参数模型在没有冗长性的情况下工作得非常好的经历?你是否运行过低参数模型作为代理?如果是,是哪些?我想对它们进行指纹识别,并获得一个良好的详细图谱,附带描述性使用数据。
查看原文

相似文章

@ryaneshea: 今天我发布了 AI IQ —— 前沿 AI 模型,按照人类智商量表进行评分。摒弃无尽的排行榜表格,AI IQ 展示了:• 模型在智商正态分布曲线上的位置 • 前沿智商随时间的变化 • 模型在智商和情商方面的对比 • 实践中获取智能的成本。包括 GPT-5.5、Claude Opus 4.7、Gemini 3.1、Grok 4.3、Kimi K2.6、Qwen 3.6、DeepSeek V4、Muse Spark 等。链接在首评中。好奇哪张图表最让你惊讶。

X AI KOLs Following

作者推出了“AI IQ”,这是一款新工具,按人类智商量表对前沿 AI 模型进行评分,提供模型性能、智能成本以及情商对比的可视化图表,而非传统的排行榜表格。

新技巧揭示AI模型的内心想法

Wired

研究人员发现了一种通过API从前沿AI模型中提取隐藏推理痕迹的方法,暴露了个人信息泄露风险,并使大规模蒸馏攻击成为可能。研究结果还表明,美国模型的推理能力可能被蒸馏到中国模型Kimi K3中,但尚无定论。

从具体到抽象的人工智能:向大众揭开人工智能的神秘面纱

arXiv cs.AI

本文介绍了一种名为 AIcon2abs 的方法论,该方法结合了可视化编程与 WiSARD 无权重神经网络,通过动手实践活动帮助普通大众(包括儿童)理解人工智能概念。该方法将训练与分类作为一等编程构件,使学习型机器与传统程序之间的区别更加直观易懂。