clustering

标签

Cards List
#clustering

利用图神经网络优化基于启发式的比特币地址聚类

arXiv cs.LG · 4天前 缓存

本文提出了一种图神经网络方法,用于优化基于启发式的比特币地址聚类,发布了一个数据集,并引入了层次聚类以更好地分析可疑合并。

0 人收藏 0 人点赞
#clustering

Exo labs 声称通过 m5u Mac Studio 集群实现 4.8 TB/s 内存带宽

Reddit r/LocalLLaMA · 2026-08-29

Exo labs 声称通过使用其 RDMA 解决方案对 Mac Studio 进行集群,实现了 4.8 TB/s 的内存带宽,这可能会显著提升 AI 推理性能。这篇 Reddit 讨论探讨了对考虑 AI 工作负载硬件配置的用户的影响。

0 人收藏 0 人点赞
#clustering

@paul_cal: "你没有看到四个集群吗?"

X AI KOLs Timeline · 2026-08-27 缓存

来自@paul_cal的一条推文,质疑可视化中的集群数量,@ArtemisConsort认为定义三个集群是任意的。

0 人收藏 0 人点赞
#clustering

牛奶中红外光谱的元聚类分析识别与泌乳早期负能量平衡相关的奶牛群体

arXiv cs.LG · 2026-08-24 缓存

本研究使用牛奶中红外光谱的元聚类来识别与泌乳早期负能量平衡相关的奶牛群体,揭示了五个具有不同严重程度的明显聚类。

0 人收藏 0 人点赞
#clustering

斯里兰卡议会辩论的三语主题建模

arXiv cs.CL · 2026-08-24 缓存

本文提出了一种用于分析斯里兰卡议会辩论的三语主题建模框架,该框架利用基于LLM的文本提取和多语言嵌入来处理语码混杂文本,并在聚类纯度上优于传统方法。

0 人收藏 0 人点赞
#clustering

EdNet日志的学习策略聚类追踪参与度而非掌握度

arXiv cs.LG · 2026-08-19 缓存

该论文表明,来自EdNet日志的学习策略聚类可以预测学习者的参与度,但不能预测掌握度,强调仅基于行为的分析不足以评估知识获取。

0 人收藏 0 人点赞
#clustering

为决策就绪的ITSM智能设计AI流水线

arXiv cs.AI · 2026-08-14 缓存

本文提出了一种面向ITSM工单数据的社会技术AI流水线,结合基于LLM的模式归一化与聚类,生成面向高管的决策支持工件。利益相关者评估显示,在可解释性、可操作性、信任度及使用可能性方面均获得高分。

0 人收藏 0 人点赞
#clustering

GRACE: LLM-Grounded Semantic Metric Spaces for Scalable Mixed-Data Clustering

arXiv cs.AI · 2026-08-11 缓存

This paper introduces GRACE, a framework that uses LLM-generated semantic descriptions at the attribute-value level to create unified metric spaces for clustering mixed tabular data, achieving scalability comparable to statistical baselines while improving clustering accuracy.

0 人收藏 0 人点赞
#clustering

跨主题与媒体类型的概念隐喻发现

arXiv cs.CL · 2026-08-10 缓存

本文提出了一种无监督方法,用于提取语言隐喻并将其分组为概念隐喻,并将该方法应用于分析左倾与右倾播客之间的框架差异。

0 人收藏 0 人点赞
#clustering

TRIBE: Predicting Team Performance via Communication Behavior Ensembles

arXiv cs.AI · 2026-08-10 缓存

Introduces TRIBE, a domain-independent pipeline that uses topic modeling and clustering on team communication to predict performance early and analyze how AI agents alter team behavioral dynamics.

0 人收藏 0 人点赞
#clustering

社交媒体兔子洞、簇群及随机游走的相对混合时间

Lobsters Hottest · 2026-08-07 缓存

利用领域共现数据和PCA/t-SNE对Twitter社区结构进行分析,揭示了紧密的右翼和松散的左翼集群,对推荐系统和随机游走混合时间具有启示意义。

0 人收藏 0 人点赞
#clustering

关于次优势(极小极大)超度量的 Hamming-Lipschitz 型稳定性:理论与简单证明

arXiv cs.AI · 2026-08-06 缓存

本文为次优势(极小极大)超度量发展了一套 ℓ0 型稳定性理论,证明了稀疏编辑仅通过最小生成树传播,并导出了变更超度量条目的 Hamming-Lipschitz 界。在深度嵌入图和聚类任务上的实验表明,所得结构评分作为脆弱性诊断具有实用价值。

0 人收藏 0 人点赞
#clustering

@freeCodeCamp:聚类是无监督机器学习中的一项关键技术,可帮助你在数据中发现有价值的见解。……

X AI KOLs Timeline · 2026-08-05 缓存

freeCodeCamp 发布了一本关于 Python 聚类的综合手册,涵盖 K-means、层次聚类和 DBSCAN 聚类,并附有实现和可视化。

0 人收藏 0 人点赞
#clustering

来自6.6万集播客的叙事语义地图

Reddit r/ArtificialInteligence · 2026-08-03

作者构建了一个流水线,将6.6万集播客转录,提取并聚类超过70万个观点到二维语义地图中,用于追踪投资叙事,并过滤掉AI生成的内容。

0 人收藏 0 人点赞
#clustering

使用GMM和LLM通过定向数据增强进行不平衡数据聚类

arXiv cs.CL · 2026-08-03 缓存

本文提出了一种新颖的无监督数据增强方法,结合高斯混合模型和大语言模型,通过为代表性不足的聚类生成合成文档,改善不平衡文本数据集上的聚类效果。

0 人收藏 0 人点赞
#clustering

Archetypes or ability? Clustering for modelling student mathematical competence

arXiv cs.AI · 2026-07-31 缓存

This paper applies clustering methods, including a Bernoulli Mixture Model, to a large dataset of UK national-level exam results to test assumptions about discrete mathematical abilities, finding that overall student ability is the dominant factor in performance.

0 人收藏 0 人点赞
#clustering

从无监督子组到假设状态干预策略:观察性健康数据中选定子组方法的评估

arXiv cs.LG · 2026-07-30 缓存

本文评估了无监督子组方法与因果发现和政策评估相结合,用于观察性数据中的预算约束健康干预,发现在留出评估中没有单一方法始终优于其他方法。

0 人收藏 0 人点赞
#clustering

大数据K-means聚类的数据原生全局优化

arXiv cs.LG · 2026-07-20 缓存

提出Big-means++,一种简单的算法,通过系统性地整理输入并使用样本诱导的代理景观,实现大数据K-means聚类的全局优化质量。

0 人收藏 0 人点赞
#clustering

CRAFT:聚类评分标准以诊断弱项LLM能力并生成有针对性的微调数据

arXiv cs.AI · 2026-07-20 缓存

CRAFT将基于评分标准的评估转化为LLM的分层能力诊断,识别特定弱点并生成有针对性的微调数据,在四个开源模型的金融和法律基准上取得了更强结果。

0 人收藏 0 人点赞
#clustering

FastCentNN: 使用熵代理加速质心神经网络

arXiv cs.LG · 2026-07-16 缓存

FastCentNN 是质心神经网络的一种加速变体,它利用基于每个训练轮次质心移动的熵代理来触发早期分裂,从而将运行时间减少高达16%,同时保持聚类质量。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈