data-mining

标签

Cards List
#data-mining

MINT: Tensor Decomposition on Stacked Recurrence Matrices for Time Series Data Mining

arXiv cs.LG · 6天前 缓存

This paper introduces MINT, a method that stacks recurrence (self-similarity) matrices of multiple time series into a tensor and applies tensor decomposition to mine co-clustered cross-sensor patterns. Experiments on transit, electricity, wind turbine, and traffic data show effective co-clustering of motifs in regular time series.

0 人收藏 0 人点赞
#data-mining

@LangChain:没看到?在@aiDotEngineer世界博览会上,@vtrivedy10登台分享了为什么从追踪数据中进行数据挖掘是公司构建理解其智能体、大规模整理数据并运行改进循环的最高效方式之一…

X AI KOLs Following · 2026-07-07 缓存

在aiDotEngineer世界博览会上,Vtrivedy10讨论了从追踪数据中进行数据挖掘是一种高杠杆率的实践,有助于理解AI智能体、大规模整理数据并运行改进循环。

0 人收藏 0 人点赞
#data-mining

@CycleDecoded: 别再花大价钱买那些破爬虫软件交智商税了!这几天有个开源工具简直离谱,直接把全网社交平台的数据底裤都给扒了,搞流量矩阵和数据变现的饭碗真危了! 这就是 GitHub 上狂砍 5.4 万+ 星标的超神开源项目 MediaCrawler。大白话…

X AI KOLs Timeline · 2026-06-30 缓存

MediaCrawler 是一个 GitHub 上 5.4 万+ Star 的开源多平台社交媒体爬虫工具,支持小红书、抖音、B站等 7 大平台的数据采集,具备多账号、IP 代理、断点续爬和 AI 集成等特性。

0 人收藏 0 人点赞
#data-mining

AnTenA: 基于大语言模型的可操作且可解释的张量分析系统

arXiv cs.CL · 2026-06-30 缓存

AnTenA 是一个可解释性系统,利用大语言模型为通过张量分解提取的隐藏模式生成自然语言解释,无需依赖可能不准确的标签或元数据。

0 人收藏 0 人点赞
#data-mining

@Vtrivedy10: 有一个非常令人兴奋的未来智能体配方,用于构建低成本到无需计量的智能,应用于提取信…

X AI KOLs Following · 2026-06-15 缓存

该帖子概述了一个未来智能体配方,通过微调高效、专业化的开源模型,在LLM-as-a-judge任务上超越前沿性能,并将其应用于从追踪数据中提取信号以实现持续学习。LangChain Labs 和 FireworksAI 发布了展示这一方法的新工作。

0 人收藏 0 人点赞
#data-mining

用于可扩展统计可靠数据挖掘的Few-Shot重采样方法

arXiv cs.LG · 2026-06-11 缓存

本文介绍了FewRS,一种基于重采样的方法,它大幅减少了统计可靠数据挖掘所需的重采样数据集数量,在保持严格错误发现控制和高统计功效的同时,实现了高达两个数量级的加速。

0 人收藏 0 人点赞
#data-mining

C-Mining:通过几何错位无监督发现文化数据合成的种子

arXiv cs.CL · 2026-04-20 缓存

C-Mining提出了一个无监督框架,通过利用嵌入空间中的跨语言几何错位来发现LLM训练数据中的文化种子,实现可扩展的合成数据生成以支持文化对齐,无需手动或LLM监督。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈