data-science

标签

Cards List
#data-science

@KirkDBorne:学习Python的NumPy库… 链接:https://amzn.to/465HI6k 和 http://numpy.org/learn/ #DataScience #DataScienti…

X AI KOLs Timeline · 2026-07-20 缓存

关于学习Python的NumPy库的推广推文,链接到官方指南书和numpy.org/learn网站。

0 人收藏 0 人点赞
#data-science

DSWorld:面向高效自主代理的数据科学世界模型

arXiv cs.AI · 2026-07-20 缓存

DSWorld 提出了一种数据科学世界模型,通过预测环境状态转换来减少自主代理中代价高昂的试错过程,在强化学习训练中实现了14倍加速,推理时加速3-6倍,同时保持了有竞争力的性能。

0 人收藏 0 人点赞
#data-science

面向开发者的数据工具生态指南

Hacker News Top · 2026-07-16 缓存

这是一份为不熟悉数据工具的软件开发人员提供的全面指南,涵盖数据生命周期、数据职业和工具生态,并融合了作者在 Deepnote 和 Metabase 的经验见解。

0 人收藏 0 人点赞
#data-science

数据科学中的数学

arXiv cs.LG · 2026-07-15 缓存

本书涵盖数据科学的数学基础,包括高维分析、奇异值分解(SVD)、主成分分析(PCA)、回归、图论、聚类、深度学习等。

0 人收藏 0 人点赞
#data-science

@DataScienceDojo: 传统RAG管道一次检索上下文,然后生成响应。𝐀𝐠𝐞𝐧𝐭𝐢𝐜 𝐑𝐀𝐆 增加了决策层…

X AI KOLs Timeline · 2026-07-14 缓存

解释传统RAG与Agentic RAG的区别,强调Agentic RAG增加了决策层以实现迭代检索和多源推理,并提到即将举办的训练营。

0 人收藏 0 人点赞
#data-science

@ParamSiddh: AI-ML 从零开始路线图 https://github.com/aadi1011/AI-ML-Roadmap-from-scratch?tab=readme-ov-file…

X AI KOLs Timeline · 2026-07-13 缓存

一个 GitHub 仓库,提供全面模块化的路线图以及免费资源,涵盖从零开始学习 AI、ML、深度学习及相关领域所需的知识,包括数学基础、数据科学和生成式 AI。

0 人收藏 0 人点赞
#data-science

@DanKornas: AI Expert Roadmap 该终极AI存储库包含以下路线图:人工智能、机器学习、深度…

X AI KOLs Timeline · 2026-07-12 缓存

推广一个名为“AI Expert Roadmap”的存储库,该库为人工智能、机器学习、深度学习、数据工程、大数据和数据科学提供了结构化的学习路径。

0 人收藏 0 人点赞
#data-science

@DanKornas: 最佳Python机器学习资源合集 汇集了880个优秀开源项目,涵盖数据可视化、NLP、时间序列等领域…

X AI KOLs Timeline · 2026-07-10 缓存

精心整理的880个优秀Python机器学习开源项目合集,覆盖自然语言处理、数据可视化和时间序列等多个领域。

0 人收藏 0 人点赞
#data-science

CausalDS:在数据科学智能体中进行因果推理的基准测试

arXiv cs.AI · 2026-07-10 缓存

介绍CausalDS,一个用于评估基于LLM的数据科学智能体中因果推理的基准。它利用合成结构因果模型和自然语言故事测试关联、干预和反事实推理,以及工具使用和弃权。

0 人收藏 0 人点赞
#data-science

LLM生成的技能能否让AI数据科学家表现更佳?数据科学工作流的组件消融研究

arXiv cs.AI · 2026-07-09 缓存

本文研究了LLM生成的可复用技能文件是否能在数据科学工作流中提升AI数据科学家的表现。通过涉及超过9000次运行的广泛消融实验,作者发现生成的技能相较于基线提示并未带来显著改进,因此提醒不要默认使用它们。

0 人收藏 0 人点赞
#data-science

跨真实数据集的本福特定律交互式探索工具

Hacker News Top · 2026-07-08 缓存

对本福特定律进行交互式探索,解释数字1作为首位数字出现约30%时间的数学现象,及其在欺诈检测中的应用。

0 人收藏 0 人点赞
#data-science

风险比与寿命

Hacker News Top · 2026-07-06 缓存

本文解释了健康研究中的风险比,为什么不能在不考虑风险随时间分布的情况下直接将其转换为预期寿命变化,并阐明了风险比与相对风险之间的区别。

0 人收藏 0 人点赞
#data-science

@mdancho84: 80%的数据科学家错误地使用Claude Code。他们打开仓库,索要代码,接受第一个看似合理的答案……

X AI KOLs Timeline · 2026-07-05 缓存

一条推文讨论了许多数据科学家如何误用Claude Code,并推广了一个受Andrej Karpathy观察启发而创建的CLAUDE.md文件,以改善AI编码行为。

0 人收藏 0 人点赞
#data-science

@Jolyne_AI: 网上的机器学习教程常见两种极端:要么满屏公式、讲得抽象难啃;要么只教你调框架、原理一笔带过。结果学完能跑代码,却抓不住算法的核心。 我在 GitHub 上挖到一本开源免费电子书《Applied Machine Learning in Py…

X AI KOLs Timeline · 2026-07-05 缓存

推荐一本开源免费的电子书《Applied Machine Learning in Python》,它结合数学推导和Python实现,覆盖30+算法,并提供交互式可视化,适合系统学习机器学习原理和实战。

0 人收藏 0 人点赞
#data-science

@_vmlops:一位开发者在他的机器学习面试过程中获得了Google、LinkedIn、Snap、Coupang和StitchFix的录用通知。这种洞察……

X AI KOLs Timeline · 2026-07-04 缓存

一位开发者在GitHub上免费发布了他的机器学习面试准备指南,基于他从Google、LinkedIn、Snap、Coupang和StitchFix收到的真实问题,涵盖学习计划、编程、统计、系统设计等;该仓库现已获得12.4k星标。

0 人收藏 0 人点赞
#data-science

面向数据工程、分析与科学领域的编程代理

Reddit r/AI_Agents · 2026-07-03

介绍一款全新的编程代理,旨在辅助数据工程、分析与科学任务。

0 人收藏 0 人点赞
#data-science

AgenticDataBench:面向数据代理的综合性基准测试

Hugging Face Daily Papers · 2026-07-02 缓存

介绍了AgenticDataBench,这是一个综合性基准测试,用于评估基于大语言模型的数据代理在不同领域中的表现,提供细粒度、基于技能的指标,包括实际B2B用例和合成任务。

0 人收藏 0 人点赞
#data-science

Clusy

Product Hunt · 2026-06-30

Clusy 是一个面向现代数据科学的AI笔记本平台。

0 人收藏 0 人点赞
#data-science

@0xQiYan: 这 10 个免费工具,随便拎出来一个,都能把年费几万块的商业软件按在地上摩擦。建议收藏! 而且它们全出自大学和研究机构之手——没花你一分钱,却撑起了半个互联网。 --- 1. Zotero 乔治梅森大学出品。帮你一键保存、整理读过的每一篇…

X AI KOLs Timeline · 2026-06-29 缓存

A curated list of 10 free, open-source tools developed by universities and research institutions that rival expensive commercial software, covering reference management, databases, big data, scientific computing, machine learning, document preparation, online learning platforms, and statistical analysis.

0 人收藏 0 人点赞
#data-science

使用J语言建模COVID-19疫情

Lobsters Hottest · 2026-06-28 缓存

本文演示如何使用J编程语言实现的SEIRS模型对COVID-19疫情进行建模,并解释所涉及的状态和变量。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈