@DanKornas: 如果机器学习只有在你自己构建各个部分时才能真正理解,那么这个仓库值得收藏。构建你自己的...
摘要
一个提供从零开始构建机器学习教程的GitHub仓库,使用NumPy,按类别组织,采用实现优先的方法。
如果机器学习只有在你自己动手构建每个部分时才能让你真正理解,那么这个仓库值得收藏。Build your own X - Machine Learning 是一个公开的从零开始构建机器学习的教程索引,适合希望获得实践经验的学习者和开发者。它通过将机器学习主题按类别组织,并为核心算法提供多个NumPy示例,帮助你从阅读算法过渡到编写算法。主要特点: • 从零开始的路线图 – 从线性/逻辑回归和KNN开始,然后扩展到深度学习和LLM主题 • 核心Python示例 – 包含回归、KNN、损失函数和激活函数的NumPy代码 • 类别导航 – 将想法分组到推荐系统、计算机视觉、NLP、预测、异常检测等领域 • 实现优先学习 – 符合README中从零开始构建机器学习模块的目标 • 持续更新的教程列表 – README表示会不断添加新教程 该项目是开源的(Apache-2.0许可证)。回复中有链接
相似文章
PostgreSQL 正则表达式的新增特性 (pg_tre 和 pg_re2)
本文探讨了用于增强正则表达式索引的新 PostgreSQL 扩展 pg_tre 和 pg_re2,展示了在大型数据库测试中相较于传统方法(如 pg_trgm)的显著性能提升。
@jakevin7: 加入 Apache 后,Maka 终于成功发布了一个版本。整个社区正变得越来越活跃…
Apache Maka,一个在 Apache Software Foundation 孵化的 AI 代理工作空间,已发布一个版本,社区参与度不断增长,特色包括本地优先设计和工具执行能力。
Harness Arena - 开源代理工具盲测基准
Harness Arena 是一个开源的盲测基准工具,旨在比较各种AI代理工具在受控、匿名条件下的表现,以提供公平评估并邀请社区贡献。
Pangram已成为AI检测的黄金标准。你是否应该信任它?
本文探讨了Pangram,一家检测AI生成文本的AI初创公司,它在出版丑闻中的角色,以及对其检测模型可信度的质疑。
在两块 Tesla P40 上运行双模型文学翻译流水线:gemma-4-26B-A4B 达到约 40 词元/秒,配合 MTP 规范解码的 Qwen3.6-35B-A3B 则达到 50-70 词元/秒——完整 llama-server 参数见下文。
该文章详细介绍了一款名为"Sunny Narrator"的开源工具,该工具利用基于Tesla P40 GPU的双模型AI流水线翻译小说,并通过优化的llama-server配置与MTP投机解码技术,实现了每秒40-70个token的生成速度。