@krzyzanowskim: Swift 很快,但当我将类重写为 Objective-C 后,变化为:在 1M 单位时,21.3 ms → 95 µs;在 67K 时,384 µs → 6.4 µs。
摘要
这篇文章突出了一项性能基准测试,其中将代码从 Swift 重写为 Objective-C 大幅提升了执行时间,对于大型数据集,从毫秒级缩短到微秒级。
Swift 本身很快,但当我将类重写为 Objective-C 后,变化为:在 1M 单位时,21.3 ms → 95 µs;在 67K 时,384 µs → 6.4 µs。
没有可比性。进行 1:1 重写。
查看缓存全文
缓存时间: 2026/09/24 06:19
Swift 速度很快,而当我用 Objective-C 重写该类并对比后,发现性能变化惊人:100万次操作下从21.3毫秒降至95微秒,6.7万次操作下则从384微秒降至6.4微秒。
两者根本不在一个量级。这是逻辑1:1重写的结果。
相似文章
Apple 使用 Swift:迁移 TrueType Hinting 解释器
Apple 将 TrueType Hinting 解释器从 C 语言迁移到 Swift,实现了内存安全并提升了 13% 的性能。源代码已开源。
@no_stp_on_snek: 还有人谈论 mlx-swift-lm 吗?说我在休息一天……清理了鸡舍,锻炼了一下,然后…
作者描述了将 TurboQuant KV-cache 压缩集成到 Apple 的 mlx-swift-lm 中,实现了 2.7 倍压缩,质量与 8-bit 相当,并通过融合 Metal 内核将解码速度提升了 3-4 倍。
Apple 内部:内核中的 Swift
Apple 已开始通过一项名为 KernelKit 的新工作将 Swift 集成到内核中,嵌入式 Swift 运行时出现在 macOS 和 iOS 中,标志着向内存安全内核扩展迈出了一步。
@no_stp_on_snek:在自定义Rust内核和Swift调度领域忙碌的一晚。9个PR中有3个是真正新增或修改的Metal内核……
在自定义Rust内核和Swift调度逻辑的优化下,Qwen3.6-35b-A3B模型的预填速度在2k提示下从255 tok/s提升到1058 tok/s,实现了约4倍的加速,解码和困惑度未受影响。
用 Swift 训练大语言模型,第一部分:将矩阵乘法从 Gflop/s 提升到 Tflop/s
作者详细介绍了在 Apple Silicon 上优化 Swift 自定义矩阵乘法内核以训练大语言模型的过程,旨在通过利用 CPU、SIMD、AMX 和 GPU 能力,实现超越 C 实现的性能。