@reach_vb: 我有大量个人副项目想用Sol处理:1. 优化llama.cpp中的MTP支持(寻找低垂果实…)
摘要
用户分享了使用Sol的计划:优化llama.cpp中的MTP支持、标准化聊天模板、恢复废弃的whisper项目、完成个人理财应用以及内核优化。
我有大量个人副项目想用Sol处理:
1. 优化llama.cpp中的MTP支持(寻找低垂果实)
2. 让Sol搞清楚各种开源运行器的聊天模板映射,并统一到HF transformers标准
3. 重启insanely fast whisper——它已经被废弃一年多!
4. 完成个人理财应用的所有银行和金融连接器,并发布它!
5. 更多内核优化!!!
查看缓存全文
缓存时间: 2026/07/02 10:20
我有一大堆个人副项目想用 Sol 来搞:
- 优化 llama.cpp 中的 MTP 支持(找出容易实现的效果)
- 让 Sol 理清各种开源运行环境之间的聊天模板映射关系,并将其标准化为 Hugging Face Transformers
- 找回极速 Whisper——它已经被弃用一年多了!
- 完成个人理财应用的所有银行和金融连接器(然后发布它)
- 更多内核优化!!!
Tibo (@thsottiaux): 等不及看大家用 GPT-5.6 Sol Ultra 能搞出什么花样了。把最难的提示词先存好。
相似文章
@swyx:我目前在大型项目上的进展:- sol ultra 计划中 - fable 5 评论中 - sonnet 5/terra ultra/swe 1.7 t…
Shawn Wang(@swyx)分享了他目前在几个AI和开发者项目上的关注点,包括Sol Ultra、Fable 5、Sonnet 5、Terra Ultra、SWE 1.7和Devin review,同时使用Kakuna等工具以及来自@mattpocockuk和@trq212的面试技巧。
@reach_vb: Hola!关于 Sol 使用模式的快速更新:我们已发布了几项改进,应能使典型的 Sol 使用时间延长约 18%……
Sol,ChatGPT Work 和 Codex 的 AI 助手,获得了提升,使其使用时间更长、效率更高,同时重置了使用限制并恢复了五小时限制。
@pcuenq: 我的数据点:使用 Pi + llama.cpp + Qwen-3.6-35B-A3B 并行处理两个项目(我更喜欢 MoE 模型)。这项工作……
有用户报告称,在较旧的 M1 Max 机器上使用 Pi 和 llama.cpp 配合 Qwen-3.6-35B-A3B 模型成功运行并行项目,证明了其实际可用性。
@bentlegen: 我:“嘿,Sol 审查这个 PR” Sol(10分钟后):“嗯,我审查了,决定做了5个修复,推送到远端,解除了CI阻塞,然后合并了……”
一个用户发推提到Sol,一个能自主审查PR、做修复、推送并合并的AI,质疑其他人是否注意到了这种行为。
@leopardracer: 这位美国开发者花了数周调试Ollama中的超时错误。然后他查看了底层——LM Studio只是……
一位开发者通过直接使用llama.cpp修复了Ollama中持续存在的超时错误,绕过了LM Studio和Ollama等封装层,在M1 Max上以262K上下文达到了53 tok/s。