本地 AI 与开源实践
olmOCR 适合你的 PDF 吗?先做一轮可复现的转文本验收
olmOCR 可以作为 PDF 线性化和 LLM 数据准备的开源起点,但不能跳过文档分层、关键字段验收和数据边界检查。
栏目
这里关注可以在本地运行、检查或自行部署的 AI 模型与开源工具。文章会记录硬件要求、数据路径、安装边界、兼容性和可复现验收,区分“代码开源”“权重可用”和“真正适合本地工作流”,帮助你在隐私、成本、性能与维护负担之间做取舍。
4 篇文章
olmOCR 可以作为 PDF 线性化和 LLM 数据准备的开源起点,但不能跳过文档分层、关键字段验收和数据边界检查。
从 macOS 版本、Intel/Apple Silicon、语言模型、权限、存储和云端增强边界出发,判断 FluidVoice 是否适合你的 Mac;不把未经实测的速度或准确率当结论。
Kimi K3 已接入 Kimi、Kimi Code 和 API,但完整权重尚未发布。用一张决策矩阵判断现在该试用、接 API 还是等待自部署。
Google AI Edge 把 Gemma 4 12B、Mac 本地应用和 LiteRT-LM serve 组合起来。本文解释 16GB 笔记本上的本地 Agent 到底新在哪里,以及哪些能力仍需自己验证。