← 返回首页

Minis体验与识图局限

发布时间: 2026-08-09 16:14(北京时间)

摘要: 作者分享Open Minis在iOS与安卓双端的使用体验,指出其高性价比但受限于非多模态模型无法识图,并探讨通过Tesseract OCR作为临时方案。同时对比了双端系统环境差异,语调客观冷静,注重技术细节与解决路径。

标签: 产品体验, AI局限, 技术方案, 双端对比, 冷静

字数: 540

原文链接: /7402396589/RcBovgpJp

群里不少朋友也开始使用 Open Minis 了,我自己也在双端体验了下。

Minis 搭配 deepseek-v4-flash 目前来看性价比很高,但后续会有“涨幅较大”的价格上调。但如果只接入 deepseek,有个很大的问题是不能传图,因为这不是多模态模型。

这个事情暂时没有比较好的解决办法,因为 Minis 不支持多配一个视觉模型专门用于读取图像。不过,issues/182 已经有人提了,团队也表示在计划中。

除去图片识别的问题(这其实是模型的支持问题),Minis 做事还是蛮舒服的。不管是 iOS 端还是安卓端,用户态都是 Alpine Linux,只不过 iOS 是基于 iSH 而安卓是走的 PRoot 方案。

在 Alpine 上能做的事情就多了,能跑原生 Python,也能编译 C++ 和 Rust。另外,如果刚才说的“识图”只需要 OCR 功能,还可以让 Minis 通过 apk add tesseract-ocr 安装 tesseract。

安卓上如果获取内核版本以及 uname -v 会得到真实的信息,但在 iOS 上获取的话就全是梗。
内核版本是 4.20.69-ish 而 uname -v 是 “SUPER AWESOME”。