我做的skill,识别图片给大模型看的。

有些大模型不是多模态的,只能识别文本,关键是便宜。但是想截图给他,他不认识,于是就专门用python做了一个识别图片的,把图片描述给大模型,于是乎,也支持看图了。识别的都是本地,不用专门的大模型,不用token。自我感觉良好,分享给大家。

好家伙!