Lemonade v11.5支持ModelScope模型搜索与下载

端侧AI推理工具Lemonade在v11.5版本中迎来重磅更新,原生接入国内主流开源模型社区作为官方模型注册源,与Hugging Face并列成为两大官方模型库。开发者无需进行任何额外配置,即可通过单一搜索框同时检索、下载并运行来自两大平台的GGUF格式模型,大幅简化了跨平台模型调用的全流程。
对于AI开发者而言,模型生态的核心价值不仅在于储备的模型总量,更在于能否便捷地完成发现、下载与实际运行的全链路操作。此次更新后,Lemonade为开发者提供了更丰富灵活的模型选择空间,无论是本地开发还是跨区域的模型调用需求都能得到更好的适配。
该新增的模型源适配两类高频使用场景:一是部分开发者所在地区访问该社区镜像的速度更快,能够有效提升大模型文件的下载效率;二是部分前沿模型会优先在该社区首发,开发者可以第一时间获取最新的模型资源。
最值得称道的是整个使用流程完全零配置:既不需要额外注册账号,也不需要修改任何系统配置文件。开发者只需要三步即可完成模型获取:输入模型关键词搜索、选择对应的GGUF量化变体、点击下载等待任务执行,全程流畅无阻碍。同时,Lemonade还会提前校验目标模型仓库的实际文件结构,确认存在可用的GGUF文件后才会显示下载按钮,彻底避免无效下载,真正做到所见即所得,用户看到的每一条搜索结果都是可直接运行的可用模型。
如果通过图形客户端使用该功能,操作步骤十分直观:打开Lemonade客户端或者访问官方网页端,进入Model Manager模型管理器界面。输入模型名称(例如Qwen 2.5),输入三个字符后就会自动触发搜索,此时本地模型列表下方会出现两个全新的分区:分别标注为FROM HUGGING FACE和FROM 目标社区的结果。每条搜索结果在下载前会展示完整的信息,包括仓库名称、来源标识、下载体积以及社区拉取次数。如果需要更换量化规格,可以在下拉菜单中选择对应档位,系统默认预选的是Q4_K_M这一兼顾推理性能和资源占用的均衡选项,选择完成后点击下载等待任务执行即可。模型下载完成后会自动完成本地注册,立即可用:既可以在对话面板直接选中模型进行交互,也可以将兼容OpenAI协议的第三方客户端对接至服务中,操作方式和Lemonade中其他模型完全一致。一旦模型下载至本地,其来源仓库不会再影响后续的使用流程。
除了图形客户端外,CLI终端工具同样支持新增的模型社区。开发者可以使用lemonade pull命令拉取模型checkpoint,并通过--source参数指定来源,也可以直接粘贴该社区的模型URL,程序会自动解析剩余参数。例如从该社区拉取Qwen2.5-3B-Instruct-GGUF模型的完整命令为:
lemonade pull Qwen/Qwen2.5-3B-Instruct-GGUF --source modelscope
如果开发者是基于Lemonade Server构建自有应用,还可以通过REST API直接调用模型搜索能力,只需要发送一次GET请求即可获取结果。例如搜索qwen系列模型的API请求示例为:
curl "http://localhost:13305/v1/registry/search?source=modelscope&query=qwen"
此外,还可以添加format=gguf参数让搜索结果更偏向GGUF格式的仓库,也可以使用limit参数控制返回结果的数量(取值范围为1-50,默认值为12)。API的响应内容会包含模型的标签、任务类型、下载次数以及每个模型的GGUF相关提示信息,完整的接口结构可以参考官方API文档。
官方相关资源链接:
- 官方安装指南
- GitHub开源仓库
- 完整API文档
- 官方Discord社区:discord.gg/5xXzkMu8Zk

