比较推荐的超低价格模型

几个超低成本甚至免费的模型推荐 最近准备整理一些价格极低,甚至完全免费的模型。先说结论:便宜模型不是用来替代 GPT、Claude、Gemini 顶级模型的,而是用来执行那些规则明确、流程固定、难度不高的任务。 本地部署:Qwen3.6 27B 自己

几个超低成本甚至免费的模型推荐

最近准备整理一些价格极低,甚至完全免费的模型。先说结论:便宜模型不是用来替代 GPT、Claude、Gemini 顶级模型的,而是用来执行那些规则明确、流程固定、难度不高的任务。

本地部署:Qwen3.6-27B

自己部署的话,我目前比较推荐 Qwen3.6-27B

这是一个27B参数的开放权重多模态模型,支持图片理解、工具调用和智能体任务。官方对它的定位也比较偏向实际开发、编程和工作流执行。

我个人一直觉得,Qwen系列在中文表达和语言理解方面比较有优势。对于内容整理、信息提取、格式转换、简单写作和固定工具调用,Qwen3.6-27B的能力基本已经达标。

最近比较火的一个变体是:

DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

名字虽然长得有点离谱,但它是基于Qwen3.6-27B制作的微调和合并版本,提供GGUF量化,可以通过 llama.cpp、Ollama、LM Studio 等方式运行。作者公布的测试数据比较亮眼,不过这些成绩主要来自模型作者自己的基准测试,实际能力还是建议大家根据自己的任务验证。

需要注意的是,27B终究只是27B。

不要拿它和大参数闭源模型硬比,也不要直接把复杂、开放式的智能体任务全部扔给它。我更建议提前设计好工作流,把步骤、工具和输出格式固定下来,再让它负责执行。

比如:

  • 按固定模板整理资料;

  • 从文档中提取指定字段;

  • 调用少量明确的工具;

  • 对内容进行分类、改写和格式转换;

  • 执行已经验证过的自动化流程。

至于能不能胜任你的任务,最好还是自己跑一遍。模型排行榜只能参考,真正重要的是它在你的工作流里会不会出错。

免费API:Agnes AI

不介意使用API的话,最近还可以关注一下新加坡公司的 Agnes AI

目前它的官网主打免费AI API,文本、图片和视频模型都可以接入。

Agnes 2.0 Flash

Agnes 2.0 Flash 是目前相对稳定的文本和多模态模型,支持图片理解、工具调用、代码任务和智能体工作流。

我实际使用下来的感觉是:简单任务能用,工具调用也可以,但同样不要指望它稳定完成特别复杂的长链路任务。

比较适合拿来做:

  • 普通问答;

  • 图片内容识别;

  • 简单代码生成;

  • 结构化信息提取;

  • 低成本工具调用;

  • 大量、不值得使用昂贵模型处理的任务。

它更像一个免费的执行模型,而不是一个能够独立解决所有问题的超级智能体。

目前 Agnes 2.5 Flash 已经开始灰度测试,主要提升了编程、工具调用、智能体工作流和多轮对话能力,但并不是所有账号都已经开放。

Agnes Image 2.1 Flash

Agnes还提供免费的图片生成模型 Agnes Image 2.1 Flash。官方目前也已经将它列入模型产品线。

我的评价是:基本能用。

生成普通配图、概念图、测试图片没什么问题,但不要拿它和GPT Image或者Google的Nano Banana系列硬比。免费的模型能够达到这个程度,已经有一定使用价值。

Agnes Video V2.0

视频方面还有 Agnes Video V2.0,支持文生视频、图生视频和关键帧动画。

不过我个人不太推荐。

虽然免费,但目前的效果更接近“让图片简单动起来”。动作、镜头和画面理解能力都比较一般,很多结果看完之后只会让人觉得:它确实动了,然后呢?

免费可以体验,但暂时不建议把它放进正式的视频生产流程。

最后的建议

选择低价模型时,不要只问一句“这个模型强不强”,而应该问:

这个模型能不能稳定完成我已经定义好的任务?

顶级模型适合处理复杂判断和不确定任务,便宜模型更适合执行固定流程。真正省钱的方式,不是强行让小模型解决所有问题,而是先把任务拆开:

复杂的规划和判断交给强模型,规则明确、重复执行的部分交给本地模型或免费模型。

模型不一定需要最强,只要在正确的位置上足够稳定,就已经很有价值了。