👉 非常省钱的 Agent 模型组合,必备
ds v4 flash + qwen3.7-flash,已覆盖我的非 Coding 任务,一天成本不到 1 块钱
绝对是“穷兄弟”的非 Coding 类 Agent 必备套餐 🤣
1️⃣ 纯按官方原价 API,该搭配成本:
- ds 跑非 agent 任务(比如对、搜索、写作),中度使用 1 天花不到 1 块钱
- 更离谱的是 qwen 识图,1 张成本只要 0.001~0.002 元,识别 100 张也只要 2 毛钱…
(不是所有任务都需要多模态旗舰 Agent 模型,猜测下半年够用便宜的智能将会是开发者的选择重点)
2️⃣ 用法:
❶ ds 作为主模型,qwen3.7-flash 只负责识图,帮没有视觉的 ds 把图片转译为描述文本
❷ 分工的实现方式:
如果你有自己开发的 Agent,可以直接在 ds 拿到图之前,固定让 qwen 把图像块转译为文本【图片描述:……】
如果是在 CC、Codex 等用,可以做个识图的 tool/skill,让 Agent 自行调用工具识图(具体可以和 Agent 聊天直接落地 skill)
3️⃣ 模型质量与价格证明:
❶ v4 flash:真的很强,而且是比较均衡,能写人
我非 coding 任务每天都在用 flash
非复杂 coding 类任务下,任务理解、工具调用都很不错。唯一就是默认的 high 档位思考比较浅,可以按需开 max 推理,或者提示词引导思考的深一点。
价格上,官方原价不命中缓存 1 元/M,命中只要 2 分钱/M。基本中度的非 coding 用户,几毛 1 天就够了
❷ qwen3.7-flash:新一批的多模态模型里,识别最好且最便宜的
虽然 qwen 的 Agent 复杂任务,在 3.8 时期大幅提升;但多模态识别能力,从过年开始一直都是最精准的一档(含国外)
别看 3.7-flash 有阶梯定价(超过 32k 就变贵到了 6 毛钱 1M),但其实看起来很大的图片,1 张图的输入只占 1~2k 左右的 token,只会用到 2 毛钱 1M 的价格区间。
所以 100 张图都只需要 2 毛钱!如果关闭 think,就只要 1 毛钱!
单 query LLM 识别图片,已经进入到比 OCR 还便宜的时代了
具体计算、各家多模态模型定价,可看图
——————
只要不做复杂 coding 任务,这个组合能 c
ds v4 flash + qwen3.7-flash,已覆盖我的非 Coding 任务,一天成本不到 1 块钱
绝对是“穷兄弟”的非 Coding 类 Agent 必备套餐 🤣
1️⃣ 纯按官方原价 API,该搭配成本:
- ds 跑非 agent 任务(比如对、搜索、写作),中度使用 1 天花不到 1 块钱
- 更离谱的是 qwen 识图,1 张成本只要 0.001~0.002 元,识别 100 张也只要 2 毛钱…
(不是所有任务都需要多模态旗舰 Agent 模型,猜测下半年够用便宜的智能将会是开发者的选择重点)
2️⃣ 用法:
❶ ds 作为主模型,qwen3.7-flash 只负责识图,帮没有视觉的 ds 把图片转译为描述文本
❷ 分工的实现方式:
如果你有自己开发的 Agent,可以直接在 ds 拿到图之前,固定让 qwen 把图像块转译为文本【图片描述:……】
如果是在 CC、Codex 等用,可以做个识图的 tool/skill,让 Agent 自行调用工具识图(具体可以和 Agent 聊天直接落地 skill)
3️⃣ 模型质量与价格证明:
❶ v4 flash:真的很强,而且是比较均衡,能写人
我非 coding 任务每天都在用 flash
非复杂 coding 类任务下,任务理解、工具调用都很不错。唯一就是默认的 high 档位思考比较浅,可以按需开 max 推理,或者提示词引导思考的深一点。
价格上,官方原价不命中缓存 1 元/M,命中只要 2 分钱/M。基本中度的非 coding 用户,几毛 1 天就够了
❷ qwen3.7-flash:新一批的多模态模型里,识别最好且最便宜的
虽然 qwen 的 Agent 复杂任务,在 3.8 时期大幅提升;但多模态识别能力,从过年开始一直都是最精准的一档(含国外)
别看 3.7-flash 有阶梯定价(超过 32k 就变贵到了 6 毛钱 1M),但其实看起来很大的图片,1 张图的输入只占 1~2k 左右的 token,只会用到 2 毛钱 1M 的价格区间。
所以 100 张图都只需要 2 毛钱!如果关闭 think,就只要 1 毛钱!
单 query LLM 识别图片,已经进入到比 OCR 还便宜的时代了
具体计算、各家多模态模型定价,可看图
——————
只要不做复杂 coding 任务,这个组合能 c