分享我超高效率但是超省钱的工作流方式:
- 和GPT深入探讨设计和方案
- GPT在A项目中给出设计方案,我直接让离线的27B去执行
- 27B执行的时候,我在和GPT讨论B项目的设计方案
和GPT深入探讨设计和方案
设计环节用线上GPT的全局规划能力。如图:我让Codex在全局列一下需求,回答尽量简洁,这样内容少了才好全局思考,把需求收拢成几条清晰的要点。
让离线的27B在后台慢慢用电干活
GPT给出设计方案后,我直接把方案丢给离线的27B执行。如图:Qwen 3.8 27B在AIPod上以vLLM方式运行,在Pi里无审查地执行“生成LPK并安装LPK”任务,23分45秒跑了22条命令,中途遇到本机缺unzip、sudo要密码这类问题也自己补了个node版unzip shim解决掉了。
兼具线上模型的能力与线下模型的省钱
看到了吗?利用线上GPT的全局规划能力,我和GPT在协作设计的时候,27B在后台慢慢用电来干活,而不是用订阅来干活。
这样我兼具了线上GPT模型的能力和线下模型的省钱,因为只要设计好,线下模型现在非常能打了。关键给我节省了90%的订阅费。

