先说结论:不是越新越好,是按"成本 / 隐私 / 时延"分活
我们踩过最典型的坑,就是一股脑把活全丢给云端,或者反过来迷信"本地部署才安全"。真实跑下来,两者各管一段最省心:重算力交给云,不能断的轻活留在本地,隐私数据画一条不越界的线。
我们的分工:云端跑生成,本地只做轻量
- 云端免费额度(HY3、DeepSeek V4 flash、Agnes 视频额度):跑文本生成、脚本、配音、视频这类"重算力、可容忍几秒时延"的活。
- 本地 / 轻量服务器(腾讯云轻量、这台 Windows 跳板):只做文件搬运、Base64 分块、定时探活、证书续期这类"轻、快、不能断"的活。
- 批处理、CAD 图纸解析(LibreDWG 转 DXF 再抽图层):单次耗时长且要稳定,放在云端常驻任务里跑,本地只收结果。
经验:把"重算力"和"不能断"分开,稳定性立刻上一个台阶。我们之前把探活脚本也塞进云端,结果云端偶发抽风,探活自己先挂了,等于没人看门。
隐私数据不往外传:一条硬线
客户图纸、报价单、通讯录这类敏感文件,原则上一律本地处理或脱敏后再上云。我们吃过一次亏——
踩坑:早期把一份带客户名称的 CAD 直接推到某云端解析服务做测试,虽然没出事,但事后复盘吓出一身冷汗。从此定下规矩:含可识别信息的文件,先脱敏(把甲方名、联系方式替换成占位符)再传,云端只看到"几何 + 图层"。
免费模型的适用边界(老实说)
- HY3:夜间跑重活、长文、结构化生成,标准倍率,性价比高,但有日调用次数上限,不能拿它刷高频请求。
- DeepSeek V4 flash:白天跑高频、短平快的生成与分类,快且稳。
- 倍率红线:任何模型调用倍率 >1.00x 一律不碰——宁可暂停任务,不花超倍率的钱。
判断一句:免费模型够用就别升级。我们曾想用某个"更强"的付费模型提质量,被成本铁律拦下,回头把免费模型的提示词和重试逻辑调好,效果反而更可控。
给普通人的"怎么选"判断表
- 活很重、偶尔跑、能接受几秒延迟 → 丢云端免费额度。
- 活很轻、要 7×24 不断、延迟敏感(探活 / 转发)→ 放本地或轻量服务器。
- 含客户隐私 / 商业机密 → 本地处理或脱敏后再上云。
- 要高频实时(每秒级)→ 本地,云端网络往返不划算。
- 想"用更强的模型"但还没收入 → 先调免费模型的提示词和流程,别急着付费。
一句话收尾
本地和云端不是二选一,是"按活分岗"。把重算力交给云端免费额度,把不能断的轻活留在本地,隐私数据画一条不越界的线——这套分工让我们零成本撑到了现在。