关于AI使用、开销及工作进展的分享 2026-07-17 【智能总结】 主要分享近期AI使用体验、费用开销及工作进展,包括不同AI模型特点及协作方式、充值官网过程与价格对比,还有公众号及直播训练成果。 - **AI使用体验**: - **写作效果**:Disick写作效果好,ChatGPT处理工程完整度高但存在过度工程化。 - **模型特点**:不同模型侧重点和应用场景不同,如Codex幻觉率小,Deepseek实战性强等。 - **协作搭配**:多个模型搭配使用,如Big Data或Cloud出方案,Codex审阅,低价模型执行。 - **费…
关于AI使用、开销及工作进展的分享
这里展示原始 capture 的摘要、正文摘录和当前派生出的事项。
Report
关键导读
先把有效信息集中到顶部:一句话总览、编号要点、待办与历史呼应。完整正文与结构化数据在下方展开。
一句话总览
关于AI使用、开销及工作进展的分享 2026-07-17 【智能总结】 主要分享近期AI使用体验、费用开销及工作进展,包括不同AI模型特点及协作方式、充值官网过程与价格对比,还有公众号及直播训练成果。 - **AI使用体验**: - **写作效果**:Disick写作效果好,ChatGPT处理工程完整度高但存在过度工程化。 - **模型特点**:不同模型侧重点和应用场景不同,如Codex幻觉率小,Deepseek实战性强等。 - **协作搭配**:多个模型搭配使用,如Big Data或Cloud出方案,Codex审阅,低价模型执行。 - **费…
01
关键洞见
- 过于复杂了,然后浪费了很多 token 然后结果有时候做的都不是重点
- 因为它们确实侧重点不是一太一样
- 但是他在是思考策略和就是在做方案的那个过程中,他其实并不是很好,因为他过度的追求细节
- 导致他很多时候给的方案,有一点过度,甚至有时候不一定能抓到重点
- 这个花销的话当然有500是我之前在买那个,开通那个抖音的那个账户导致的
02
优先级分层
- 高:主要分享近期AI使用体验、费用开销及工作进展
- 高:模型特点:不同模型侧重点和应用场景不同,如Codex幻觉率小,Deepseek实战性强等
·
涉及实体
Codex伦巴Kimi及中转平台
✓
待办动作
- 先从这些尝试一下从这边走
- 应该会比原计划稍微晚一点
- 这个文章主要它是啊,今天卡在了一个,因为我今天没有让我之前的那一个 AI 来做嘛
- 甚至我去让那个是让我的那个 AI 去突然间就就有点想不起来刚刚聊哪些内容,先不管了
- 就比如说我想跑一个我的那个工作岗位的那个这一个就要花,我今天看那个,用那个我之前那个常用的平台
与历史呼应
价格对比:对比官网、Kimi及中转平台价格,各有优劣,官网较稳定且有生图功能 协作搭配:多个模型搭配使用,如Big Data或Cloud出方案,Codex审阅,低价模型执行 模型特点:不同模型侧重点和应用场景不同,如Codex幻觉率小,Deepseek实战性强等
完整记录 · 正文与结构化数据
Summary
Summary Preview
先看一眼这条 capture 大概在说什么。
Body
Body Excerpt
这里直接展示归档后的正文摘录,方便核对提炼是否失真。
关于AI使用、开销及工作进展的分享 2026-07-17 【智能总结】 主要分享近期AI使用体验、费用开销及工作进展,包括不同AI模型特点及协作方式、充值官网过程与价格对比,还有公众号及直播训练成果。 - **AI使用体验**: - **写作效果**:Disick写作效果好,ChatGPT处理工程完整度高但存在过度工程化。 - **模型特点**:不同模型侧重点和应用场景不同,如Codex幻觉率小,Deepseek实战性强等。 - **协作搭配**:多个模型搭配使用,如Big Data或Cloud出方案,Codex审阅,低价模型执行。 - **费用开销情况**: - **充值尝试**:尝试充值官网版本,通过小红书方法未成功,参考B站分享成功充值。 - **价格对比**:对比官网、Kimi及中转平台价格,各有优劣,官网较稳定且有生图功能。 - **工作进展成果**: - **公众号运营**:实现公众号自动化发布,已发布3篇内容,吸到1个粉丝。 - **直播训练**:拉丁直播训练有稳定进展,直播素材结合感悟发视频能吸引关注。 【原文】 出发去跳舞。应该会比原计划稍微晚一点。但是是没有完全按照我们的计划。 比较快的话,可能做一点点就到最后还是把那个文章发了之后才出来的。然后这个文章主要它是啊,今天卡在了一个,因为我今天没有让我之前的那一个 AI 来做嘛。有一些上下文他们之间就没有共享到。导致出现了很多问题。然后后来才发现,原来是因为我有多个公众号。那我多个公众号它它在推这个草稿的时候,他没有推到我对应的那个公众号上。下一次就知道了,就把两个 IP 两个公众号都加就行了。不过还好没有配一样的,不然的话它就推到另一个公众号上就不对了。 不管怎么样,就是整个流程基建其实做的还比较快,因为本身我的很多模块就已经跑通了。是有些内容没有完全考好。但不得不说,我觉得 Disick 他的那一个写作效果真的是好很多。虽然说 ChatGPT 它在处理这个工程的完整度,让它连续跑的这个效果会好一点。有时候一天不管他。让它持续帮我跑个一两天,它这个结果它是会比较好的实现内容。但是也还会存在一定的过度工程化的问题。那这个问题的话,我这两天其实有看到一个用不用去解决这个问题?那这个问题的话,看一下怎么去结合一下,因为不然他每次定的那个任务有点过于过于奇怪了。就是。就是过于复杂了,然后浪费了很多 token 然后结果有时候做的都不是重点。甚至我去让那个是让我的那个 AI 去突然间就就有点想不起来刚刚聊哪些内容,先不管了。先从这些尝试一下从这边走。上一次家人告诉我说他有个同事从这边开车都会快一点,那我试试从这边骑行会不会快一点。正好可以考虑从那个公园那边,那边走,还可能会少过两个红灯,稍微好一点。 正好有一个相对比较长的时间段,可以梳理一下我这两天做了什么。其实这两天感觉效率还挺高的。而且我会觉得,在我这几天尝试用不同的模型之后,然后就觉,还还大概算了几笔账,然后就觉得可能不是说用一个模型替代所有的内容。会,就是会最好,而是这几个模型可能都用会比较好。因为它们确实侧重点不是一太一样。而且在应用场景上也不是很一样。其实我之前就发现了部分的使用方法,但是在实际去结合起来用之后,感觉还是会有新的体验。就比如说,我之前其实就发现了,扣带在处理长任务,还有一些工程化实施的时候,它其实很细节。但是他在是思考策略和就是在做方案的那个过程中,他其实并不是很好,因为他过度的追求细节。他就像是一个很专业的工程师,可能是因为我的配置问那我现在用的是一个执行者的那样的一个角色。所以他整个人都偏于执行了。导致他很多时候给的方案,有一点过度,甚至有时候不一定能抓到重点。 然后,在这个过程中,我去结合另外两个。 AI 可能效果就还好。就比如说我在使用 Cloud 或者是 Deepseek 的时候,用它们两个来做的时候。就会觉得它们两个更懂我。甚至是说,让他们去回复的时候,也会给到更好看的回复样式。 和结果吧。 具体怎么说呢?就是这几天其实非常波折,虽然可能刚过去没几天,因为相当于是我周三晚上去,周三周周三去游完泳。之后经历的这件事情。当时游完泳之后我忘了怎么开启的这个话题。好像就是大概看了一眼账单,然后去看了一下,发现这一个月已经花了1800,1800。1900。的那个花销了。那这个花销的话当然有500是我之前在买那个,开通那个抖音的那个账户导致的。那其实相当于还有1400,那这1400元的话,那不,就虽然是1400元,但是它依然也是个不小的数字。 那有这个数字的话,其实按理说,我去充值官网的 TOKEN 都可以满足用都可以开最强的那个内档。而且最近不是一直都在有说官网一直在恢复用量,那相当于它就如果用官网的那个最大的额度。他的用量还能进行重置的话,那他其实是一个很好的就是奖励嘛,那我觉得就是很亏啊。所以我就想说,那能不能去充值官网的这个版本?然后我就去了解了一下,我发现现在真的是有方法可以充值官网的。版本。当然我最开始去,还是按照小红书的推荐去试了试,那几个方法都不是很好用。然后也没有成功,折腾了,浪费了一两个小时吧。然后我在查那个哔哩哔哩的时候,发现有一个字节,刚入职字节的员工,他分享他的购买方式。有一个可以在网络上去给开卡的,他好像是借助虽然手续费抽的不少,给 Shripe 抽了3.4%。每笔还加收手续费。 但是效果还不错,最终成功了。我当时充的是 Plus,也就是每个月的,一共花了20刀。相当于每周有100刀的额度吧。其实好像也没多少,因为我实际用起来100刀我基本上一天就用完了。因为我量比较大,他,我很多操作。用起来是有点繁琐。然后用完了之后,那相当于跑四五个长任务吧。那如果这样算的话,其实就能算出来价格了。就比如说我想跑一个我的那个工作岗位的那个这一个就要花,我今天看那个,用那个我之前那个常用的平台。差不多要20刀20刀,差不多这个价格。然后我对照了一下官网,我发现它这个真的没怎么注水。官网也差不多20刀左右的价格能把这个东西完成。反倒是20道那其实也差不多,用 Kimi 的话,20刀也差不多,也就只能用个这个东西。 那他们的价格看起来好像也真的是差不了多少。20刀的话,99块钱。差不多哎,那那我去用 Kimi 的话也差不多是这个价格。但是 Kimi 它有一个5小时限额,但它整体限额也挺贵,反正 Kimi 现在用起来就贵。但是虽然 Kimi 它确实准确性性还行,它其实给我的感觉就跟那个低配版的,嗯, Codex 差不多。如果用不了 Codex 而且对要求性比较要求比较高,其实用 Kimi 也不是不能干。那与此同时呢,我一下就把那个 Codex 用量用完了。按理说应该这个时候继续去充值。 CodeX,但是我了解了一下,它是按天来结算价格的。也就是说我昨天充了 class,如果昨天我立刻升级到 Pro 版本的话,那相当于我就浪费了一个 class。 就是我就额外得多付20美金,那我觉得这样太不划算了。那我不如等下个月,整个周期跑完,然后下个月的时候再充值,然后就好了。那为什么想去充值官方?一是它比较稳定。二是呢,它还会有的时候会恢复用量,我觉得这还挺好的。但是其实,现在对比中软感觉也还差不多,其实也没省多少,因为它相当于 Pro 版本一周。它要是跑的话能跑2000刀。2000刀的话,我在我那中转买。的话,他只是现在是60块钱买。然后100次买1000,差不多也是0.14。好像我就大概算了一下,觉得价格应该差不了多少,也省不了多少钱。而且我那边还会加上一个手续费,那其实里外里就更是差不了多少了。 那如果说本身价格就差不多的这个情况下,那其实中转的话,它它不好的点在于它不稳定。它好的点在于它,可能你不需要想着把所有用量都用完,这也是有好的地方。但是官网其实还有一个好处,官网它其实有那个生图的功能,我觉得这个也挺而且它的的那个 Computer use 的整个功能。明显能感觉它适配度会更好一点。 虽然,不过其实还好一点就是,它那个工具在我调试之后,我用 Deepseek 其实操作也差不了多少。就是 Deepseek 好像也是要练一练,就是调一调,我发现它有些工具慢慢它自己也会用了。就是因为他在我本地,可能本身上下文空间信息比较少,一上来的时候他不是很了解我,所以做了很多事情都是做错了。在互相,我就让他们彼此去互相审阅了一下对方做的内容。 还是有很多问题的,我觉得这些问题可能要我在,我找一个时间。去详细的去看一下这些问题怎么解决。尤其是最近收集了,不是收集了一些很好的指令吗?包括什么什么 green。 还有一些什么卡姆提到原则,尤其是在在让他们帮我写购方案的时候,还是不能让他们去尽可能的把这事情扩大。而是还是应该去瞄准最重、最关键的目标,而不在于说是一定要去完整的目标去给他写。可能有时候我的某某些描述让他们产生误解。其实最本质的还是要把最关键的目标写好。再有就是之前我在反反复复用 Codex 的情况下。 在处理那个在处理页面的语义层面的展示的时候,效果不是很好。但反到这一点的话,你看 Deepseek 效果就会明显很好,而且看起来就类似于当初 Cloud 给我的一个观感。那 Cloud 本地我试了一下,就是首先它是感觉比较贵。但这俩价格其实我没有对比过。如果要是执行同样的任务,到底 Cloud 的贵还是它贵?那应该还是第四个便宜,我第四个不是公认的它比较便宜的这个东西吗?我今天算是比较深度的用,就是可了劲地用。大概花了多少?30 30块钱吧,30人民币。那怎么看还是比较省。虽然说确实有些地方比较繁琐了一点,他有的时候在处理某些内容的时候确实不够严谨,然后端到端测试做的也不够好。 但是它确实挺便宜的。然后我发现有一些更基础的工作,让我我可把它来做也不是不行。尤其是如果如果有一些内容,我把方案已经做好了,我就让便宜的模型去好执行,可能这样的效果还是会是更好一点。而且我觉得现在让后去来跑那些。就是很简单的操作,我觉得有一点浪费它了。但是我在想是不是可以拆再细一点,让,嗯,嗯,Big Data 或者 Cloud 去出方案。 把方案尽可能描述好,就是描述目标层面的方案。然后让 Codex 就是审阅,然后让便宜的模型看起来什么去,甚至或者说可以不用5.6来去执行,要5.4去跑。长任务,因为我之前用5.4,其实,分形效果就挺好的。可以让5.4去跑,但是5.4更低一点的模型去跑。因为好第一点模型能更遵循指定的那就让5.4去跑直行,5.6,我觉得5.6的设计已经做得非常好看了。 因为我这几天不是那个一是有些内容描述给 ChatGPT 比较费劲,二是 ChatGPT 用量它免费用量一下用完了嘛。然后我不让那个 Soul 去帮我做这个设计,我觉得 Soul 的这个设计提升了一大截。可能也是因为我本地装了那个 Direct 的那个。 Design Design Direct 有一个防防 cloud 的一个设计的 views。 说完之后,它现在的效果突飞猛进。就基本上每次做完都是让我眼前一亮那种状态。可能他也比较多,本地上下文做得很好。所以我觉得送,让他去做一些基础维护性的工作,我觉得有点浪费他的能力了。而且他也容易想太多,然后就会扩展越来越多没有用的东西。就是明显能感觉 Deepseek 跟 HotDocs 不是两个极端。Deepseek 它总是不管我的一些具体的 gate 要求,脚本去做事情。然后 Codex 就有点太细致了,他可能把这个东西,像工程师一样,一点都不能出错。他两个感觉都不是说能随便交给他们一个任务让他们全都完成,还是要尽可能的我去先去写一个 PRD 之类的。然后去让他们两个从各自的角度去讨论完善。看看有没有必要去弄完之后再怎么去跑,然后根据不同任务的需求池来去做这个东西。 就如果今天按 Codex 来去,帮我完成这篇文章发布,这文章可能今天发不完了。但是 Codex 确实指出了很多很有用很就是很有道理的,很本质的东西。就比如说这两个文章是虚假的,它能够帮我验证这个东西是真实的,那这个东西非常重要,如果我发两篇假的东西。对我来说,这个损伤性是远远比我不发还要还要大的。 所以 Codex 它的那个教练确实是必不可少的。不过它提出了之后,我再告诉 Deepseek,然后 Deepseek 它就能给我写出一个很不错的文章。而且是引经据典。然后图片也符合规则了。当他了解了我这个东西内容的时候,他确实能做到,而且效果不错,而且很省钱。就是如果他不用反反复复试错的话,他其实做的很好。 哦,还有一点非常非常重要,就是,这个这个非常快。尤其是在接入这个 Codex 之后,它整个这个前端界面也是适配得非常好。就是原来我以为它适配不了,但是在某些调整之后,它其实完全都是可以适配的。所以我也能理解为什么一部分人要用 this thick 来去做这个东西。我本来是还想让 Codex 帮我写一篇文章,就讲 this thick 不是适合来处理。但在我用 Deepseek 再用 Codex 然后处理,然后出现问题,再返回用 Deepseek 之后。我发现它其实也并没有想象那么糟糕。它确实能够帮我很直接的去解决眼前很明确的问题,而不是说一定要等到我所有内容都准备好了。 你觉得 Deepseek 不会是中国人吧?印出来的模型,它就不会想那么搞那么多,是形式主义的东西,也不是说形式主义吧,就是比较实战。就是很直接,不会搞一些客套性的东西,或者说安全审计的东西。这样的话也确实可以节省很多 token 不过它这个东西可能不适合让它直接上线,我觉得维护这种线上的产品。你想去维护版本的话,那我觉得可能还是用 Codex 比较稳妥。因为它,像你这这个来做的话,它很可能就做的是没有满足我们的一些需求。他们两个又吵又闹的,真的是。不太一样。而且第4个它其实有更便宜的版本,我在想,或许也可以考虑用它那个 fast 去做一些更基础的校对工作。因为它速度比较快嘛。那其实有点浪费,还不如让你扣的是在循环跑,让你跑慢一点,其实我觉得没关系的。卖的比较便宜。 5.4,甚至说5,当你当说5.2用着就挺好。跟我模式一连接起来,因为 Codex 一直都是一个很很错,它它幻觉率非常小,因为它很多东西它都是要去实时校验。对,这里就是提到幻觉率,因为可能 DPC 它是本身你这个创意性跟你的幻觉力就是,有一些可能是一个密不可分的东西。你很难说让一个东西它既严谨又有创意。很严谨的人,他是很难有创意的。因为严谨的人,他叫,任何事情他就是要循规蹈矩去讲真实的事情,但是创意的人他更多还要去想一些不存在的东西。那它可能更会激发一些你没有提到的一些想象。但它对,就不可,就不可避免的就是会有更多的幻觉产生。 那我刚是,光是聊这个模型的体验。啊,这里,Kimi 还没怎么讲呢。Kimi 反正大概提了几下吧,他也就一下就用完了,我还没有来得及继续去用它。可以试试 Kimi 的视觉能力,他们都说它视觉能力还挺强的。但我现在没太想好用什么场景去使用它。所以从这个角度来看的话,如果我想未来多体验一些模型,可能还是直接用中软是比较合适的。 开官方的这个,确实不是,不一定是一个非常好的。选择啊,但是不管怎么样,至少我是有能力开通它,有能力去使用,而不是说被迫的无法使用的这样的一个程度吧。然后其他关于这两天去做的那内容就先不讲了。就这几天感觉,这一周最大的进展主要是公众号的自动化发布这个东西。那公众号已经发了3篇内容,然后目前就吸到了一个粉丝,感觉还不错。然后再有就是拉丁,这个直播训练这块也有了一个基本稳定的进展嘛。哦,虽然说拉丁在直播的过程中没有给我吸引到粉丝,没有如我预期一样,但是直播录制的素材。然后发现效果还挺不错的,而且结合结合就是我日常的一些感悟,然后发成了视频。然后发现这样还挺能吸引到人去关注我。目前还有吸引到 录音完整详细总结 这份录音是说话人骑行途中的个人复盘分享,核心围绕多款AI模型实测对比、AI使用成本开销核算、公众号自动化发布踩坑与业务进展、多模型协同工作流方案四大板块展开,同时穿插出行路线、时间规划等生活化碎碎念,整体是近期高强度使用各类大模型后的实操心得复盘。 一、公众号自动化发布工作踩坑(近期核心业务) 1. 故障根源:多公众号账号切换时,AI草稿推送未匹配对应目标公众号,多账号上下文无法互通,导致发布流程出错;解决方案是后续配置时同时录入双IP、双公众号账号,避免推送错位。 2. 流程基建现状:底层模块已提前跑通,整体搭建速度快,仅内容适配、多账号联动细节未完善。 3. 当前成果:已自动发布3篇文章,新增1名粉丝,是本周最大工作进展;若仅用Codex单独完成发文,效率极低、当天无法完成发布。 4. 模型分工实操:Codex负责事实校验,可识别虚假素材,规避发文造假带来的严重损失;将Codex校验后的需求交给DeepSeek,即可产出引经据典、合规配图的优质文稿,速度快、成本更低。 二、多款主流AI模型实测优缺点、适用场景对比 说话人实测Codex、DeepSeek、Claude、Kimi、GPT系列(5.4/5.6)、本地Sora,总结出各模型两极化特性,提出多模型搭配使用而非单一模型全覆盖的工作思路: 1. Codex(代码/工程向模型) • 优势:工程落地完整度高,可连续自主运行1-2天长任务;事实校验严谨、幻觉率极低,适合真实性要求高的内容审核、线上产品维护;工具、前端界面适配完善;擅长细节落地、代码执行。 • 短板:极度偏向执行层,过度追求细节,容易把任务复杂化,消耗大量Token,抓不住核心目标;做顶层方案、策略规划能力弱;单一处理内容创作效率差。 • 定位:工程执行者、内容校验员,不适合单独做创意写作、方案设计。 2. DeepSeek(国产高性价比模型) • 优势:价格低廉,深度使用单日仅消耗30元人民币;写作、页面语义展示效果优秀,输出排版美观;风格务实直白,无冗余客套、多余安全审计话术,节省Token;工具调试后可自主调用,本地适配优化后速度快;低版本(5.4/5.2)遵循指令能力强,适合批量执行基础任务。 • 短板:容易无视明确约束指令,自主发挥;创意强但幻觉问题更突出;本地初始上下文不足,初期操作易出错;不适合直接上线商用产品维护。 • 细分版本:V4-Flash速度快,适合低成本校对、简单基础工作;5.4适合长任务批量执行;5.6内容设计质感出色。 3. Claude • 优势:理解用户需求能力强,写作回复质感好,擅长顶层方案、策略规划;输出内容更贴合创作者思路。 • 短板:使用成本偏高,未深度测算与DeepSeek的价差。 4. Kimi • 优势:内容准确度尚可,可作为Codex低配替代;视觉能力网传很强,有待测试。 • 短板:计费昂贵,存在5小时使用限额;长任务成本对标Codex,20刀仅能完成单一岗位类任务;额度消耗速度快,说话人尚未充分体验。 5. GPT 5.4 / 5.6、本地Sora • GPT5.4:分形长任务效果优秀,指令遵循度高,适合低成本批量执行。 • GPT5.6:内容设计质感顶尖,但单纯做基础维护属于性能浪费,容易过度发散、生成无效内容。 • Sora:本地安装Design Direct插件后设计能力大幅提升,输出效果惊艳,本地上下文存储完善,适合创意设计类工作。 模型底层矛盾总结 严谨性与创意性天然冲突:Codex极度严谨、循规蹈矩,几乎无创意;DeepSeek、Claude创意充足,但幻觉无法避免,二者需搭配互补使用。 三、AI工具使用成本、充值渠道对比与开销测算 1. 当月总开销情况 当月AI相关总花费1800-1900元,其中500元为抖音账户开通费用,纯AI工具消耗约1400元,成本偏高,因此研究官方充值渠道降低损耗。 2. 官方GPT充值踩坑与方案 1. 初期尝试小红书渠道充值失败,浪费1-2小时;后参考字节在职员工分享的渠道,通过第三方开卡平台充值Plus月付套餐(20美元/月),平台收取3.4%手续费,操作繁琐但充值成功。 2. 额度限制:Plus每周仅100美元额度,说话人使用量大,单日即可耗尽,仅能支撑4-5个长任务;单岗位类任务消耗约20美元,官网API与中转平台定价基本持平。 3. 充值策略:当前已用完Codex额度,因Codex按日结算,若立刻升级Pro会浪费当期Plus订阅,决定等月度周期结束后再充值Pro。 3. 官方渠道 vs 中转平台对比 1. 官方渠道优势:运行稳定、定期重置免费用量;自带生图、Computer Use工具,适配度更好。 2. 中转平台优势:无需刻意用完额度,灵活灵活。 3. 中转平台劣势:服务不稳定,叠加手续费后总成本和官方几乎无差价,省钱效果微弱。 4. 选型结论:若需要多模型同时体验,中转平台更合适;官方订阅稳定性更强,但综合成本无明显优势。 四、标准化多模型协同工作流(核心实践方案) 说话人根据各模型优劣势,搭建分层分工流程,避免单一模型短板放大: 1. 顶层方案输出:Claude、DeepSeek负责输出目标导向的顶层方案,聚焦核心需求,避免过度细化; 2. 事实校验审核:Codex审阅方案、核验素材真实性,剔除虚假内容; 3. 批量落地执行:低性价比需求、基础重复工作交给DeepSeek低版本(5.2/5.4),控制Token成本;复杂设计交给GPT5.6/Sora; 4. 协同优化:让Codex与DeepSeek互相审阅输出内容,提前排查问题;撰写清晰PRD需求文档,明确核心目标,减少模型误解;复用优质提示词(格林原则、卡姆原则),约束模型不要无限扩大任务范围。 五、其他业务进展 1. 拉丁直播训练:直播未直接涨粉,但录制素材结合个人感悟剪辑成短视频,引流涨粉效果可观,项目流程趋于稳定。 2. 出行规划:计划更换骑行路线,途经公园减少红灯,利用通勤长时段梳理工作思路。 六、整体核心观点汇总 1. 不存在全能AI模型,各模型侧重点、适用场景差异极大,多模型组合协同是最优解; 2. 严谨度与创意无法兼得,工程校验、内容创作必须拆分给不同模型处理; 3. DeepSeek性价比优势突出,适合批量落地执行;Codex是真实性校验刚需,线上稳定生产离不开;Claude擅长顶层策划; 4. 官方GPT订阅与中转平台成本差距极小,仅稳定性、多模型体验各有优劣; 5. 自动化内容生产流程基建已成型,核心卡点是多账号联动、模型分工、提示词标准化优化。 查看音频文稿
Derived Items
从这条 capture 派生出来的事项
点任意 item 可以继续看 gate / writeback / patch 的处理结果。