Private Capture

Unlock Capture

这个站点包含私人录音与日记内容。输入密码后进入;当前浏览器会自动记住。

密码仅保存在当前浏览器本地。

关于工作流程、项目及求职的探讨

页首只保留导读,完整正文和结构化内容继续在下方展开。

Day2026-09-02 Time21:10 SenderLily Topics录音与采集 / 工作流与自动化 Entities6 ModeStructure + Text SourceArchive Complete
来源类型录音转写
说话人Lily
归档时刻2026-09-02 21:10:40
主题录音与采集 / 工作流与自动化 / AI 工具与 Codex
实体6 项
模式结构化 + 正文
Report

关键导读

先把有效信息集中到顶部:一句话总览、编号要点、待办与历史呼应。完整正文与结构化数据在下方展开。

一句话总览

主要探讨工作中语音转录流程优化、技术接入部署,结合自身求职阐述项目改进,包括Molly job商业化与开源思考,以及Moment Flow和白板讲解功能完善想法。 - **转录流程现状与优化**:当前语音转录需手动多步操作,理想形态应更便捷,支持多素材类型,实现完整闭环,还应优化操作入口,考虑接入快捷指令。 - **技术接入与部署**:考虑不依赖外部AI,接入自有API,关注后端部署,合理整合数据库,避免重复建设。 - **求职与项目结合**:认为自身能力适合新型小公司,需优化简历,可将求职系统与Molly job项目结合,围绕其完善内容,考虑商业化与开源方向。 - **项目改进想法**:对Moment Flow项目,想添加AI功能,实现模板生成、修改对比等,限制免费使用,付费或自配置token可享更多服务;白板讲解功能可进一步完善,增加手机端个性化操作。

01

关键洞见

  • 的,或许他其实对于我那种比如图文和视频的类型,其实对你们支持得不是很友好
  • ,按理说,但现在我其实有一个总结看板的客户端,按理说它其实现在不是一个完整的闭环
  • 用新一套视觉其实还挺长久的,不过这个先视觉层面,我觉得确实不是很急的去搞它
  • 技术接入与部署:考虑不依赖外部AI,接入自有API,关注后端部署,合理整合数据库,避免重复建设
  • 这里会涉及到几个维度,比如说你的真是不是不够真实了
02

优先级分层

  • 高:主要探讨工作中语音转录流程优化、技术接入部署
  • 高:付费或自配置token可享更多服务
  • 中:技术接入与部署:考虑不依赖外部AI,接入自有API,关注后端部署,合理整合数据库,避免重复建设
  • 中:转录流程现状与优化:当前语音转录需手动多步操作
  • 中:以及Moment Flow和白板讲解功能完善想法
  • 中:白板讲解功能可进一步完善,增加手机端个性化操作
·

涉及实体

FeishuDoubaoMinutes手机关于工作流就比如像现在我去手机录音
✓

待办动作

  1. 应该在解释的过程中,我如果识别到某些原文的片段,因为现在我会有原文摘录的这个过程嘛
  2. 同时我再去豆包把他的那一个总结的版本也复制下来,也粘贴到推出的妙计群中,以确保以确保这个内容可以同步到我的本地
  3. 把它去分享到这个云端部署上面去
  4. 因为图文和视频它首先会依赖比较高的存储空间,我目前其实没有那么高存储空间,所以我并没有加这个类型
  5. 用新一套视觉其实还挺长久的,不过这个先视觉层面,我觉得确实不是很急的去搞它
与历史呼应

转录流程现状与优化:当前语音转录需手动多步操作

本条脉络:主要探讨工作中语音转录流程优化、技术接入部署,结合自身求职阐述项目改进,包括Molly job商业化与开源思考,以及Moment Flow和白板讲解功能完善想法。 - **转录流程现状与优化**:当前语音转录需手动多步操作,理想形态应更便捷,支持多素材类型,实现完整闭环,还应优化操作入口,考虑接入快捷指令。 - **技术接入与部署**:考虑不依赖外部AI,接入自有API,关注后端部署,合理整合数据库,避免重复建设。 - **求职与项目结合**:认为自身能力适合新型小公司,需优化简历,可将求职系统与Molly job项目结合,围绕其完善内容,考虑商业化与开源方向。 - **项目改进想法**:对Moment Flow项目,想添加AI功能,实现模板生成、修改对比等,限制免费使用,付费或自配置token可享更多服务;白板讲解功能可进一步完善,增加手机端个性化操作。
完整记录 · 正文与结构化数据
Mind Map

思维导图

这里不再用摘要卡片伪装脑图,而是直接用经典 mindmap 组件来展示结构。点击分支会跳到正文。

点击节点会定位到正文,方便一边看脑图一边回看原文。

Local Relation

这条录音的局部关系图

不用先跳到全局图。这里先把当前 capture 连到的 Topic / Entity / Day,以及共享这些节点的其他记录显出来。

View
Layout
来源
聚焦
Topic Entity Capture Signal Day capture -> topic / entity / signal / day

单击右侧看详情;双击节点开浮层。这里只展示和当前录音直接相关的局部网络。

完整原始转录 · 音频文稿点击展开

说话人 1
发了之后就想账号的风格。

说话人 2
哦。

说话人 3
那个游泳的话还是得吧。

说话人 2
哎,手表忘拿了。

说话人 2
好,穿上这个裤子。

说话人 2
啊,我吹个头发。

说话人 3
Oh my god 谁让我们周五周五周六周日,周一周二周三,将近半周的时间。他在这个过程中真的是点到了人机写作的痛点。今天继续做。我认为痛点我觉得标准的内容。虽然说现在很多还是很难这么严格的制度。

说话人 3
这里会涉及到几个维度,比如说你的真是不是不够真实了?

说话人 3
内容去进行比对。措辞甚至还有些奇葩的说。

说话人 3
甚至我现在用最高级的。我发现这个过程中会发现会好很多。

说话人 3
然后在跟家人去拿我的这个简历的内容。聊天探讨的时候,其实会发现一些问题的。就是好几个问题。那比如修改起来特别的不便捷。根据一张 7点半去看的。在整个过程是没有内容的。但我在想这个过程其实可以更加的便捷一点。就比如说,就像他们做那种腾讯会议一样。是屏幕就是他们的眼睛,聊天的就是他们的内容。然后他加上会议转录,他应该是一个相对比较高效的过程。然后,但是我觉得昨天是一个什么样的一个状态?是一个需要去做语音的一个记录,这个是比较类似的。但是具体我对某一个内容进行修改,一是我不,没办法做到实时地去修改调整它。另一部分呢就是没办法去跟那个时间点去结合起来去做操作,所以我在想这个事情。这个东西应该是,我觉得我的 capture 还是有一个。大的优化了一个场景的视频。说现在的 capture 只是一个,各个渠道去,其实就是一个很简单的核心链路的跑通。就比如像现在我去手机录音,记录下来之后,进行转录,然后发送到我的飞书群里面。然后然后分手群里面的内容,以结构化的形式呈现出来。这是我现在当前说的一个。

说话人 3
然后就是我当前的这个就分为当前的转录形态和我之前认为理想的形态以及终极的形态可能什么样子的几个分类嘛。那当前的形态就是我去用语音进行录音,然后用,把它发给豆包来进行 AI 这个环节的语音的一个转录。他会给我那个原文的一个逐字稿,加上那个时点和人物的那个。人物识别分析的部分。

说话人 3
人物识别分析的部分,然后此时我要进行手动的操作,来进行在豆包里面将它转录的那个结果的原文本。复制,然后粘,打开飞书,粘贴到我的飞书的妙记群,然后按照我核心的指令,然后艾特,然后去添。去复制到里面。同时我再去豆包把他的那一个总结的版本也复制下来,也粘贴到推出的妙计群中,以确保以确保这个内容可以同步到我的本地。然后我的本地它会跑一个自动化的任务。把它去分享到这个云端部署上面去。然后这一条链路是一个获取语音文字的一个过程。然后当然除了我这种语音类类型,我也可以去复制那链接的类型,它现在也是支持了。任何一个链接,它都会获取里面的原信息,并且把原文获取下来。然后像我本地有一些小红书的获取,它其实是比如说小红书的获取链接的方式,它也有小红书的获取的那种插件可以进行运行。当然这一系列的东西。就各个渠道都是要去做单独定义的一个适配的层面嘛。

说话人 3
然后这个是各个渠道各种方式。那现在其实主要还是文本类型。的,或许他其实对于我那种比如图文和视频的类型,其实对你们支持得不是很友好。因为图文和视频它首先会依赖比较高的存储空间,我目前其实没有那么高存储空间,所以我并没有加这个类型。那从理想上来看的话,应该不限于语音的类型和各种素材类型的内容,都应该去被准确的识别才对。那是,就是那种语音、视频。还有语音的话,现在我也是只存那种转录后的结果,其实源文件还是在本地存放的。

说话人 3
其实源文件的话,从长远来看,我也不太确定有没有必要给它摘录出来,甚至我在想。应该在解释的过程中,我如果识别到某些原文的片段,因为现在我会有原文摘录的这个过程嘛。我应该把原文摘录的那个内容或者信息 cut 出来,我觉得可能这是一个更好的实现方式。因为这样的话,它就会有更原子层的音频的素材。然后音频素材的话,它也不会像视频和图片那样可能空间那么大,但是它也可能在,能保留一定的真实性。

说话人 3
和,就是长远来看的话,一个素材结构化构建的方式。那现在就是,一是各个渠道的,二是各种媒体类型的。然后操作,然后反正就是现在是操作入口层面上,因为像我之前其实这套流程还是一个,你看相对比较繁琐的流程。因为我现在并没有做出来一个准确的客户端出来。然后,按理说,但现在我其实有一个总结看板的客户端,按理说它其实现在不是一个完整的闭环。如果一个完整的闭环应该是从我用户,我下载它,或者说了解它,登录之后,然后它进行第一次获取到它完整整个链路流程应该是一套完整的闭环内容。那现在还不是吗?那怎么去做完整的闭环?我认为我其实本地好像也在尝试做这个构建,但是我没有太看它最后构建的效果如何。他应该要有一个。哦。输入端,但我觉得输入端其实理论上应该去跟我的那个展示端,应该共用一套视觉风格,可能是更好的方式。但现在其实并没有去做那套风格的展现。

说话人 3
其实用新一套视觉其实还挺长久的,不过这个先视觉层面,我觉得确实不是很急的去搞它。但是不管怎么样,这个闭环要去跑通,那首先是跑通了这种看起来比较复杂的这个链路,那如果不在这样的复杂。这样的流程去做,比如说我,像我的那一个记账软件一样,记账软件其实是做了一个 Web 的网页端。然后我平时在记账的这个过程中。会去打开这个网页,输入我的密码。然后我会把它创建这个桌面的快捷方式,直接在桌面就可以找到它。那理论上我的 capture 它也应该是一个这样的一级入口,甚至未来它可以作为一种 iOS 的形式。甚至可以语音去调度它。

说话人 3
然后有更多的快捷指令去写入它,而不只是说现在的这种,是要还有进行手动操作的方式,甚至我的记账其实也应该可以接入快捷指令。我之前就了解到,记账这种方式完全是可以接快捷指令的。那现在我可能是没有开放接口。他可能做这一系列就不一定有那么的简单。那具体的话怎么做?其实这些还有待思考。但现在我不是在做,没有没有完,没有实现一个完整的计划。那接下来的话,可能在卡斯,这个真的是,如果说作品集展示的层面,它需要有一个这样的入口。点击之后。可以进入到一个这个可能是我现在如果看版的一个记录页,在这里可能要增加一个直接补货的一个功能。在这里进行补货的话,可以直接在线进行数据的解析。像之前这个操作也是借助了豆包,还是出现了。

说话人 3
豆包的话,它是一个,你用了外部 AI 吗?这个问题。是为了节省成本去使用。但其实我自己是有 API 可以用,甚至说还有一些免费的 API 可以用。

说话人 3
然后刚刚梳理了那个 capture 的一个闭环流程,那相当于是说,在这个入口的基础上。其实这个入口完全没有必要新开功能。这些功能的话,可以在,是,比如说品牌升级的那种概念上再去做。然后现在其实要做的只是这个,录入端的一个闭环,就是不依赖豆包的话,那我如何去接一个外部的 API?比如说比如说去,先去接我自己的那个 API 吧,因为虽然那个是付费的,但是它毕竟还有2000多刀的额度。偶尔用用,我觉得应该没有什么问题。啊,关键可能这里需要可能看一下,就是首先这几个都部署在哪里。就比如说我要接大模型的话,其实不需要很复杂,那可能会涉及到一些 API 的配置。那如果它是个网页端的话,那它是不是需要一个后台去接这些内容呢?因为会涉及到后端部署的问题。

说话人 3
之前我好像一直都没有遇到后端不足的那个东西。可能 Cloudflare 好像是可以不足吧?我不太确定。我现在只是那个第一数据库现在满了。10个,然后看一下我这个东西其实是可以跟那个图度的那一数据库结合到一起的。虽然说我有10个数据库已经满了,但是那些数据库其实每个数据库都可以有很多张表,它不一定要是有有那么多独立的项目。它其实很多项目之间是可以有共性的,就比如说 to do,它本身做的事情就跟我这个 capture 很做那些事情很相似。那就没有必要说去单独独立一个第一数据库出来。再有就是这两天不是在搞这个 job 的这个内容的时候,然后也会在这个插件的一个维护上。

说话人 3
还有那个数据库的踩坑上遇到了一些问题嘛,那这些问题其实可以在我其他的数据库维护的这个过程中。有更多的注意的一个细节,包括像我最新的这个岗位,我现在说自己是一个全站,那其实像数据库维护这些知识。还有这些性能的这些,我都应该去注意起来,然后确保没有什么,确保可以跑通吧。然后如果真的是有人看中我全站这方面的素养的话,那我也不至于上手太尴尬。

说话人 3
这里就会涉及到一些名词知识的一个概念化的东西,我觉得可能需要去,不止需要去维护这样的。也不说维护,就是创建这种 AIPM 的看板。在 AIPM 它会有一些围绕,就是信素养的东西,AI 人工智能师的一个概念,因为它会涉及到这个。从模型的接入到模型的维护,然后用量节省,成本的分析。甚至说整个性能的性能的保障啊,还有这个运营这一块知识,还有自动化测试等一系列内容的要点。

说话人 3
还有什么数据监控这一系列内容,其实也都是我日常在关注的范围,虽然说而且我认为我其实已经有多年的这种对于各个项目全栈的这种经验。其实是非常适合这种新型小公司的一个立场吧。我觉得我可能还是比较适合的,只是现在没有匹配到适合的岗位,我觉得可能是我之前的简历确实写得太单调了。是没能体现我有那些能够匹配这些岗位的能力。但当我逐渐去优化,我已经不断尝试把我所谓的产品素养能能表达产品素养的这些能力和能表达我这些开发这些产品的水平都展现出来的话。那其实还是很容易匹配到适合的岗位的。

说话人 3
那话说到这里,其实我觉得我现在正在做的那个简历的系统,以及那个找工作的那个系统,其实很适合跟我当初那个 Molly job 来去做结合。这个 Molly job 的话,甚至我觉得可以自己包装一下,它这个东西就叫 Molly job。我甚至自己都可以做一个网页,就叫 Molly job 就好了。因为它是我一段真实的经历。虽然这个东西最终没有真的和上线推广,但它这个东西确实也是有真实的客群。如果当时有真实的这个项目合作和相关数据的探讨,而且现在遇到了一些问题,也都是我们之前其实遇到过的问题和痛点。那,其实之前在做这种流程设计的时候,就会发现其实更新这件事情是一个非常头疼的事情。不止我们觉得头疼,而且多人,可是甚至模型也会觉得这是一个头疼的事情。相比于完全重新创建一个东西。更新是一件更困难的事情。

说话人 3
那这是关于这个 Molly job 的这个东西,然后可以就想说围绕着这个 AI 系统怎么去做。然后当时还没有那么治,然后就可以讲,就是就当时就可以讲说什么用什么 Browser you Playwright 来去接入。然后去访问更多的岗位。我就可以完全把这一套拿到 Modely Job 那边。去讲。更多简历也可以围绕这个 Molly job 更多内容去讲进去。然后 Molly talk 的话,可以结合我最新的那个 Echo 的那这个语音对话来去更新。甚至我觉得也可以把我那个直接就改成 Molly Talk 对吧?这样的话也会让这个品牌一直是更强烈一点。也没有必要,因为最终我这个也只不过是个原型,可能也不会去推广出去。先这样做也无所谓。甚至可以看一看有没有什么那种便宜、简单一点的 API 来去接入,以防有人白嫖我。

说话人 3
甚至我可以去接这个,在我接那个登录注册之后,看看有没有人用。如果有人用的话,我也可以考虑去出这个付费服务,或者是接那种 token 的服务,就比如说它可以自己绑任何一种 token 我可以就配置那种中台嘛。就是这个是我之前也一直想做,想去做这种中台,就不管我哪个应用都可以去接这种中台,它可以去接任何的密钥配置。然后自己输入他自己的 token 来,去使用我的这个工具。或者是直接我就去做这种。开源的工具,相当于token 你可以用你自己的,然后盒子是用我这个的,你可以在我的官网上进行体验。然后我这个是一个可以供他体验的东西。相当于我画我自己的 token,可以鼓励大家来使用我的这个内容。如果你想用的话,你也可以去给我 star,然后来那内容。

说话人 3
然后我觉得这个其实我有很多个项目都可以去做这几个方向,甚至我之前不还做了那种可视化的一个小说的看板。其实它可以作为我上下,AIGC 上下文工程的一部分。我不是说了吗?我 AIGC 上下文工程涉及到做漫画、做音乐、做什么各种东西,其实连音乐的那个流程也算。只是说他还没有做到。其实我会纠结音乐那个要不要跟我其他的坐在一起。因为它本质上也属于 AIGC 的一个上下文工程,但是它可能会包含更多的自动化任务的部分。然后而且它相对比较独立的点在于它有真实的发行结果,所以说我会比较贪心的把它放出来。但是我不太确定它是是不是值得去拿出来,去单独作为一例来去解释这个事情?然后最近在分享这些内容的时候,我会觉得其实最难的反而是简介,你如何用更少的文字去讲述你更多的内容。

说话人 3
这是一个非常难的事情。包括你在写文章也是,最重要的不是水文字,堆积一些没有用的、没有价值信息的文字,而是要在很短的文字中去表达最多的信息量。我觉得这个是一件非常困难的事情。所以说就会觉得啊,那个之前那个绯闻爆掉的那个事情,就会觉得他们确实还有点水平。甚至我前两天还说我想去把那个 skills,复制下来自己来写文章。但是我现在都没有时间去搞这些东西。包括这些 skills 的维护东西,创作这些内容的事情。

说话人 3
就感觉每天还是一件非常忙碌的事情。我也不知道我现在在做的这种方向到底是不是一个最佳实践的选择。但是就是不知道一天又一天,总感觉每天沉浸在细节,都有很多事情要做一样。可能是它还是不够智能吧,不然它怎么会平白无故还给我带来那么多痛苦呢?嗯,除此之外,昨天在去跟家人聊那个 Moment Flow 的时候,其实还有了一些新的灵感。比如说他那个 Moment Flow。 他能不能去做 AI Moment?比如说一进来,他想创建图表,我不想自己写,因为你自己写这件事情也是件比较困难的事情。

说话人 3
那可不可以?哦,其实我提供了一部分价值,昨天没想到提供了模板的价值。比如说有人想去做这个就是流程图,简单的流程图,他就想去画。所以他就想代码来画,他这个概念也比较小,我觉得。它确实是具备了这样的模板展示的一部分了。但是现在好像确实也是有人在用的,我不太确定这个数据分析。那今天我分享之后,好像确实有人在看,至少每天都有人在体验这个东西,不知道是这个运营已经传播出去了。还是怎么回事。

说话人 3
然后我在想要不要去创建 Flow Chat 这种域名?但我觉得它又有点太局限了。或者叫 AI Flow 这种域名,AI Flow 点 com。我也不太确定哦,就是按理说我这个东西它应该是一个 AI 流程,现在已经,AI 已经这么发达了。那它应该是用 AI 可以创建一切流程的东西。但是我觉得那样可能也有点太麻烦了。我觉得我应该把 AI 功能,AI 功能,甚至说 AI agent 的功能,结合到我这个 Merge Flow 里。然后他就会变成一个围绕这个 Mermaid 流程图的样式来去做操作的东西。那那其实现在还是有不好用的地方。就比如说当初我在分享了这个流程图之后,有一些人来使用,他们觉得,比如说我想修改一个位置。能不能不要去还在呢。我是直接去改这个图表的某一个位置。我觉得他说其实挺有道理的,但是当时其实我精力有限。你有没有维护他?时间好像过了将近一年了吧,这好像是去年做的项目,现在已经稳定运行一年了。

说话人 4
嗯。

说话人 3
我好像缺少个运行日志。算了,运行日志没必要的。然后那现在应该更容易实现了吧?比如说我想去做修改,我点击某一框,我就能定位到某一个位置,它其实只是一个前端的展示而已。就相当于定位到一个框,它那个前端的 DOM 就可以去定位到对应框的一个渲染。然后我编辑了之后,他就去做一个数据的更新和替换,然后他替换到对应位置代码的那个位置。道理说他应该不难学。应该挺好实现的,但是之前确实没有实现它。但我觉得这个如果有精力的话可以尝试去实现一下这个事情。

说话人 3
然后,AI 的话可以直接姐,其实这个只要直接接 AI 的话。就直接就是一个 AI flow 了,就相当于后面后面那些层我都做好了,只是差我输入一个内容。就相当于说,AI 可以帮我生成模板。甚至 AI 可以去创建新的。就比如说我在这个基础上,我想让它去做修改,做完修改之后,甚至我连 deep 都已经做好了。你可以说 AI 修改以前是这样的,AI 修改后是这样的。给他展示两张图来去做对比,甚至说这两张图可以有高亮对比。那这个一个完美的出来了。那甚至我觉得这些服务应该是登录才有服务,因为 AI 实在太贵了,肯定不能让那些套壳的人去反带我这些能力。然后我也不能用太贵的 AI 来做,我可能要备注一下,这个是在用一些很便宜的。我很难做。那我可能要拍一个,比如像 Mini Mac,或者是有没有那种网络上好像有一些免费的那种额度。用那些免费的额度来来搞。然后用免费的额度展示在这,然后登录之后就可以享用 AI 功能。然后登录之后你也可以自己配置自己的。密钥,你也可以不登录也行,你不登录也可以。完全本地接入,就是不会有什么获取你信息的这种担忧。你可以输入你的 token 来去完成这个东西。可以去互相聊一聊,沟通沟通。

说话人 3
看,我这个倒还好,应该不会有什么太大的问题。那这个是 Moment Flow 这一块,然后关于那个白板讲解这个事情。哎,虽然我一直没用起来,但是我觉得它这个功能有的确实还都挺有意思的。比如说它能不能直接在这个白板上,我就说我想去做一个什么样的视频。帮我做一个这样的筹备的材料。像那个家人跟我说,他是不是就像一个 PPT 的作用?我觉得他可能本身就跟 PPT 差不了太多。它只不过进一步整合了这个摄像头的功能而已。然后它本身其实没有什么太大的难度,甚至我在想这个东西其实它最大的作用应该是那比如现在手机端没有。我在手机端能不能实时,我就开起来就开始录,然后这个背景就是一样的。

说话人 3
不会涉及到,如果我想让 AI 进行修改,它能不能去做 deep 修改的一些,更进一步的设置。更友好的配置。更友好的操作这些内容。这都是一些很具象化的一个细节的呈现。但它本质都是服务的人群其实是不变的,它只是有没有一些更性个性化的功能。来去作为一个适合我身为这个 AI 产品经理去展示的能力啊,这样。

说话人 3
嗯。这一路真的是聊了不少。这有不少感觉很有意思的想法。所以真的是不要出来。

录音文档详细总结

这份录音是一场围绕个人自研多个项目技术现状、痛点、迭代规划、产品构想,以及求职简历优化、个人职业定位展开的深度探讨,说话人3作为主要发言者,依次讨论了Capture语音素材收集项目、Molly Job求职项目、MollyTalk、MomentFlow流程图工具、白板类产品构想,同时复盘自身求职困境与全栈/AIPM方向的职业思考。

一、Capture项目:语音/多源素材采集工具

1、当前工作流程(现状)

1. 录音后交给豆包做语音转录,拿到逐字稿、时间戳、人物识别结果;

2. 手动复制原文、AI总结,粘贴到飞书妙记群;

3. 本地自动化任务再将内容同步至云端部署。

4. 除语音外也支持链接抓取,可获取网页原文;小红书等平台需要单独插件适配。

2、现存痛点

1. 操作繁琐,大量手动复制粘贴,没有完整产品闭环,仅有总结看板客户端,缺少完整录入端;

2. 媒体类型支持有限:主要支持文本,图文、视频受存储空间限制没有做适配;音频只保存转录文本,原始音频文件保存在本地;

3. 转录后无法结合时间点实时修改内容;

4. 当前依赖外部豆包AI,没有自建API接入能力。

3、理想&终极形态构想

1. 多素材统一识别:覆盖语音、视频等多种素材;提取音频原子片段,保留素材真实性,不必完整存储体积庞大的视频图片;

2. 完善产品闭环:

◦ 录入端与展示看板共用一套视觉(视觉优先级低,可以后置);

◦ 参考记账软件方案:做网页端,创建桌面快捷入口;未来支持iOS快捷指令、语音调度;

3. 摆脱对外依赖:接入自有/第三方大模型API,利用现有API额度;需要处理后端部署、API配置问题;数据库可复用现有todo项目数据库,不必新建独立数据库,解决数据库已满的问题。

二、求职、简历与个人职业定位

1. 自我定位:自认具备多年全栈项目经验,适合小型AI创业公司,可覆盖模型接入维护、成本分析、性能保障、数据监控、自动化测试、运营等AIPM(AI产品经理)相关能力。

2. 求职问题:过往简历内容单调,没能充分展现全栈、AI产品相关能力,导致岗位匹配度不足。

3. 简历优化思路:把自研项目作为简历核心素材,把项目踩坑、数据库维护、插件开发等实际遇到的工程问题写进简历,体现工程实操能力。

三、Molly Job、MollyTalk系列项目规划

1. Molly Job(求职系统)

◦ 是已有真实客群、有实际项目经历但未正式上线推广的旧项目;计划单独搭建网页,把简历系统、求职系统和它合并;

◦ 将Playwright爬虫抓取岗位的技术方案复用进来,丰富简历中的项目案例;

◦ 项目痛点感悟:内容更新比新建内容难度更高,人和大模型都面临这个难题。

2. MollyTalk

◦ 和Echo语音对话项目合并改造,复用品牌;

◦ 商业化与安全构想:接入登录注册;防止被白嫖;支持用户自行绑定token密钥,做成中台能力,供多个内部项目复用;可开源,允许用户本地填入自己token体验,也可考虑后续付费服务。

四、AIGC上下文工程相关其他项目思考

1. 小说可视化看板属于AIGC上下文工程的一部分;同时还有音乐AIGC流程,带有真实发行结果,但该模块相对独立,纠结是否单独拿出来做案例展示。

2. 内容创作难点:短文本高密度信息输出难度很高,用最少文字传递最大信息量是一大挑战,日常事务繁多,没有充足时间维护技能文档、产出文章。

五、Moment Flow(Mermaid流程图工具)

该项目已经稳定运行一年,目前有用户在持续体验使用。

现有问题

用户体验痛点:想要修改流程图局部元素,必须修改底层代码,不能直接点击图表元素直接编辑。

产品迭代构想

1. AI Flow思路:将AI Agent能力整合进现有Moment Flow,基于Mermaid做AI流程图工具;

2. 交互优化:通过前端DOM定位图表内元素,点击即可直接编辑局部,自动替换对应代码片段;

3. AI能力:AI生成流程图模板、直接修改已有流程图;提供修改前后对比图,支持高亮差异;

4. 权限与成本控制:AI功能需要登录使用,防止被套壳盗用;优先使用低价、免费模型额度;支持两种模式:登录使用平台提供的AI能力,或者用户本地输入自己的token,不收集用户信息。

5. 域名还在权衡,担心域名名字带来功能定位局限。

六、白板类产品的想法

1. 白板工具定位近似PPT,额外集成摄像头录制能力;

2. 期待功能:基于白板直接生成视频筹备素材;补齐手机端能力,手机直接开启录制;支持AI深度修改内容,配置更友好;

3. 项目价值:可作为AI产品经理作品集,体现产品设计能力。

七、整体感悟

手上有大量产品想法,但大量时间消耗在工程细节上;感慨AI工具本应降低负担,但现阶段反而带来不少工作量;很多产品构想已经具备底层基础,主要欠缺前端交互、AI能力接入等落地实现。
查看音频文稿

1. 关于工作流程、项目及求职的探讨(新录音 89.m4a)

Atomic Insight Layer

原子结构层

主题 / 实体 / 概念三层标签 + 逐字原话 + 出链 / 反链。点击 chip 筛选。

主题 实体 概念
全部主题实体洞见
topic-0

录音与采集

主题
topic-1

工作流与自动化

主题
topic-2

AI 工具与 Codex

主题
entity-0

Feishu

实体
entity-1

Doubao

实体
entity-2

Minutes

实体
entity-3

手机

实体
entity-4

关于工作流

实体
entity-5

就比如像现在我去手机录音

实体
insight-0

的,或许他其实对于我那种比如图文和视频的类型,其实对你们支持得不是很友好

洞见
insight-1

,按理说,但现在我其实有一个总结看板的客户端,按理说它其实现在不是一个完整的闭环

洞见
insight-2

用新一套视觉其实还挺长久的,不过这个先视觉层面,我觉得确实不是很急的去搞它

洞见
insight-3

技术接入与部署:考虑不依赖外部AI,接入自有API,关注后端部署,合理整合数据库,避免重复建设

洞见
insight-4

这里会涉及到几个维度,比如说你的真是不是不够真实了

洞见
Normalized Tags

规范标签与同类归并

把 topic / semantic / source / entity 放到分组标签里,后面做筛选、聚类和同类合并时会更稳。

Normalized Topics
录音与采集工作流与自动化AI 工具与 Codex
Normalized Entities
FeishuDoubaoMinutes手机关于工作流就比如像现在我去手机录音
Normalized Provenance
Xiaohongshu
Normalized Semantics
时间线同步岗位方向周中复盘游泳
Normalized Channels
我的录音
Normalized Sources
录音转写feishu_text