完整原始转录 · 音频文稿点击展开
昨天刷GitHub看到一个项目,差点以为眼花了
52,000颗星,6,800个Fork。
一个叫minimind的开源项目。
它做的事情很简单:
让你用2小时,从零训练一个自己的大模型。
不是拿现成模型微调。
是真正的从零开始——下载数据集→写训练代码→跑训练→得到一个能对话的LLM。
64M参数,单张显卡就能跑。
作者还写了完整的教程,每一步都解释为什么这么做。
我第一反应是:这东西有什么用?
又不是GPT-4,64M能干嘛?
但仔细想了一下,它的价值不在"跑得多好"。
在于:以前"从零训练大模型"这件事,只存在于顶级实验室的PPT里。
现在你打开笔记本电脑,2小时后,你有了一个自己训练的AI。
就像一个厨师学徒,以前只能看大师傅做菜。
现在终于能自己从切菜开始走一遍完整流程了。
叫minimind,GitHub搜就有。#多模态人工智能[话题]# #开发[话题]# #AI人工智能[话题]#
昨天刷GitHub看到一个项目,差点以为眼花了 52,000颗... http://xhslink.com/o/9vBTu0zfxC4 先复制这段文字,再进【小红书】查看完整笔记。
resolved_url: https://www.xiaohongshu.com/explore/6a476c5d000000001700a720
xhs_capture_status: success