昨晚刷到这条消息的时候,手抖了一下。
2.8万亿参数,全球首个开源的三万亿级别模型。
说实话,看到这个数字的第一反应是——真的假的?
不是我不信月之暗面,是这步子迈得有点大。
上一回使用Kimi之际, 是处于撰写周报之时, 当时感觉它蛮机灵的, 只是尚未达到这般程度。
你可能跟我一样,对“万亿”这个单位已经麻木了。
然而换一种表述方式: 这个东西能够一口气将整个维基百科读完, 并且还能够记住三个月之前和它进行交流时其中的某个细节哪。
不是夸张,参数多到这种程度,记忆力和理解力已经不是问题了。
问题在于——你跑得动吗?
这才是让我真正在意的点。
模型开源是一回事,能不能用是另一回事。
华为所言极快适配零日漏洞, 此所指之意为, 于模型发布当日, 昇腾便可运行。
你或许对Atlas 800 A3这个名字不太熟悉, 你或许对Atlas 900 A3这个名字也不太熟悉。
但“国产芯片跑国产大模型”这件事,懂的都懂。
以前总有人说,我们模型做得好,但硬件跟不上。
此刻, 昇腾950超节点对包括FP8、MXFP8、MXFP4在内的全系列精度格式予以支持, 并且原生支持Kimi K3的mxFP4量化。
翻译成人话:你用更少的显存,跑更大的模型。

不是所有人都需要自己训模型。
但所有人都能免费下载、部署、魔改。
这回月之暗面将高性能通信, 高性能算子, 分布式RL环境这三项核心技术全部进行了开源。
以前这些是各家公司的秘密武器,现在你也能拿到。
对于做AI应用的人来说,这等于拿到了造火箭的图纸。
短期看,别指望手机能跑。
但长期看,所有用Kimi的产品都会变聪明。
写代码、查资料、做分析,这些场景的提升会很明显。
K3面向的就是“长程编程、知识工作、推理”这些场景。
说白了,就是帮你干那些需要动脑子、花时间的活。
开源这件事,月之暗面不是第一个,也不会是最后一个。
但把三万亿参数级别的模型开源,确实是头一回。
有人说这是为了抢占生态位,有人说这是技术自信。
我觉得都有,但更关键的是——你终于可以自己试试了。
不用等厂商适配,不用看脸色,下载下来就能跑。
这种感觉,很久没有了。