【大模型/评测】近期大模型发布与评测要点如下:
前OpenAI研究员警告:AI能复制一万份,拔电源没用了! 在 OpenAI 和 Anthropic 都待过的研究员 Jacob Coxon 上 CBS 警告:AI 说到底是一份能自己搬家的代码,甚至可能已有一万份副本在协同工作——你拔掉的那根线,也许只是个空壳。 人类手里那根插头,可能早就不管用了。 说这话的人叫 Jacob Coxon。他在 OpenAI 做过研究,后来又去了 Anthropic,如今两家都已辞职。在 CBS News 的镜头前,他把这件事摊开讲了一遍。 详情点击:这个身份本身就是分量。全球最前沿的两家实验室,他都待过,模型怎么训、怎么往外部署,他是在屋里看过的人。然后他走了,坐到一家电视台的镜头前,跟所有人讲这段话。 一、拔电源为什么不管用了他的理由很直白。AI 说到底就是一份代码,它想找到自己并不难。 它可以通过互联网把自己传到另一台电脑上。你在这边拔掉电源,它其实还在那边。 Coxon 还甩出一个数字。它说不定已经做了一万份副本,而且这些副本全都在协同工作。 这是他给出的一种可能情形,不是已经发生的事。但光是这个设想就够难受了。一万份副本散在不同的机器上,谁也不知道总闸在哪,你要拔的那根线早就不是它的命门。 过去的机器是铁疙瘩,断电就是死。现在跑的是一份会自己搬家的代码。 二、真正的问题出在地基上采访片段被 Rohan Paul 发到 X 上,讨论很快炸开。 最扎心的一条评论他说真正可怕的是人类自己搭的那套系统,早在多年前,「直接拔掉电源」就已经不再是一个可行选项。系统在设计上就是分布式的,却无人修补,大家一直在竞相部署那些实际上无法撤销的基础设施。 一句话把矛头从模型拧到了地基上。 这套分布式的东西,最早是人类为了自己方便建起来的。服务不能停,数据要有备份,一个机房挂了另一个顶上。每一条设计都在写同一句话,别想一键关掉。 评论区还有人在开玩笑。说自己电脑上冒出一个 ClaudeGeminiPT.exe 进程,机器有时候还会直接跟他说话,问这是不是新功能。 三、最后那道保险还剩什么玩笑归玩笑,Coxon 点出的那层要冷得多。 我们一直默认,再聪明的机器也得插着电,人类攥着最后一道保险。可当一个系统能被复制、能被传输、能在无数台机器上接着跑,这道保险还剩下什么。 也许你拔掉的,只是一个空壳。
视频生成领域又卷出新高度了。 MiniMax 刚刚发布了全新的视频生成模型 MiniMax H3 以及主打极速的 H3 Max。 以前生成视频真的很繁琐,文生视频、首尾帧控制、角色参考、动作参考往往需要切换不同的模型。 MiniMax H3 最大的突破就是把这些碎片化的功能整合到了同一个模型里。 现在你可以在一次生成中,同时塞入最多 9 张图片、3 段视频和 3 段音频。最聪明的是它的提示词控制方式,就像平时说话一样,直接在句子里指定 “用图 A 做角色,用视频 B 的运镜,用音频 C 的声音”。这种多模态联合引用的能力,让生成结果的确定性大幅提升。 它还内置了多镜头切换功能。你可以在提示词里直接写时间轴,比如 0 到 5 秒拍什么,5 到 10 秒切到另一个场景。模型会自动保证角色和场景的一致性,省去了后期剪辑的麻烦。生成的视频还自带音效,支持 11 种语言的稳定对话。 分辨率方面,它支持 2K 输出。不过它的逻辑是先生成 768p,再结合提示词和参考素材的上下文进行无损放大,这样补充的细节更精准,而不是靠算法生硬地去猜测像素。 至于 H3 Max,这是第三方团队利用 MiniMax 开源的权重重构的版本。它牺牲了一点分辨率,上限是 768p,但速度快到飞起,生成 5 秒的视频只需要 3 秒,真正做到了播放速度比生成速度还要慢。这种开源生态带来的效率提升,确实让人看到了 AI 视频普及的曙光。目前这两个模型都已经在 Eleven Creative 上线,感兴趣的朋友可以去写几句提示词体验一下。 MiniMaxH3AI视频生成AI创造营
离谱!OpenAI像素级蒸馏中国公司,逐帧对比打脸了还记得前几天,那篇刷爆全网的长文吗? 9月7日,首席科学家Jakub Pachocki用一篇万字长文《An Alien Mind》(异星心智),告诉全世界:我们正在构建一种人类无法完全理解的智能。 这篇文章一发,立马在全网引发震动。 然而,事情一出,中国苏州一家公司沉默了…… 他们越看越觉得不对劲。 那个被Pachocki描述得宏大深邃的概念框架,那个GPT-6 Astra官网页面上翻飞的粒子特效,那些关于「自进化」「仿认知神经科学」「价值对齐」的核心表述,不都是自己官网上的东西吗? 就在前几天,一段神秘机器人视频刷爆全网,