三个月连融两轮,日卖数万亿Token!独家对话魔形智能创始人
三个月连融两轮,日卖数万亿Token!独家对话魔形智能创始人模型都开源了,为什么Token工厂反而更值钱?
搜索
模型都开源了,为什么Token工厂反而更值钱?
只做一次生成器前向,就能得到一张图,这是一步生成追求的效率。但想把采样步数降到 1,难题其实在训练端:怎样用足够稳定、简单的监督信号,让生成分布靠近真实分布?
过去两年,self-reflection、self-correction、self-play、agentic RL、skill learning、test-time adaptation、open-ended evolution、self-evolving agent等概念不断涌现。
世界模型是物理原生智能(Physics-native Intelligence,Phi)重要的组成环节。
希望能做一个各个模型评分排行的汇总,方便实时了解和对比各种模型的性能。这个是一个非常有趣、且对我自己非常刚需的需求。因为现在的模型评测排行榜、评测集等等,实在是太多太多了,人人其实都可以做一份自己的评测集,然后来跑一份模型排行榜,有的测的全一些,有的就是个垂直场景的特定任务,这个量级真的特别大。
10万亿参数的GPT-6,即将于本月发布!就在刚刚,X上传来惊爆消息。AI内幕记者ChrisGPT爆料,即使顶着政府审查的压力,GPT-6 (Astra)仍将在8月发布。GPT-6,就是昨天OpenAI紧急暂停发布的模型Astra。
8 月 9 日,长期关注 OpenAI 模型动向的 X 用户 ChrisGPT 爆料称,OpenAI 正在推进一个代号为 Doug 的新一轮大型预训练模型。按照他的说法,Doug 将是 OpenAI 迄今规模最大的一次预训练项目,而且它与 GPT-6 并不是同一个模型。
“蒸馏”一词再次成为舆论的关注焦点。这一次,站在聚光灯下的不是多次指控国产模型蒸馏的强硬派Anthropic,而是久未公开露面的张一鸣。张一鸣在最近的字节全员会上罕见发话:字节宁愿忍受模型的落后,也不希望依赖蒸馏实现短时的智能爬坡。
离开 OpenAI 不到一天,研究员 Andrew Ho 在 X 上写下一篇长文,质疑整个前沿 AI 实验室的商业模式。「前沿 AI 实验室赚的钱,或许根本撑不到 AGI 到来。」AI 圈知名播客主持人 Dwarkesh Patel 随后发文反驳:只要模型能力仍在快速增长,领先本身就能创造巨大的商业价值;一旦真正的 AGI 出现,它就会主动扩散。
今年,由倪赞林担任第一作者,王慎执、乐洋共同参与的《The Flexibility Trap》获得 ICML 2026 Outstanding Paper Award。ICML 2026 投稿量达到创纪录的 24,000+ 篇,仅评出 2 篇 Outstanding Paper,该论文成为ICML历史上首篇完全由国内单位学者完成的获奖成果,为更好地理解和设计扩散语言模型做出了重要贡献。