硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响!
硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响!浪潮信息在AICC 2026发布搭载128芯本土AI芯片的元脑SD200 Ultra超节点AI服务器,通过超级算子融合技术将2.8万亿参数Kimi K3的Token生成时延降至5.85毫秒,与海外Inferact以"巨内核"路线共同打响万亿参数模型推理效率战。
搜索
浪潮信息在AICC 2026发布搭载128芯本土AI芯片的元脑SD200 Ultra超节点AI服务器,通过超级算子融合技术将2.8万亿参数Kimi K3的Token生成时延降至5.85毫秒,与海外Inferact以"巨内核"路线共同打响万亿参数模型推理效率战。
截至2026年9月,实测整理出16个仍可免费获取Token的渠道,按限时活动、长期免费层、国内平台额度三档分类,涵盖阶跃星辰Step 5、Qoder、Cline、Gemini API、GitHub Copilot、Kilo Code、OpenCode、Groq、Cerebras、火山引擎、阿里云百炼、腾讯云混元、百度千帆、智谱及硅基流动等平台。
欧洲开发者 Mario Zechner 开发的极简 Coding Agent Harness Pi 只给模型一个 bash,却在多项 Benchmark 中击败 Claude Code 和 Codex,凭借极简设计和高可扩展性在 2025 年底爆火,团队来自维也纳而非硅谷。
硅谷DrivingBench测试中,从未专门学过开车的通用大模型GPT-6 Astra操控改装丰田卡罗拉以5分22秒通过锥桶摆出的科目二考场,成为全场唯一通关的大模型,而Claude Fable 5.1、Grok 4.6和GPT-5.6 Sol均未通过。
OpenAI旗下编程智能体Codex于周五下午全面宕机68分钟,硅谷程序员被迫提前收工,OpenAI随后为所有付费用户重置额度作为补偿。
Eight Sleep联合创始人Matteo Franceschetti与Alexandra Zatarain在对话中介绍其AI智能床套Pod的动态液冷温控、健康异常预警和FDA申请进展,并分享进入中国市场后成为增长最快市场及产品定价策略方面的思考。
9月18日,亚马逊云科技官宣,旗下大模型服务平台Bedrock正式托管Kimi K3。国产模型上线海外云平台并非新鲜事。但是作为开源模型,开始让美国云厂商愿意"交钱" ,Kimi确实是独一份。
今年以来,RSI(Recursive Self-Improvement,递归自我改进)逐渐从硅谷前沿话题,演变为全球共识。
硅基流动拿下B+轮二期、C轮融资,港股IPO在路上。
就在今天,整个硅谷都被Jev刷屏了!发布仅三天,它就被Vercel、Cloudflare和LangChain等主流平台迅速集成,有人说,我们即将迎来自动化智能的大爆发!而这场狂欢的主角,竟然是一个不会说话的大模型。