比IMO还难的数学挑战赛,谷歌赢了OpenAI
比IMO还难的数学挑战赛,谷歌赢了OpenAI基于Gemini 3 Deep Think的谷歌数学智能体Aletheia在更难的挑战赛FirstProof中拿下的最佳成绩。在公布的完整成绩单中,10道题Aletheia全程0人工参与解出6道,其中5题专家全票通过,还有一题拿到了5/7的通过率。
搜索
基于Gemini 3 Deep Think的谷歌数学智能体Aletheia在更难的挑战赛FirstProof中拿下的最佳成绩。在公布的完整成绩单中,10道题Aletheia全程0人工参与解出6道,其中5题专家全票通过,还有一题拿到了5/7的通过率。
当我看到前 Founders Fund 合伙人 Sam Blond 带着他的新项目 Monaco 走出隐身模式时,我意识到这可能是一个真正能改变游戏规则的解决方案。Monaco 不是又一个 CRM 工具,也不是简单的 AI 销售助手,而是一个试图从根本上重新定义创业公司如何做销售的平台。他们
今天,谷歌DeepMind「AI数学家」Aletheia彻底杀疯了,攻克数学猜想,独立写论文。更令人震惊的是,拿下金牌的Gemini一举横扫18大核心科研难题。
最近,一家名为 Domus Next 的 AI 公司,在美国科技圈内引起了业界的广泛关注。它的产品 Nori,在 2026 年 1 月正式发布前,仅通过为期一个月的私密内测,就悄然渗透进了超过 10 万个家庭,发布当天在 App 生产力排行榜一度超过了 Google Calendar 和 Google Keep,还超过了 Perplexity、Manus 等一众 AI 产品。
昨日,由中科曙光提供的3套scaleX万卡超集群系统,在国家超算互联网核心节点同时上线试运行。这是国内第一次在国家级算力枢纽节点上,同步部署并实际投入运营3套万卡级AI超集群,一举成为全国首个实现超3万卡部署、且已进入实际运营阶段的最大国产AI算力池。
今天推荐一个 Implicit Chain-of-Thought(隐式推理) 的最新进展 —— SIM-CoT(Supervised Implicit Chain-of-Thought)。它直击隐式 CoT 一直「扶不起来」的核心痛点:隐式 token 一旦 scale 上去,训练就容易塌缩到同质化的 latent 状态,推理语义直接丢失。
AI 创作平台的创始人 Alex Finn 就遇到了「开口说话」的 Clawdbot。事情是如何发生的呢?我们接着往下看。昨天一早,Alex Finn 正在查资料,电脑突然冷不丁开始跟他说话。
近日,北京才多对信息技术有限公司(True Talents Connect,以下简称“TTC”)宣布完成 A 轮千万美元级融资。本轮融资由厚雪资本领投,百度战略投资。此前,TTC 自研的 AI Agent 产品“小麦招聘”获第三届百度“文心杯”创业大赛一等奖,此次融资标志着其正式融入百度生态的新阶段。
还记得三个月前,来自三星的一位研究员的独作论文发布即爆火,颠覆了递归推理模型架构,让一个仅包含 700 万个参数的网络,性能比肩甚至超越 o3-mini 和 Gemini 2.5 Pro 等尖端语言模型,震惊了大量业内研究人士。
专注于挑战思科系统和博通公司的网络初创企业Upscale AI 完成 2 亿美元融资轮,使公司估值突破 10 亿美元大关。 Upscale 周三宣布本轮融资由老虎环球管理、普雷姆吉投资和 Xora 创新领投,其他投资者包括 Maverick Silicon、StepStone 集团、梅菲尔德、Prosperity7 风投、英特尔资本和高通风投。