AI Dating都是衡水中学
AI Dating都是衡水中学作者三文盐体验良配等AI Dating产品后指出,AI Dating已演变为衡水中学式做题相亲,AI军师与提效机制无法解决情感茫然与真实人际连接的本质。
搜索
作者三文盐体验良配等AI Dating产品后指出,AI Dating已演变为衡水中学式做题相亲,AI军师与提效机制无法解决情感茫然与真实人际连接的本质。
地铁急刹,金属尖叫,广播响起「请乘客注意扶稳」,人群骚动、孩子哭声、对讲机杂音一层层涌上来···
晚上下班,你正百无聊赖地坐在地铁里玩着你的手机。
忍!不!了!了! 你老A社天天一会儿AI要失控、一会儿互联网要完蛋,转头自己IPO、融资、扩算力,一个都没耽误??
北航、南方科技大学、复旦大学、北京理工大学、爱丁堡大学等 8 家机构的 19 位研究者联合完成 Theory of Agent 综述,讨论模型内部与外部 harness 应如何分配能力,并据此梳理 LLM Agent 的学习、对齐、演化与评测。
“智能并不局限于大脑内部。当我们使用纸笔或地图来梳理复杂问题时,这些外部工具就成为了我们‘延展的心智’。”
把 On-Policy Distillation(在线策略蒸馏,OPD)的训练集从 17000 道题删到 1 道,会发生什么?
OpenAI的GPT-6 Sol已在API中被发现并处于内部测试阶段,预计本月与Anthropic的Opus 5.2同期上线,实测显示其性能逼近GPT-6 Astra但调用成本更低;OpenAI核心研究员Noam Brown在播客访谈中透露,公司已将AI递归自我改进(RSI)确立为第一优先战略目标。
OKEight(回了么)是程梦琪团队开发的AI回复工具,它为每位联系人维护本地人物卡,学习用户与不同人的沟通风格,在Mac端读取当前对话生成候选回复,并记录未完成的约定和事项。
过去两周里,「循环深度」这个词变成了 AI 安全讨论的焦点。
成立才一个多月,估值就要冲到 500 亿美元。
刚刚,生数上线了最新的 实时视频模型 S2,输出提高到 720p,保持 25—42 FPS,包含下面两款:
DeepSeek资深MLSys工程师刘胜与深夜发文,坦承刚完成V4.1核心算子交付后,意识到AI已能自主编写和优化GPU算子,正迫使他从手写底层算子转向驾驭AI Agent的"机甲驾驶员",并警示工程底层能力空心化可能带来系统性风险。
OpenAI计划以3亿美金收购由前苹果工程师创立的AI影像公司Glass Imaging,以补充端侧视觉能力,布局多模态AI硬件。
大模型过去几年的能力跃迁,几乎都围绕一个词:Scaling。
Token词元替代了Byte字节,但不意味着大模型都得是Token。
人类密码学界,要破防了?
Agent爆发时代,我们需要什么样的AI计算底座?
就在刚刚,飞书和豆包工作一起,开了他们的全新发布会。
小宇宙想要「强而久」。
过去两周,AI圈最让人坐不住的三个字母,就是RSI。
“在 MBZUAI 读研,是世界上最好的工作。”
Astra 惊艳之后,具身公司还有护城河吗?
真实家庭任务往往从「不完整的信息」开始:机器人不知道目标在哪里,用户也未必能一次说清自己想要什么。面对「帮我从餐桌上拿点零食」这样的模糊指令,机器人不仅要主动寻找候选物体,还要在发现面包和多个甜甜圈后进一步询问用户,确认究竟该拿哪一个。
AI 的竞赛正在经历一次深刻的转向。过去两年,行业目光从“卷参数”转向“卷推理”,如今新的分水岭已经显现:AI 能否从数字世界走进物理世界,真正去“行动”?
多轮智能体任务只有一个终点奖励,但在一条包含搜索、工具调用和多轮决策的轨迹里,决定成败的往往是一个不起眼的查询词、动作或对象选择。
英伟达CEO黄仁勋在洛杉矶All-In Summit上接听特朗普现场来电,明确表示"绝不让AI减速",并就AI安全工程化、开源重塑中美AI竞争、英伟达向模型与基础设施两端延伸等议题展开近50分钟讨论,坚持放慢AI发展是错误策略。
Claude Code 里,已经有人玩起了俄罗斯方块。不是另外打开一个游戏窗口,游戏直接出现在 Claude Code 的界面里。
「人类造的最后一个 AI」还有多远?OpenAI、Anthropic 等头部厂商进度如何?定义中国 RSI 的 roadmap——前沿 AI 研究机构 Theseus Labs 结合 72 家产业实践,推出「RSI 五级框架」
AI 虚拟伴侣,走进恋综了。