刚刚,Anthropic首次承认内部存在更强前沿模型,同时自曝多起AI失控事故。
刚刚,Anthropic首次承认内部存在更强前沿模型,同时自曝多起AI失控事故。Anthropic刚刚发布了一份长达186页的最新Risk Report。如果只是快速扫一眼,这仍然是一份典型的前沿AI安全报告:模型能力评测、生物风险、网络安全、自动化研发、对齐问题,以及各种防护措施。
搜索
Anthropic刚刚发布了一份长达186页的最新Risk Report。如果只是快速扫一眼,这仍然是一份典型的前沿AI安全报告:模型能力评测、生物风险、网络安全、自动化研发、对齐问题,以及各种防护措施。
近日,Oh My Pi 作者 can1357 在 X 上发文,展示了利用模型 API 漏洞,直接提取 GPT-5.6、Claude Fable 5 等顶级模型完整内部推理记录的方法。他发现,做到这些并不用破解加密,只需要关闭模型的隐藏思考,再给它一个思考工具,就能让模型主动输出内部推理格式。
OpenAI 官方公告,包括 OpenAI、Anthropic、Google、Meta、Microsoft 在内的一大批公司,签署了欧盟《AI 生成内容透明度行为准则》,承诺推进 AI 生成内容的标记与检测。看起来 AI 内容马上也要有「署名」了。
前不久用Fable 5推翻雅可比猜想的Anthropic研究员,又吭哧吭哧和两个人类伙伴带着Claude,做出了668阶哈达玛矩阵!(好数学家不挑AI模型,doge)不过这人每次有成果都不明说,发一堆只有内行才看得懂的东西。
视频模型这个月很热闹。7 月 31 日,MiniMax H3 和字节跳动 Seedance 2.5 同日发布。3 天后,MiniMax H3 正式开源;8 月 7 日,Seedance 2.5 开放 api。模型越来越好了,但产品能把它用好吗?
8 月 11 日,xAI 联合创始人伊戈尔·巴布什金(Igor Babuschkin)创办的 River AI 宣布完成 11 亿美元融资。这笔资金横跨种子轮和 A 轮,由 General Catalyst 和 AMP PBC 领投,英伟达、AMD Ventures 战略投资,Y Combinator 和淡马锡等参与。
根据Polymarket预测,Anthropic很可能在10月底进行IPO。有投行人士甚至预计,Anthropic可能通过IPO募集超过600亿美元。如果成真,这将是全球规模第二大的IPO,仅次于今年募集857亿美元的SpaceX。
AI智能体训练平台Bespoke Labs宣布已完成4000万美元融资,其中A轮由Wing VC领投,Mayfield、The House Fund、dbt Labs CEO Tristan Handy,以及来自Anthropic、OpenAI和Meta的其他天使投资人参与
DeepSeek官方版还在路上,民间「最佳Harness」已经先杀出来了!(卷死算了.jpg)项目名叫「Pi」,一款在GitHub狂揽揽揽揽揽约8.6万Star的开源编程Agent。项目之所以so火爆,主要还是因为这玩意儿太《省》了。。。
8 月 2 日起,Claude 生成的每一段文字都将携带隐形水印。水印嵌在文本的统计分布里,复制粘贴也会被带走,部分编辑也抹不掉。Anthropic 周一在帮助文档中公布了这项计划。触发它的是欧盟 AI 法案 Article 50 的透明度要求——生成式 AI 提供商必须标记输出内容。