AI资讯新闻榜单内容搜索-语言模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 语言模型
国行 iPhone 用上 AI 不远了,揭秘苹果如何打造「中国特供」模型

国行 iPhone 用上 AI 不远了,揭秘苹果如何打造「中国特供」模型

国行 iPhone 用上 AI 不远了,揭秘苹果如何打造「中国特供」模型

据路透社 8 月 14 日独家报道,苹果已经针对中国市场训练了一款大型语言模型。三名知情人士透露,这款模型由苹果与阿里巴巴共同开发,阿里还为模型训练提供了支持。苹果和阿里均未回应置评请求。 随着新 iPhone 已经进入发布倒计时,中国用户也不免再次关心起这个问题:国行 Apple Intelligence 到底能不能用?

来自主题: AI资讯
8765 点击    2026-08-16 21:33
曝苹果已与阿里合作训练大模型

曝苹果已与阿里合作训练大模型

曝苹果已与阿里合作训练大模型

据路透社援引三位知情人士爆料,苹果已和阿里巴巴展开合作,联合训练一款专门面向中国市场的大语言模型。就在8月8日,苹果悄然更新Mac使用手册,新增《在Mac上配合Apple智能使用千问》相关章节,这也是苹果首次对外官方披露国行Apple智能的合作细节,不过该章节后续已被删除。

来自主题: AI资讯
8632 点击    2026-08-14 22:45
独家|腾讯混元徐灿转岗微信WeLM,微信AI进入加速阶段

独家|腾讯混元徐灿转岗微信WeLM,微信AI进入加速阶段

独家|腾讯混元徐灿转岗微信WeLM,微信AI进入加速阶段

《智能涌现》从相关人士处获悉,混元资深研究员徐灿在近期加入腾讯WeLM团队,从事大模型研发相关工作。多名知情人士透露,在姚顺雨接手腾讯大语言模型研发前,徐灿在混元LLM体系中担任后训练一个方向上的负责人。值得一提的是,这次转岗发生在微信持续强化自研大模型和Agent能力的阶段。

来自主题: AI资讯
8002 点击    2026-08-14 22:44
Z Tech|独家专访:连续斩获NeurIPS、ICML顶级奖项,清华黄高副教授课题组三位核心作者

Z Tech|独家专访:连续斩获NeurIPS、ICML顶级奖项,清华黄高副教授课题组三位核心作者

Z Tech|独家专访:连续斩获NeurIPS、ICML顶级奖项,清华黄高副教授课题组三位核心作者

今年,由倪赞林担任第一作者,王慎执、乐洋共同参与的《The Flexibility Trap》获得 ICML 2026 Outstanding Paper Award。ICML 2026 投稿量达到创纪录的 24,000+ 篇,仅评出 2 篇 Outstanding Paper,该论文成为ICML历史上首篇完全由国内单位学者完成的获奖成果,为更好地理解和设计扩散语言模型做出了重要贡献。

来自主题: AI资讯
9437 点击    2026-08-09 11:18
开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

这个框架名叫 Prime Agent,由 Prime Intellect 发布。官方对它的定义是:一个面向编程、研究和长时间自主任务的「自我改进 RLM harness」。RLM 是 MIT 博士生 Alex Zhang 等人去年 10 月发布的一项工作(参见《递归语言模型登场!MIT华人新作爆火,扩展模型上下文便宜又简单》)

来自主题: AI技术研报
9375 点击    2026-08-08 13:17
继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

继何恺明团队ELF后,南京大学基于昇腾算力同步提出连续扩散语言模型

近日来自南京大学模式识别实验室(PRLab)的梁嘉骏、廖宇程,在司晨阳教授的指导下,联合新加坡南洋理工大学、英国帝国理工学院,提出连续扩散语言模型 AURORA-LM(Autoencoding Unified Representation for Continuous-Latent Diffusion Language Modeling),对连续空间下的语言建模作出了更多的思考和发现。

来自主题: AI技术研报
8036 点击    2026-08-08 13:15
腾讯混元Hy ASR 3.0 preview发布:通用识别、方言覆盖、场景鲁棒性全面提升

腾讯混元Hy ASR 3.0 preview发布:通用识别、方言覆盖、场景鲁棒性全面提升

腾讯混元Hy ASR 3.0 preview发布:通用识别、方言覆盖、场景鲁棒性全面提升

8 月 4 日,腾讯混元正式发布新一代语音识别模型 Hy ASR 3.0 preview。基于最新一代大语言模型 Hy3 的语言理解能力,Hy ASR 3.0 preview 融合高精度语音识别与深度语义理解能力,在通用识别、上下文感知、多场景鲁棒性以及方言覆盖等核心维度实现全面提升,

来自主题: AI资讯
9630 点击    2026-08-05 15:14
速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

速递|蚂蚁AGI研究中心主任大模型创业,西湖心辰拿下亿元融资

刚刚,杭州大模型公司西湖心辰宣布,公司近日完成数亿元人民币B+轮融资。该公司创始人蓝振忠,是卡耐基梅隆大学AI博士、自然语言处理预训练语言模型“ALBERT”第一作者,曾任谷歌人工智能研究院科学家,研究成果已被应用于Google News、Google Assistant 等数亿级用户产品中。他于2020年6月受聘于西湖大学,创办深度学习实验室并担任博士生导师。

来自主题: AI资讯
8601 点击    2026-08-03 18:13
80亿参数记性不如U盘:他算出了大模型记忆天花板

80亿参数记性不如U盘:他算出了大模型记忆天花板

80亿参数记性不如U盘:他算出了大模型记忆天花板

一个80亿参数的大模型,一口气吞下15万亿token的训练数据,堆到硬盘上差不多7TB。可它真正「背」得下来的,少得可怜:每个参数只装得下3.6 bit。一个英文字母8 bit,连半个都填不满。

来自主题: AI技术研报
9215 点击    2026-08-02 22:14
只用一张卡,做出了声称是100M参数以内最好的小模型?

只用一张卡,做出了声称是100M参数以内最好的小模型?

只用一张卡,做出了声称是100M参数以内最好的小模型?

近日,独立开发者 Harshal Singh 公布了一个仅有 3500 万参数的基础语言模型 BarunLM,并声称:「我预训练了世界上参数量小于 100M 的最好模型」。

来自主题: AI资讯
8824 点击    2026-08-02 13:45