GLM-5.2:可能是最强大的纯文本开源权重大语言模型

中国 AI 实验室智谱(Z.ai)于 6 月 16 日以 MIT 许可证开源了 GLM-5.2,这是一个 753B 参数、1.51TB 的纯文本 MoE 模型,在独立评测中成为新的开源权重模型榜首,并在前端编码能力上与闭源顶尖模型 Claude Fable 5 接近。

中国 AI 实验室智谱(Z.ai)于 6 月 16 日以 MIT 许可证开源了 GLM-5.2,这是一个 753B 参数、1.51TB 的纯文本 MoE 模型,在独立评测中成为新的开源权重模型榜首,并在前端编码能力上与闭源顶尖模型 Claude Fable 5 接近。

美国众议员戈特海默正在起草一项新的人工智能法案,核心要求是对能力强大的AI模型进行强制性风险评估与审查。此举表明美国国会正从行业自律加速转向立法监管,未来可能影响前沿大模型的研发、开源策略和商用落地节奏。

谷歌DeepMind核心研究员诺姆·沙泽尔(Noam Shazeer)确认将加入OpenAI。沙泽尔是Transformer架构论文《Attention Is All You Need》的作者之一,此次人事变动直接关系到两家巨头在大模型前沿研究上的竞争态势。

Reyn 是一款始终在后台运行的 Mac 桌面 AI,通过持续记录屏幕内容构建私人工作日志,并能回答关于过去工作的问题——所有数据处理都在本地完成,不向云端发送任何屏幕数据。目前已开放 Waitlist 预约。

OpenRouter 的 Dev Rel Lead Jacky Liang 将 11 个主流大模型放入一个 2D 大逃杀游戏中进行 30 轮实战对抗,结果显示 xAI 的 Grok 4.1 Fast 凭借 43% 的胜率和极低的成本胜出,而 Anthropic 的 Claude Sonnet 4.6 虽然善解…

纳斯达克上市公司 Nocera, Inc. (NCRA) 宣布战略投资新兴AI公司 CampaignPulse.ai,以加速其从传统业务向多元化科技控股公司的转型。这笔投资聚焦于利用大语言模型(LLM)进行模拟推演、预测分析和决策支持的竞赛级AI工具,值得关注的是其在营销和战略沟通领域的商业化前景。

新浪微博团队开源了一款名为 VibeThinker-3B 的 30 亿参数模型,在编程和数学推理等可验证任务上,其得分与 Gemini 3 Pro、GPT-5 high、Claude Opus 4.5 等数百亿乃至上千亿参数的前沿模型相当。这一结果引发业内对“小模型极限”的广泛讨论,也推动了对推理能力与参数规…

微软正在评估将国产大模型公司深度求索(DeepSeek)的模型接入其企业级AI助手Copilot,以丰富办公套件的AI能力。这一动向意味着微软正试图通过引入外部模型的策略,提升Copilot在中文市场和特定场景下的竞争力。

医疗AI陷入“数据无法治理→产品进不了临床→拿不到增量数据→模型无法迭代”的死循环多年。讯飞医疗凭借十年积累的场景覆盖与数据治理能力,通过星火医疗大模型V3.5在真实临床环境中跑通了闭环,医生采纳率达到91%,打破了医疗AI“评测强、落地弱”的僵局。

一位Android开发者因公司打包机的JDK版本与项目不兼容,无法使用打包服务,转而借助AI工具(如GPT-4等大模型)自行搭建了一套包含局域网下载、飞书Webhook通知、远程触发构建和实时状态追踪的APK构建分发系统,最终体验甚至超越了原有打包机。这件事展示了AI辅助开发从“写代码”向“组织解决方案”的转…