阿里发布Token Plan个人版,Qwen3.8-Max-Preview同步上线

7月19日,阿里巴巴正式推出Token Plan个人版,并同步开放了拥有2.4万亿参数的Qwen3.8-Max-Preview模型体验。这意味着阿里将大模型的调用从“按API调用付费”进一步推向“订阅制套餐”,同时用巨型模型拉高代码工程和专业办公场景的能力上限。

7月19日,阿里巴巴正式推出Token Plan个人版,并同步开放了拥有2.4万亿参数的Qwen3.8-Max-Preview模型体验。这意味着阿里将大模型的调用从“按API调用付费”进一步推向“订阅制套餐”,同时用巨型模型拉高代码工程和专业办公场景的能力上限。

阿里云百炼于2025年7月20日灰度发布“HappyOyster1.0(快乐牡蛎)”,这是一个支持实时交互、可连续生成超3分钟视频的开放世界模型,标志着AI从“单向生成内容”向“实时模拟世界因果”的新范式转变。

谷歌正在对旗下企业级AI助手Gemini Enterprise进行界面统一和底层连接器升级,核心在于为后续智能代理功能铺路。此次调整不仅让企业版与消费版外观一致,更涉及权限架构的深层重构,直接影响AI读取企业数据和执行任务的能力。

腾讯旗下混元大模型Hy3原定两周的免费试用期结束后,因用户强烈反馈,决定将WorkBuddy和CodeBuddy产品的免费体验延长至8月5日。这一动作表明,在办公与编程这两个高频AI应用场景中,厂商正通过延长免费入口来争夺早期用户和真实业务数据。

2026年7月19日,上海科学智能研究院在WAIC 2026上发布“神珍”科学多模态基础模型。该模型以约110亿参数,在单一框架内实现了对DNA、RNA、蛋白质、小分子、地球系统与医学图像六类科学数据的理解与生成,是此前“大圣”科研智能体的核心大脑,并已面向社区开源。

月之暗面CEO杨植麟在GTC2026上公开了Kimi K2.5背后的三大核心技术替换——用MuonClip替代Adam优化器、用Kimi Linear(KDA注意力)替代标准全注意力、以及全新的Attention Residue架构替代传统残差连接,并且全部开源。这意味着在大模型训练接近数据瓶颈时,一家中国公…

在2026年世界人工智能大会(WAIC)上,昆仑万维董事长方汉正式宣布2026年为“世界模型元年”,并推出Matrix-Game 3.5世界模型。该模型在720p分辨率下,仅用单张显卡即可使5B参数模型实现20FPS的实时生成速度,同时其核心架构已开源。

知名语音转文字应用Handy的作者Seb Jones于7月19日开源了transcribe.cpp v0.1.0,这是一个基于ggml的本地语音转录库,支持60余种模型及Vulkan、Metal、CUDA等GPU加速路径,旨在替代whisper.cpp和ONNX方案,解决跨平台部署的碎片化痛点。

腾讯混元大模型最新的 Hy3 模型,原本两周的免费试用期在用户强烈要求下延长至 8 月 5 日。一个总参数 295B、激活参数仅 21B 的 MoE 架构模型,能在有限算力下提供长上下文推理,这次的“续命”让更多开发者和企业用户有机会零成本深度测试该模型的实际效果。

月之暗面于7月16日发布的旗舰大模型 Kimi K3,因用户请求量远超预期、算力接近上限,仅三天后便暂停新用户订阅。这意味着前沿大模型在步入真实生产环境时,算力瓶颈已取代模型参数成为最紧迫的制约。