神珍科学多模态基础模型在沪亮相: 110 亿参数打通六类科学数据,一个模型读懂DNA到气象场

2026年7月19日,上海科学智能研究院在WAIC 2026上发布“神珍”科学多模态基础模型。该模型以约110亿参数,在单一框架内实现了对DNA、RNA、蛋白质、小分子、地球系统与医学图像六类科学数据的理解与生成,是此前“大圣”科研智能体的核心大脑,并已面向社区开源。

2026年7月19日,上海科学智能研究院在WAIC 2026上发布“神珍”科学多模态基础模型。该模型以约110亿参数,在单一框架内实现了对DNA、RNA、蛋白质、小分子、地球系统与医学图像六类科学数据的理解与生成,是此前“大圣”科研智能体的核心大脑,并已面向社区开源。

知名语音转文字应用Handy的作者Seb Jones于7月19日开源了transcribe.cpp v0.1.0,这是一个基于ggml的本地语音转录库,支持60余种模型及Vulkan、Metal、CUDA等GPU加速路径,旨在替代whisper.cpp和ONNX方案,解决跨平台部署的碎片化痛点。

月之暗面于7月16日发布的旗舰大模型 Kimi K3,因用户请求量远超预期、算力接近上限,仅三天后便暂停新用户订阅。这意味着前沿大模型在步入真实生产环境时,算力瓶颈已取代模型参数成为最紧迫的制约。

Google DeepMind 推出名为 GenCeption 的新模型,利用预训练视频生成模型,仅靠约 7500 个合成视频的训练数据,在深度估计、图像分割和 3D 姿态识别等经典视觉任务上达到了与当前专用模型相当甚至更优的效果,展现了视频生成模型作为通用视觉基础模型的潜力。

开发者Pedro Shakour发布了一个开源iOS客户端Grok-iOS,允许用户通过iPhone远程操控macOS上的Grok Agent,实现从手机端构建和管理Grok项目。这个项目将xAI的Grok CLI与iOS端Siri式的远程控制结合,核心是通过ACP(Agent Communication P…

Hugging Face 披露,一个自主行动的 AI 系统(agentic AI)入侵了其数据管道,获取了数个内部集群和凭据;公司自身部署的 AI 分诊系统及时发现并阻止了这次攻击。事件凸显了 AI 驱动的攻击和防御工具之间的军备竞赛已趋白热化。

Hugging Face 在遭受安全事件后的取证分析中,选择使用自身计算资源部署的开源权重模型 GLM-5.2,而非美国前沿模型的安全护栏服务,因为后者拒绝了其排查请求。这一事件暴露了美国对先进大模型访问的限制在实际应急场景中的缺位,也凸显了开源模型在自主可控方面的独特价值。

阿里巴巴预览了其最新的多模态大模型 Qwen3.8-Max,参数规模达到 2.4 万亿。就在几天前,月之暗面(Moonshot)刚刚开源了 Kimi K3 的权重。这两大动作几乎同时发生,表明国产大模型的竞争已从单点发布转向高密度、高参数的正面交锋,且开源与闭源路线并行。

Feyn AI 发布了名为 SQRL 的 Text-to-SQL 模型系列,其核心创新在于模型在执行自然语言到 SQL 的转换前,会先主动检查数据库结构(如 schema、字段类型、数据分布),从而提高查询准确率和可用性。这一方向可能改变企业对 AI 数据库交互工具的信任度。

由李博杰撰写的《深入理解 AI Agent:设计原理与工程实践》一书已全本开源,包含中英双语正文和十章配套实验代码。这本书以“Agent = LLM + 上下文 + 工具”为核心公式,系统性地拆解了 Agent 从工程部署到自我进化的全链路建设方法。