字节跳动发布Seed Audio 1.0:音频生成从“会说”迈向“会创作”

字节跳动正式推出音频生成模型Seed Audio 1.0,该模型不再局限于单一语音合成,而是能在统一框架下联合生成人声、音效与环境声,直接输出完整的叙事性音频作品。目前该模型已在火山方舟体验中心开放测试。

字节跳动正式推出音频生成模型Seed Audio 1.0,该模型不再局限于单一语音合成,而是能在统一框架下联合生成人声、音效与环境声,直接输出完整的叙事性音频作品。目前该模型已在火山方舟体验中心开放测试。

全球最大AI开源社区Hugging Face披露服务器遭黑客AI智能体入侵,其安全团队在尝试使用美国商业大模型API分析超1.7万条日志失败后,转而部署国产开源模型GLM5.2完成取证。这一案例直接暴露了闭源API在安全分析场景中的数据访问和策略限制问题。

DeepSeek官方版V4模型的测试视频和真机演示近日在社交平台流出,多方消息显示该模型最快将于下周一(7月中旬首个周一)正式发布。测试数据显示,V4在多项核心指标上已达到Claude Opus 4.8水平,特别是在3D生成能力上表现突出,且成本优势显著。

知名开源大模型本地运行工具 Ollama 于 7 月 9 日宣布完成 8800 万美元融资,投资者涵盖 Benchmark、Docker 创始人等。目前该平台已服务 890 万开发者,被 85% 的财富 500 强公司采用,本轮资金将用于混合推理、模型首发支持和云服务升级。

开发者 amalshehu 发布了一个名为 pexels-skill 的开源工具,允许用户通过 Pexels API 在 Claude Code 中直接搜索免版税库存照片,将图像搜索能力接入 AI 对话环境。

AI 模型 Claude Fable 在验证一个著名数学猜想(雅可比猜想)时,直接给出了一个反例,并且后续多名 AI 和人类研究者确认该反例有效。这一事件展示了先进 AI 在逻辑推理与自我验证流程上的突破性进展,也暴露了不同模型在面对统一数学问题时的能力差距。

东南亚超级应用Grab的网络安全与平台工程团队推出内部平台Palana,专门为高自主性的AI智能体提供安全的隔离运行环境,从基础设施层面解决智能体可能带来的凭证泄露、网络攻击和运维失控风险。

字节跳动于2026年7月20日发布了Seed Audio 1.0音频创作模型,将人声、音效和环境声统一在一个框架下建模,实现从文本到完整音频场景的端到端生成,已在火山方舟上线。这是AI音频从“单要素生成”走向“复杂场景创作”的一次关键升级。

Ollama 宣布完成 8800 万美元融资,由 Benchmark、Theory Ventures 和 8VC 等机构领投。这笔资金将用于推动开放模型的本地运行和云端部署,目标是让 AI 像个人计算机一样可掌控、可定制且保护隐私。

7月19日,阿里巴巴正式推出Token Plan个人版,并同步开放了拥有2.4万亿参数的Qwen3.8-Max-Preview模型体验。这意味着阿里将大模型的调用从“按API调用付费”进一步推向“订阅制套餐”,同时用巨型模型拉高代码工程和专业办公场景的能力上限。