标签: 大模型

豆包音频生成模型1. 0 发布,开启“音频导演”时代

豆包音频生成模型1. 0 发布,开启“音频导演”时代

字节跳动旗下火山引擎于6月23日发布豆包音频生成模型1.0,用户只需输入包含角色对话、情绪、背景音乐和环境氛围的提示词,即可直接生成一段完整音频,无需手动对白、音效和配乐。这一模型同时解决了长音频中“角色声音一致性”的行业难题,将创作模式从“后期拼接”转向“一次导演”。

40 天不睡、5 人死磕,DeepMind主管爆Gemini大战DeepSeek惨烈内幕,聊普通程序员的转型之路

40 天不睡、5 人死磕,DeepMind主管爆Gemini大战DeepSeek惨烈内幕,聊普通程序员的转型之路

Google DeepMind 的 Gemini 预训练主管 Vlad Feinberg 在一场播客中曝光了模型训练的真实面貌:5 人团队在硅谷和巴黎两地倒班、不眠不休 40 天,才让 Gemini 2.0 上线。与此同时,他指出了当前 AI 行业最稀缺的能力——不是发论文,而是踏实解决算力与工程落地的“脏活…