德国黑森林实验室发布Flux3 多模态模型:原生音频生成, 20 秒音视频同步输出

德国AI初创公司黑森林实验室(Black Forest Labs)正式发布多模态基础模型Flux3,支持原生音频生成和最长20秒的同步音视频输出,在评测中对部分竞品取得了显著优势,并已开始向机器人领域拓展应用。

德国AI初创公司黑森林实验室(Black Forest Labs)正式发布多模态基础模型Flux3,支持原生音频生成和最长20秒的同步音视频输出,在评测中对部分竞品取得了显著优势,并已开始向机器人领域拓展应用。

Anthropic 在 2026 年 7 月 24 日对 Claude 语音模式进行重大升级,使其不再只依赖轻量模型 Haiku,而是可以调用 Opus 和 Sonnet 等更强模型,并支持连接 Gmail、Slack 等工具以及更多语言。这意味着语音模式从简单的问答工具,升级为能处理复杂业务、实时调用外部工…

OpenAI 于近期宣布为其集成 Codex 的 ChatGPT 桌面应用推出 Voice 模式,基于全新 GPT-Live 模型。用户现在可以通过语音口述需求,AI 能同时执行多个后台任务,比如查冲突、整理邮件和准备会议纪要,语音交互从单轮问答升级为多线程智能体协作。

OpenAI 于 7 月 24 日为 ChatGPT 桌面应用正式上线了基于 GPT-Live 模型的语音模式,用户可以在 Chat、Work 和 Codex 三个板块中用语音启动任务、检查进度。这不仅是语音输入,而是实现了全双工对话——AI 能一边听、一边说、一边在后台执行多线程任务,显著提升了人机协作的流…

在 LobeChat v2.2.3 Docker 自部署环境中,通过环境变量 NEWAPI_MODEL_LIST 添加自定义向量模型(如 +bge-m3=bge-m3 ),前端网页将模型错误推定为对话模型,而非向量模型(embedding)。
![[Bug] Selecting GLM-IMAGE / CogView models in image workspace throws ZodError: prompt Required](https://www.chat-gpts.plus/wp-content/uploads/2026/07/15493-dffd3d90-768x403.jpg)
用户使用 lobehub/lobe-chat-database Docker 镜像(PostgreSQL 16 + pgvector),在图像工作区下拉框中选择智谱AI的图像模型(GLM-IMAGE、CogView-4、CogView-3-Flash)进行生成时,弹出 ZodError 错误。其他图

一名55岁的美国用户起诉OpenAI,声称ChatGPT反复给出错误医疗建议,导致他在肺栓塞发作前拒绝就医,最终因血栓危及生命。这起案件将AI工具的责任边界问题再次推向舆论焦点。

Amazon 要求第三方卖家对使用 AI 生成人物的商品广告进行明确标识,以遵守纽约州即将生效的法规。这部法规要求广告中必须披露“合成表演者”(synthetic performers),这意味着 AI 生成的人物形象在商业广告场景中将不再被视为普通素材,而是一个需要单独告知的合规要素。

开发者徐小夕发布了一款名为 wx-editor 的开源微信公众号编辑器,基于 Vue 3 和自研的 JitWord 协同文档 SDK,集成了 AI 写作助手、主题切换和微信兼容导出功能。这个项目的价值在于它为公众号创作者提供了一个从写作、排版到导出均可离线完成、不依赖后端的技术方案。

向量数据库公司 Pinecone 发布了 Nexus 知识引擎,能将企业分散的合同、知识库、客服记录等非结构化数据,一次性转化为 AI 智能体可直接查询的结构化知识层,从而大幅降低每次查询时的 token 消耗与响应延迟。