马斯克亲自下场演示:Grok 新功能能”看片”了,一段科比 AI 视频精准识破

马斯克在社交平台演示了 Grok 的新视频交互能力,上传一段科比 AI 生成视频后,Grok 不仅能描述画面、提取对话,还综合判断出这是 Deepfake。视频理解正从“看懂内容”走向“判断真假”。

马斯克在社交平台演示了 Grok 的新视频交互能力,上传一段科比 AI 生成视频后,Grok 不仅能描述画面、提取对话,还综合判断出这是 Deepfake。视频理解正从“看懂内容”走向“判断真假”。

MiniMax 在 8 月 3 日开源了新一代全模态生成模型 MiniMax H3,它能同时理解并生成文本、图像、视频与音频,支持 2K 超分输出。这是多模态视频生成领域少见的“完整系统”开源,意味着影视预演、叙事设计和 AI 交互的底层工具门槛在进一步降低。

2026年8月3日,MiniMax 开源了多模态生成模型 H3,国产 GPU 厂商摩尔线程当天完成适配,3 小时内让 H3 在其 MTT S5000 加速卡上稳定运行。这是国产算力与前沿开源模型快速协同的一次重要进展。

IBM与Ponemon Institute联合发布的年度数据泄露报告显示,AI驱动的攻击已占全部恶意数据泄露的四分之一,单次平均损失600万美元,比整体平均水平高出20%。这意味着AI攻击正从“新威胁”变成主流风险,企业防御体系的AI化和自动化已经不再是可选项。

腾讯旗下 AI 助手“元宝”升级图片理解能力,推出“遇事拍一张”场景,让用户通过拍照直接完成医疗报告解读、合同条款审查、家电故障排查等日常问答。这件事值得关注的点在于,AI 助手正在从“聊天窗口”走向“随手拍”的轻量入口,把通用大模型能力落地到高频率、低门槛的生活场景中。

阿里被曝正在内测一款名为“万有无界”的 AI 办公平台,核心特点是多个数字员工可以组队协作完成任务。它值得关注的原因在于:办公软件的竞争正在从“单个 AI 助手”走向“多智能体协作”,而阿里这次可能是在国内大厂中率先落地的产品化尝试。

京东外卖向骑手免费发放AI智能头盔,把老骑手认路、看备注的经验转化成语音导航和自动提醒;这是AI从手机屏幕走向骑手真实工作场景的一次具体落地。

两个独立团队在同一时间使用同一个 AI 模型解决同一量子密码学问题,论文提交仅相隔 3 小时,让学术界对 AI 辅助科研的成果归属和署名规则产生追问。

xAI 为视频生成模型 Imagine Video 1.5 带来一次重要更新,新增图像参考、语音参考和原生 1080p 视频生成能力,让 AI 视频从“生成一段画面”向“可控的角色与场景创作”迈进了一步。

美国俄亥俄州博览会海报竞赛曾被允许使用 AI 生成作品(需在申请中说明),但官方在 2026 年奖项公布后同步宣布:2027 年起将正式禁止 AI 参赛。这是传统艺术类竞赛从“有限开放”转向“明确禁止”的又一标志性案例。