不用设计直接“一句成图”!谷歌推出最强Canva杀手Google Pics

谷歌正式推出AI图像生成与编辑工具Google Pics,主打“一句提示词直接出图”,将深度集成进Workspace,直接对标Canva和Adobe Express的轻量设计场景。

谷歌正式推出AI图像生成与编辑工具Google Pics,主打“一句提示词直接出图”,将深度集成进Workspace,直接对标Canva和Adobe Express的轻量设计场景。

Reddit 社区开发者构建了一款手写互动学习应用,让 Claude 能像“魔法日记”一样在数位板上实时识别用户手写内容,并以自然的笔迹在同一页面回复。这很可能重新定义 AI 在教育与笔记场景中的交互形态,值得关注。

由李飞飞创办的World Labs正式推出号称全球首个多模态世界模型的Atlas,它能在3D空间中精确控制镜头位置,从单张或数张图片生成电影级“子弹时间”视频,同时兼顾3D重建与模拟能力。

OpenAI CEO Sam Altman 公开表示“不喜欢智能眼镜”,认为戴着摄像头和灯光设备与人交流让人不适。这等于变相告诉 Meta:短期内 OpenAI 不会以眼镜形态切入 AI 硬件赛道。

Anthropic 于 9 月 1 日发布新一代模型 Claude Fable 5.1 与 Claude Mythos 5.1,编程与科研基准测试成绩大幅提升,缓存读取价格直降 75%,同时推出更严格的安全分级与企业级数据隔离方案。

据外媒报道,Google 计划最早于本周三发布 Gemini 3.8 Flash,而下一代旗舰 Gemini 4 在预训练评估中表现优异,但尚未完成后续训练,这意味着 Google 正在加快小模型迭代以抢占市场窗口。

OpenAI 在 8 月 12 日确认,其尚未发布的 Astra 模型在网络安全领域首次达到其内部安全框架中的“关键”(Critical)风险级别,但公司同时表示仍将继续推进 Astra 的公开上线,只是会限制最高级的网络攻击能力开放范围。

Google 在 2026 年 9 月 1 日推送了新一轮 Android Drop(Pixel Feature Drop 的延续),为 Find Hub 增加“记忆物品”能力,Gemini Live 新增 Guided vision 视觉引导模式,并推出 Motion Assist 缓解晕动症。这是 Goo…

Meta 发布了首个实时音频模型 Muse Voice Transcribe,能在同一段音频中区分 20 多位说话者并即时切换处理多种语言。这是 Meta 在语音 AI 赛道上对 Google 的直接回应,也是其超级智能实验室(MSI)近期密集发布产品的延续。

一款名为 Weedout 的 Safari 扩展在 Mac App Store 上线,售价 1.99 美元,可依据 YouTube 官方的“Made with AI”披露标签,自动从首页、搜索结果、相关推荐和 Shorts 中过滤或跳过 AI 生成内容。它不依赖猜测或启发式算法,而是直接引用平台自带的标识,试…