V4-Flash-Vision-Exp 上线,开启多模态 API 服务

DeepSeek 于 2026 年 8 月 21 日上线了实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp,在保持纯文本能力与正式版持平的同时,大幅提升了视觉理解与多模态 Agent 能力,目前可通过 API 直接调用。

DeepSeek 于 2026 年 8 月 21 日上线了实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp,在保持纯文本能力与正式版持平的同时,大幅提升了视觉理解与多模态 Agent 能力,目前可通过 API 直接调用。

教皇 Leo XIV 在罗马的一场立法者会议上警告,AI 的快速发展可能让贫穷国家更加依赖富裕国家,形成新的“经济殖民主义”;他还批评社交媒体算法本身就是一种“微妙的支配形式”。这一表态将 AI 治理争议从就业和隐私,进一步拉向全球权力结构层面。

LinkedIn 上线“疑似 AI 灌水”举报按钮仅数周,平台称相关内容的曝光量已下降 40%。这是主流社交平台首次用明确的用户反馈机制直接压制 AI 生成内容,标志着平台治理从算法暗调转向公开干预。

Anthropic 将最强模型 Claude Mythos 5 接入网络安全扫描工具 Claude Security,帮助企业客户批量检测代码漏洞并给出修复建议。这是 Anthropic 首次将顶级闭源模型定向用于防御场景,而非开放给所有用户。

LMSYS 与蚂蚁灵 Infra 团队公开了 Ling-3.0-flash 在 4 块 Blackwell GPU 上的推理优化细节:通过投机解码和系统性延迟拆解,将单请求解码平均 TPOT 从 3.33 ms 降至 1.53 ms(降幅 54%),并在受控对比中把 DSpark 路径推至 0.78 ms。这…

一名开发者用自托管的 AI 智能体,只靠一条提示词,就让大模型自主完成了从写代码、跑测试、配置数据库到部署上线的完整软件开发流程,全程无需人工介入。他刻意将所有环节锁在自己的家用服务器上,以此探索“如何在不给 AI 根权限的前提下安全使用它写软件”。

围绕“自托管 AI 软件工厂”的热门讨论显示,开发者正在尝试用本地 GPU 运行开源编码模型(如 Qwen)替代 Claude 等闭源前端模型,但实际体验表明本地模型在复杂任务、上下文管理和自主性上仍明显落后,大多数人选择让 Claude 主导、Qwen 处理局部任务的混合架构。

本期少数派社区周报聚焦 AI 编程工具混战,围绕 Codex、Pi、Kimi-Code 等助手讨论实际工作流;同时分享了租房场景下的电钻+电动螺丝刀组合,以及让孩子脱离屏幕的实体卡片故事机 Yoto。

GitHub 更新了个人账户和组织的屏蔽用户管理工具,新增搜索、排序、筛选、备注和到期时间查看等功能。这次更新让社区治理从“一刀切”转向更精细化的操作,对依赖开源协作的 AI 开发者尤其重要。

Google 于 8 月 20 日宣布为 Gemini for Home 语音助手推送新一轮更新,修复 Spotify 播放、消息广播和智能灯色温控制等问题,但用户普遍认为 Google 仍未解决闹钟、自动化日程等长期存在的基础功能故障。