DeepSeek v4.1 Flash 现在是我们最强的黑客模型

AI 安全公司 Enclave 的基准测试显示,DeepSeek V4.1 Flash 以约 4.65 美元成本攻破了全部 11 个漏洞靶机,并在复盘中暴露出 5 条原评分系统未识别的“意外路径”,说明现有智能体安全测试需要同时检查结果和攻击过程。

AI 安全公司 Enclave 的基准测试显示,DeepSeek V4.1 Flash 以约 4.65 美元成本攻破了全部 11 个漏洞靶机,并在复盘中暴露出 5 条原评分系统未识别的“意外路径”,说明现有智能体安全测试需要同时检查结果和攻击过程。

据 Bloomberg 报道,Meta Compute 联席负责人 Dina Powell McCormick 正利用其人脉网络为大型 AI 融资项目牵线搭桥,而马克·扎克伯格本人则将精力集中在产品层面。这一分工透露出 Meta 正在把 AI 基础设施的"钱"和"产品"拆成两条线来推进。

软件作者 Mark Seemann 公开回应一位读者的来信:这位没有计算机背景的开发者用大模型搭起了一套包含 API、PostgreSQL 和 LLM 流水线的大型 TypeScript 系统,却在转向生产时发现自己造出了超出自身理解能力的系统。Seemann 借此谈了他对“LLM 时代还要不要学编程基本功”…

Hacker News 上有人整理出 20 个主流大模型的发布时间与训练数据截止日期,讨论随即转向一个更实际的问题——模型到底知不知道"现在"是什么时候,以及它是否会因此给出过时甚至错误的答案。

AI 陪伴平台 Joi AI 邀请伦敦国王学院讲师 Chloé Locatelli 担任“自慰顾问”,她以研究者身份创建并使用了 AI 角色,同时推动一项为期两年、尚待伦理审批的用户访谈研究。这起合作把“AI 伴侣到底如何影响亲密行为”从媒体恐慌拉回到可验证的实证研究上。

开发者 Fabian 在 Hacker News 上发布 Chat-Man,提供免费的 WhatsApp MCP 服务器和一个面向非技术用户的 Web UI,让 AI Agent 能直接读写、搜索和发送 WhatsApp 消息。它试图解决一个很实际的问题:不必为每个项目单独接一遍 WhatsApp 库。

TechCrunch Disrupt 2026 公布了第二批将担任 Startup Battlefield 200 评委的五位风投,比赛将于 10 月 13 日至 15 日在旧金山 Moscone West 举行。对早期创业者而言,这份名单本身就是一份“当下什么样的公司更容易被看见”的参考坐标。

Meta 旗下 Threads 上线播客推广工具,让创作者能在帖子里嵌入可点击的节目卡片、节目文字稿和嘉宾标注。这本身不是 AI 功能,但反映出社交平台正围绕内容分发与创作者变现展开新一轮竞争。

安全研究者和 Anthropic 发现,约 28 款打着“真实交友”旗号的约会应用,实际上由 AI 自动生成对话、配合少量兼职真人完成人脸和视频验证,向用户售卖虚拟金币牟利。这是目前已知规模较大的一次 AI 工业化“杀猪盘”式运营案例。

Mozilla 推出 Firefox Smart Window 测试版,这款浏览器 AI 助手由法国 Mistral 的模型驱动,主打隐私优先、对话默认不落库;它既是 Mozilla 在 AI 浏览器赛道的一次落子,也是 Mistral 从企业客户走向全球终端用户的关键一步。