OpenAI:“我们使用去标识化数据来改进 ChatGPT

OpenAI 研究负责人 Mark Chen 公开区分了两件事——没有任何人查看用户数据用于 Navier-Stokes 相关研究,但公司确实会用用户反馈和去标识化数据来整体改进 ChatGPT 和 Codex。这句话之所以引发讨论,是因为它把大模型行业长期模糊的数据使用边界,第一次说得比较直白。

OpenAI 研究负责人 Mark Chen 公开区分了两件事——没有任何人查看用户数据用于 Navier-Stokes 相关研究,但公司确实会用用户反馈和去标识化数据来整体改进 ChatGPT 和 Codex。这句话之所以引发讨论,是因为它把大模型行业长期模糊的数据使用边界,第一次说得比较直白。

有开发者在 16GB 内存的 2020 款 M1 Mac Mini 上,用本地方式跑起了 DeepSeek V4.1 flash,但首 token 等待 108 秒、之后每生成一个 token 约 23 秒。这说明超大模型在消费级硬件上“能跑”和“能用”之间,仍隔着很远的距离。

Epson 在欧洲六国调查 3360 人后发现,约 80% 的教师担心 AI 进入课堂的速度已超出他们能掌控的范围,而 87% 的学生每周至少用一次 AI 做功课。随着欧盟《人工智能法案》开始执行,学校被要求为在用的 AI 工具提供相应培训,问题从“要不要禁”变成“怎么管”。

Product Hunt 上出现了一款名为 MCPShip 的产品,从命名看,它面向当下快速升温的 MCP(Model Context Protocol)生态,试图简化 AI 应用与外部工具、数据源之间的连接流程。值得关注的原因在于,MCP 正在成为大模型接入外部能力的事实标准之一,围绕它的工具链越完整,AI…

25 位菲尔兹奖得主联合发声,警告 AI 公司把数学题当作刷榜基准,正在伤害数学真正追求的理解与洞察,并认为这套逻辑很快会蔓延到其他知识型行业。

当 Open WebUI 中使用的 Ollama 模型(如 PaddleOCR-VL、qwen3 8b 等)不支持工具调用(tools)能力,但 Open WebUI 默认按工具调用模式发起请求时,就会报 does not support tools 。优先检查当前模型的函数调用模式设置。

在专家并行(EP)下使用 experts_implementation="batched_mm" 时,MoE 路由门控权重( mlp.gate.weight )会收到错误梯度,loss 与参考实现完全一致,但梯度偏大约 50%;优先确认是否启用了 batched_mm ,并切换为 grouped_m

在 Transformers 中使用 MambaForCausalLM 生成文本时,如果吞吐量明显低于原始 mamba-ssm 仓库开启 cg=True 的结果,核心原因是 Hugging Face 实现当时未支持 torch.compile / CUDA Graphs 编译路径,而不是 use_c

开发者 Leto Bao 在 X 上发帖称程序员将被 AI 取代,未来属于“AI + 金融/医疗/工业”的行业人,这条帖子浏览量超过 11 万,引发评论区关于 AI coding 与行业 Know-how 谁更稀缺的争论。

社交平台账号 @AsiaFinance 于 9 月 12 日发布消息,称月之暗面创始人杨植麟及团队 15 名成员被带走调查,并指 Anthropic 指控多家中国大模型公司通过 API 调用 Claude 进行模型蒸馏。相关传闻目前尚未获得当事公司或官方证实。