DeepSeek回应“深度思考模式偷偷取外号”:实际为临时标签,不会存储用户信息

DeepSeek 回应了“深度思考模式会偷偷给用户起外号”的争议,称这些称呼只是推理过程中的临时标签,用于辅助模型理解上下文,不会被存储或形成长期记忆。这一事件折射出大模型思维链透明化后,用户对隐私与模型行为边界的新关切。

DeepSeek 回应了“深度思考模式会偷偷给用户起外号”的争议,称这些称呼只是推理过程中的临时标签,用于辅助模型理解上下文,不会被存储或形成长期记忆。这一事件折射出大模型思维链透明化后,用户对隐私与模型行为边界的新关切。

Cactus Compute 发布了 Needle 2,一个只有 14MB 大小、45M 参数的智能体大模型,专为手机、手表、智能家居和机器人等低成本设备设计,能在无 GPU、无 NPU 的环境下本地运行,Pebble 已经将其用在 Index 01 应用中。

弗吉尼亚州要求数据中心自行承担为其新建的电网基础设施费用,不能再把成本转嫁给普通居民。这一政策若落地,可能为当地用户节省数亿美元电费,也对全美AI算力扩张的成本分摊方式产生示范效应。

TechRadar 编辑用 Gemini Live 的摄像头询问“鸡肉沙拉是否还能吃”,Gemini 没有直接回答,反而先念了一段医疗免责声明。这件事表面是日常生活的 AI 问答,实际反映了生成式 AI 进入健康建议场景时,大模型如何先规避责任风险、再谈用户体验。

自由软件基金会创始人 Richard Stallman 在采访中公开表示拒绝携带手机,称其是“斯大林的梦想”和“老大哥的工具”。这一表态将手机追踪能力与监控政治直接挂钩,在 AI 时代重新引发关于位置数据、隐私边界的讨论。

Jarred Sumner 让 Claude 挑战黎曼猜想,虽然未能终结猜想本身,但 Claude 在 1.5 天内将“临界线上零点占比”的已知下限从 41.6% 推进到至少 67%,并将证明在 Lean 中形式化。这展示了大模型在数学研究中连接已有成果、辅助构造证明的潜力,值得关注。

美国数字出版公司 Arena Group 宣布更名为 Paradium.AI,押注 AI 内容生成与自动化叙事;但更名同期发布的最新财报显示,公司营收同比腰斩,转型尚缺乏可验证的商业成果。

Cactus 发布新一代端侧智能体模型 Needle 2,仅 14MB、45M 参数,就能在树莓派、千元机和 VR 头显上完成工具调用和结构化输出。它把“边缘 AI”从 Mac/PC 拉回到更庞大的低算力设备市场,并证明特定任务并不需要大模型。

金尼药房(Kinney Drugs)因收到数百起客户投诉,撤下了其 AI 手机助手。这是生成式 AI 在真实客服场景中遭遇大规模负面反馈的典型案例,再次说明 AI 落地不能只看模型能力,更要看人工兜底和用户体验设计。

Hugging Face 与 EleutherAI 合作发起 FineBooks 项目,实测 14 款开源 OCR 模型后发现,当前最优模型能以不到每千页 2 美元的成本,把历史书籍扫描文本的字符准确率提升到 97% 以上,足以改善大模型训练数据的质量,但也还不能直接用于学术研究。