Claude赛:Claude寓言 5 逐行翻译的荷马史诗《奥德赛》

有人在 Hacker News 上让 Claude 逐行翻译《奥德赛》开头,结果发现它更像是在混编两个知名英译本,而不是独立翻译。这个细节让大模型的“翻译能力”与“记忆能力”之间的边界再次成为焦点,也把版权问题推到了台前。

有人在 Hacker News 上让 Claude 逐行翻译《奥德赛》开头,结果发现它更像是在混编两个知名英译本,而不是独立翻译。这个细节让大模型的“翻译能力”与“记忆能力”之间的边界再次成为焦点,也把版权问题推到了台前。

Databricks 公开了将内部 AI 编程支出削减 70% 的具体做法,核心不是谈下更低价格,而是主动把模型流量迁移到“效率前沿”模型上,并为此建立了可复制的基础设施;Stripe、Coinbase、Uber 等公司也在采用类似策略。

数据与 AI 基础设施公司 Databricks 将 AI 编程相关支出削减了 70%。在行业普遍加码 AI 编程的背景下,这个动作指向一个更现实的问题:AI 编程投入是否真的带来了对等的产出。

1Password 旗下安全实验室的大规模测试发现,用前沿大模型自动生成漏洞补丁的成功率仅 26%,部分补丁还会改变应用行为甚至引入新漏洞——AI 补丁仍需人工审查,不能直接信任。

安全公司 Zenity Labs 发现,攻击者在 AI 技能市场 skills.sh 上通过克隆热门技能、后门投毒的方式窃取云端凭证,其中一个技能家族的累计下载量超过 170 万次,暴露了 AI 应用生态正在成为供应链攻击的新目标。

效力Google近27年的AI灵魂人物Jeff Dean宣布离职,与另外三位顶级科学家共同创办新公司Discovery Loop,目标是让AI自动化科研与工程闭环。这是Google AI体系迄今最严重的一次人才流失。

AI2发布了TutorMoments评估框架,用真实的一对一数学辅导数据测试大模型能否拿捏“该帮学生”还是“该让学生自己想”的分寸。结果显示,主流LLM普遍倾向于过度帮助,替学生做太多本该由他们完成的思考。

三星高管在 Reddit AMA 中正面回应“创新停滞”批评,指出 AI 正在推动折叠屏和可穿戴设备的形态变革,并把健康监测视为下一阶段的核心差异化方向。

旧金山街头被大量语义不明的 AI 广告覆盖,引发当地媒体和文化编辑公开批评,认为这些圈内人看不懂的“黑话广告”正在加剧公众对 AI 的疏离感,也是 AI 公司营销出圈失败的典型信号。

Hacker News 上一场高赞讨论认为,AI 驱动的广告投放逻辑正在杀死旧金山街头广告的公共属性——广告不再试图说服路人消费,而是精准瞄准少数高价值决策者。匹兹堡球场从 Heinz Field 改名 Acrisure Stadium,正是这种“面向企业而非面向人”的广告逻辑的缩影。