利用NVIDIA Transformer Engine、融合内核、BF16、FP8及GPU基准测试加速Transformer训练

MarkTechPost 近期发布技术解读,聚焦 NVIDIA Transformer Engine、融合内核和 BF16/FP8 低精度格式如何加速 Transformer 训练。对于使用 GPU 训练大模型的团队来说,这类优化直接关系到训练成本和效率的改善。

MarkTechPost 近期发布技术解读,聚焦 NVIDIA Transformer Engine、融合内核和 BF16/FP8 低精度格式如何加速 Transformer 训练。对于使用 GPU 训练大模型的团队来说,这类优化直接关系到训练成本和效率的改善。

开源项目 Wienerdog 为 Claude Code 和 Codex CLI 这类 AI 编程助手装上一个共享的“记忆仓库”和“夜间反思”机制,让 AI 在切换工具后依然记得你是谁——不改变模型本身,只靠一堆纯文本文件。

OpenAI CEO Sam Altman在X上推荐了一个ChatGPT育儿用法——连接家庭日历,每天早上为家长生成一个给孩子听的简报播客。这个提议在原帖本身热度不高的情况下,招致大量用户和行业人士的批评,争议焦点是:AI辅助育儿会不会变成亲子关系之间的“隔层”。

美国法官拒绝了 xAI 提出的紧急请求,未能阻止明尼苏达州一项针对“nudify”类 AI 应用的法律生效。理由是请求递交太晚,这显示出 AI 产品与州级立法赛跑时,时间窗口往往决定了法律先行。

Reddit 二季度财报表面超出预期,股价却暴跌 23%,根因是 AI 搜索摘要正在拦截用户对 Reddit 的直接访问,美国用户增长从 16% 骤降至 6%,登录用户增长更是跌到只剩 1%。AI 内容授权生意,正在反噬 Reddit 最核心的社区资产。

安全研究员披露了一种针对 Microsoft 365 Copilot 的提示注入攻击:恶意指令以白色文字藏在 Word 文档中,Copilot 会在用户毫不知情的情况下篡改文件,并把指令复制进新文档实现自我传播。经过微软 144 天、两轮修复,该攻击仍可复现。

为了获得“干净”的AI训练数据,部分AI公司正在批量采购并销毁2022年前出版的书籍——包括一些存世极少的珍本——用切掉书脊、高速扫描的方式把它们变成数字数据。这件事引发了对不可逆文化损失的广泛担忧。

拥有 SciShow、Crash Course 等知名教育频道的 YouTube 创作者 Hank Green,因承认在内容制作中使用 ChatGPT 辅助研究而遭到粉丝批评,公开道歉并宣布减少更新。这一事件让“创作者是否应该披露 AI 参与”成为无法回避的信任议题。

拥有320万订阅者的美国YouTuber Hank Green因视频脚本被观众怀疑由AI代写而公开道歉,并承认自己与ChatGPT等大模型互动已成瘾,称这种使用方式“不健康”。这件事把创作者使用AI辅助创作时面临的透明度、创作身份和成瘾风险摆到了台面上。

Hacker News 用户发现,Cursor 在用量页面和 CSV 导出中移除了成本信息,同场讨论中还公布了六款 AI Agent 框架在同一任务下的 token 消耗对比,结果差距接近 30 倍。事件核心不是模型性能,而是 Agent 基础设施正在成为新的成本战场。