利用NVIDIA Transformer Engine、融合内核、BF16、FP8及GPU基准测试加速Transformer训练

MarkTechPost 近期发布技术解读,聚焦 NVIDIA Transformer Engine、融合内核和 BF16/FP8 低精度格式如何加速 Transformer 训练。对于使用 GPU 训练大模型的团队来说,这类优化直接关系到训练成本和效率的改善。

MarkTechPost 近期发布技术解读,聚焦 NVIDIA Transformer Engine、融合内核和 BF16/FP8 低精度格式如何加速 Transformer 训练。对于使用 GPU 训练大模型的团队来说,这类优化直接关系到训练成本和效率的改善。

安全研究员披露了一种针对 Microsoft 365 Copilot 的提示注入攻击:恶意指令以白色文字藏在 Word 文档中,Copilot 会在用户毫不知情的情况下篡改文件,并把指令复制进新文档实现自我传播。经过微软 144 天、两轮修复,该攻击仍可复现。

为了获得“干净”的AI训练数据,部分AI公司正在批量采购并销毁2022年前出版的书籍——包括一些存世极少的珍本——用切掉书脊、高速扫描的方式把它们变成数字数据。这件事引发了对不可逆文化损失的广泛担忧。

拥有320万订阅者的美国YouTuber Hank Green因视频脚本被观众怀疑由AI代写而公开道歉,并承认自己与ChatGPT等大模型互动已成瘾,称这种使用方式“不健康”。这件事把创作者使用AI辅助创作时面临的透明度、创作身份和成瘾风险摆到了台面上。

老牌写作工具 iA Writer 发布 8.0 大版本更新,主推的不是 AI 功能,而是将文档大纲与全局搜索整合的新搜索体系。在几乎所有写作工具都在拥抱大模型的当下,iA Writer 选择从“人类写作的回溯需求”下手改进产品。

X 用户 @MaxForAI 发文称,当前全球大部分大模型已进入 DeepSeek 的“斩杀区”——能力不如 DeepSeek、价格却更贵的模型会被逐步淘汰。帖子引发大量讨论,核心争议是 DeepSeek 是否真的足以改变市场格局。

一条教 Claude Code“先调查再动手”的提示词在 X 平台广泛传播,原推文已获得超过 6.2 万次浏览。它试图解决的问题很具体:如何让 AI 编程代理少做无用功、少提蠢问题,从而更接近资深工程师的工作方式。

AMD发布Instella-MoE-16B-A3B,这是一个完全开源的混合专家大模型,总参数160亿、激活参数仅28亿,并在AMD自有Instinct GPU上完成训练,试图以更低推理成本进入开源大模型竞争。

开源开发者 linsizhen 推出了覆盖 A 股、美股、港股的 AI 投研系统 Vibe-Research,发布后迅速获得约 1.1k GitHub 星标。它把行情、财报、公告、资金流等数据整理成结构化工作流,让用户接入 Claude、Codex 等大模型完成每日复盘和持仓分析,而不是直接给出买卖建议。

范冰将二十多万字的新书《前置部署工程师》免费开源,系统讲述AI时代如何把产品能力与客户真实需求对接。这本书为开发者和创业者提供了一套可落地的FDE方法论,值得关注。