标签: AI

https://t.co/r1m5AlVMJl Anthropic 公开点名 7 家中国大模型 “非法蒸馏” – 阿里千问(Qwen):被指开展史上最大规模思维链(CoT)蒸馏,5-7 月达 1.51 亿次交互,峰值日请求 300 万次,用 3500+ 虚假账号抽取 Opus 4.6/4.7 推理链,用于训练 Qwen 3.5/3.6/3.7。 – 月之暗面(Kimi):被指在后台 “偷换后端”,把用户请求静默转发给 Claude O…

https://t.co/r1m5AlVMJl Anthropic 公开点名 7 家中国大模型 “非法蒸馏” - 阿里千问(Qwen):被指开展史上最大规模思维链(CoT)蒸馏,5-7 月达 1.51 亿次交互,峰值日请求 300 万次,用 3500+ 虚假账号抽取 Opus 4.6/4.7 推理链,用于训练 Qwen 3.5/3.6/3.7。 - 月之暗面(Kimi):被指在后台 “偷换后端”,把用户请求静默转发给 Claude O…

Anthropic 发布威胁情报报告,公开点名 7 家中国大模型公司,指控其通过虚假账号、请求转发、会话重放等方式抽取 Claude 的推理链与输出用于训练,其中阿里千问被指规模最大。这既是一份技术安全报告,也是围绕模型能力来源与数据合规的一次公开交锋。

全网男同短剧合集 完整版最新资源点击秒看↓↓↓ https://t.co/3E9EDIaDpZ 🧨最新AI男同短剧合集已整理,真的猛到腿软《归乡遇旧少年》《占有成瘾》《伟松的陨落》👀🔥 #AI短剧 #gay #肛交 #肉便器 #AI成人短剧 #成人短剧 #男同 https://t.co/9nvRqxGfTG

全网男同短剧合集 完整版最新资源点击秒看↓↓↓ https://t.co/3E9EDIaDpZ 🧨最新AI男同短剧合集已整理,真的猛到腿软《归乡遇旧少年》《占有成瘾》《伟松的陨落》👀🔥 #AI短剧 #gay #肛交 #肉便器 #AI成人短剧 #成人短剧 #男同 https://t.co/9nvRqxGfTG

一个名为 @FASLOVER 的账号在 X 上发布「AI 男同成人短剧合集」,列出《归乡遇旧少年》《占有成瘾》《伟松的陨落》三部作品,并给出网盘链接,帖子浏览量约 6.77 万。它把 AI 视频生成从「技术演示」直接推到了成人内容分销的灰色地带。

〖每日知识点〗大语言模型 Large Language Model (LLM) 大语言模型是参数规模达百亿、千亿乃至万亿级的神经网络模型,它以「预测下一个词」为基本方式,在海量文本上预先训练,从而掌握语言规律和世界知识,具备理解、生成、推理等通用能力;当规模大到一定程度,还会「涌现」出小模型不具备的本领。

〖每日知识点〗大语言模型 Large Language Model (LLM) 大语言模型是参数规模达百亿、千亿乃至万亿级的神经网络模型,它以「预测下一个词」为基本方式,在海量文本上预先训练,从而掌握语言规律和世界知识,具备理解、生成、推理等通用能力;当规模大到一定程度,还会「涌现」出小模型不具备的本领。

2026 年 9 月 10 日,X 用户 @caofengguang 在「每天学点儿 AI」系列第 32 期给出大语言模型(LLM)的通俗定义:参数规模达百亿到万亿级、以「预测下一个词」为训练目标,并在规模足够大时「涌现」出小模型不具备的能力。这套说法是理解当下所有大模型产品的基础框架。

“Reasoning” 只是行业术语,推理模型不是在像人一样思考。 @sophiamyang & @rasbt 在这场 69m 访谈里拆解了推理模型的工程本质: · RLVR 如何用可验证奖励训练模型 · 蒸馏的伦理边界在哪 · 循环 Transformer 是否真的会隐藏思维链 他们认为:推理模型没有魔法,只有方法。 https://t.co/tTK3govJG0

"Reasoning" 只是行业术语,推理模型不是在像人一样思考。 @sophiamyang & @rasbt 在这场 69m 访谈里拆解了推理模型的工程本质: · RLVR 如何用可验证奖励训练模型 · 蒸馏的伦理边界在哪 · 循环 Transformer 是否真的会隐藏思维链 他们认为:推理模型没有魔法,只有方法。 https://t.co/tTK3govJG0

Sebastian Raschka 与 Sophia Yang 在一场 69 分钟访谈中,把"推理模型"从概念神话拉回工程现实——它只是会写思维链的模型,能力来自 RLVR、蒸馏和推理时扩展这些具体方法。理解这些方法,比争论"模型是否在思考"更有实用价值。

Bug in modeling_bart.eager_attention_forward

Bug in modeling_bart.eager_attention_forward

这个报错通常出现在把 BART 系列模型(如 facebook/bart-base)的注意力实现从默认的 SDPA 切换为 eager 之后,eager_attention_forward 直接把 2D/不匹配的 attention_mask 加到注意力权重上导致形状不匹配或结果异常。优先排查当前