标签: AI

在看了下DV4.1 Flash论文里的结构图然后和大佬们讨论之后,我觉得这次真正值得关注的,不是参数也不是跑分,而是DeepSeek又开始改Transformer本身了。 这次至少有三个很大的变化。 第一,又走回了Encoder + Decoder。 V4.1 Flash 上20层Causal Encoder + 20层Decoder。 当然,这不是回到传统 BERT/T5 那套,而是一个新的非对称结构。 Encoder负责读取、理解…

在看了下DV4.1 Flash论文里的结构图然后和大佬们讨论之后,我觉得这次真正值得关注的,不是参数也不是跑分,而是DeepSeek又开始改Transformer本身了。 这次至少有三个很大的变化。 第一,又走回了Encoder + Decoder。 V4.1 Flash 上20层Causal Encoder + 20层Decoder。 当然,这不是回到传统 BERT/T5 那套,而是一个新的非对称结构。 Encoder负责读取、理解…

据 @MaxForAI 对 DV4.1 Flash 论文结构图的分析,DeepSeek 这次的看点不在参数和跑分,而是重新改动了 Transformer 结构:回归非对称 Encoder + Decoder、升级 CSA2 跨层复用 Attention、并让 Engram 条件记忆回归。

为什么越来越多人愿意“自己搓一个工具”?Vibe Coding正在发生什么变化? 微博VibeLab AI 创意赛收官了,一共有 2500 多件原创作品,2.4 亿多话题阅读。很荣幸这次是评委一员,有机会翻看了不少优秀的参赛作品,也转发了其中一部分。 一个直观的感受就是软件开发这种事情,不再需要专业人士了,普通人也能 Vibe 一个工具出来。 所以借这个机会,整理总结一下:为什么越来越多人愿意“自己搓一个工具”?Vibe Coding…

为什么越来越多人愿意“自己搓一个工具”?Vibe Coding正在发生什么变化? 微博VibeLab AI 创意赛收官了,一共有 2500 多件原创作品,2.4 亿多话题阅读。很荣幸这次是评委一员,有机会翻看了不少优秀的参赛作品,也转发了其中一部分。 一个直观的感受就是软件开发这种事情,不再需要专业人士了,普通人也能 Vibe 一个工具出来。 所以借这个机会,整理总结一下:为什么越来越多人愿意“自己搓一个工具”?Vibe Coding…

微博 VibeLab AI 创意赛收官,收到 2500 多件原创作品、话题阅读量超 2.4 亿。评委之一宝玉据此观察到,借助 AI Agent 与 Vibe Coding,写工具的门槛正在从"专业技能"变成"语言表达能力",普通人开始自己解决长尾需求。

💥必读:DeepSeek V4.1 Flash论文里面暗藏的玄机!V4.1 Pro将是大杀器!2000张GPU+存储集群将是最大助推器! 论文核心要点速览: 1️⃣Flash 反杀 Pro,是产品线信号 不是“小模型勉强接近大模型”,而是新结构系列的最小尺寸已经全面超过上一代旗舰。Pro 被路由、被计划下线,说明他们认准了:密度比绝对规模更重要。 2️⃣CED 是给 Agent 账单改写的 Prefill 8B / Decode 16…

💥必读:DeepSeek V4.1 Flash论文里面暗藏的玄机!V4.1 Pro将是大杀器!2000张GPU+存储集群将是最大助推器! 论文核心要点速览: 1️⃣Flash 反杀 Pro,是产品线信号 不是“小模型勉强接近大模型”,而是新结构系列的最小尺寸已经全面超过上一代旗舰。Pro 被路由、被计划下线,说明他们认准了:密度比绝对规模更重要。 2️⃣CED 是给 Agent 账单改写的 Prefill 8B / Decode 16…

DeepSeek 发布 V4.1-Flash 并公开论文与权重,把 100 万 token 上下文的全局 KV 压缩到约 890MB 量级(每 token 890 字节),同时用新结构让最小尺寸模型全面超过上一代旗舰,配套招聘指向 2000 张 GPU 加存储集群的推理部署。

剪映可以退出历史舞台了! AI 剪辑已经达到专业剪辑师水平,几乎零成本 AI 剪辑方案,Antigravity ➕ chatcut 完美配合,不用担心 Token 不够用。 chatcut 接入 Antigravity ,使用 Gemini 3.8 flash 模型是又快又稳! https://t.co/GBYDrMvbLr

剪映可以退出历史舞台了! AI 剪辑已经达到专业剪辑师水平,几乎零成本 AI 剪辑方案,Antigravity ➕ chatcut 完美配合,不用担心 Token 不够用。 chatcut 接入 Antigravity ,使用 Gemini 3.8 flash 模型是又快又稳! https://t.co/GBYDrMvbLr

有开发者称,将 chatcut 接入 Antigravity 后可实现接近专业剪辑师水平的 AI 剪辑,成本极低且不受 Token 限制,并使用了 Gemini 3.8 flash 模型。但评论区多位用户质疑其实际体验,称 chatcut 效果一般。

1/6 大多数 AI Agent(智能体)的失败并非源于模型本身,而是源于数据问题。 大语言模型(LLM)掌握的是过去的信息,而互联网每时每刻都在变化。 要构建真正智能的 AI Agent、RAG 系统和 SaaS 应用,你需要一套现代化的网络数据流水线。 这是一份完整的 2026 年“Web-to-AI”(从网络到 AI)指南 🧵👇

1/6 大多数 AI Agent(智能体)的失败并非源于模型本身,而是源于数据问题。 大语言模型(LLM)掌握的是过去的信息,而互联网每时每刻都在变化。 要构建真正智能的 AI Agent、RAG 系统和 SaaS 应用,你需要一套现代化的网络数据流水线。 这是一份完整的 2026 年“Web-to-AI”(从网络到 AI)指南 🧵👇

WebPipe.ai 发布了一份 2026 年“Web-to-AI”指南,认为多数 AI Agent 失败的原因不在模型能力,而在数据管道——LLM 的知识停留在过去,无法感知实时变化的互联网。其核心主张是:用抓取加清洗后的 Markdown 流,替代把原始 HTML 塞进向量库的做法。

近期 @KorProtocol 最新发布的演示,展示了一条完整端到端的 AI 音乐创作链路,用户只需要在 Claude 下达一句自然语言指令,AI Agent 就会自动完成音乐素材查找、版权授权采购、歌曲 Remix 混音,整个流程里的版权付费环节,完全由 AI 自主在链上完成结算,无需人工介入 这套能力的底层依托 Base MCP,为 AI 代理挂载钱包能力,再搭配 x402 协议,在 Base 公链网络实现实时交易与支付结算 过去…

近期 @KorProtocol 最新发布的演示,展示了一条完整端到端的 AI 音乐创作链路,用户只需要在 Claude 下达一句自然语言指令,AI Agent 就会自动完成音乐素材查找、版权授权采购、歌曲 Remix 混音,整个流程里的版权付费环节,完全由 AI 自主在链上完成结算,无需人工介入 这套能力的底层依托 Base MCP,为 AI 代理挂载钱包能力,再搭配 x402 协议,在 Base 公链网络实现实时交易与支付结算 过去…

KorProtocol 发布了一段端到端演示:在 Claude 中说一句自然语言指令,AI Agent 就能自动找素材、买版权授权、完成 Remix 混音,并在 Base 链上通过 x402 自主完成付款结算,全程不需要人工切钱包、签名或发起交易。

2026年9月10日|麦麦课堂 🤔 油价冲破100美元,三大指数继续下跌, $META 却逆势涨6.55%。 🎬 Meta推出个人AI助手Muse。 AI从算力走向用户入口,市场这次为什么先认了它? #AI

2026年9月10日|麦麦课堂 🤔 油价冲破100美元,三大指数继续下跌, $META 却逆势涨6.55%。 🎬 Meta推出个人AI助手Muse。 AI从算力走向用户入口,市场这次为什么先认了它? #AI

2026年9月10日,油价突破100美元、美股三大指数继续下跌的背景下,Meta 逆势收涨6.55%至653.69美元,同日推出个人AI助手 Muse。市场用真金白银投票的,是 AI 从算力叙事转向用户入口叙事这一变化。

Eval bug: on HIP, a sequence whose prompt shares a llama_decode() batch with another sequence’s decode row gets corrupted logits, and every

Eval bug: on HIP, a sequence whose prompt shares a llama_decode() batch with another sequence's decode row gets corrupted logits, and every

在 HIP(ROCm)后端下,当一个新序列的 prompt 行与另一个正在生成序列的 decode 行被放进同一个 llama_decode() batch 时,加入方序列(seq 1)的首个采样 token 就会出错,并退化成 3–7 个 token 的循环,但所有调用仍返回成功。优先确认是否在使