RuntimeError: start (0) + length (17408) exceeds dimension size (8704)”

用户尝试用 vLLM 加载 nvidia/Qwen3.6-27B-NVFP4 (Dense 架构,混合精度 W4A16_NVFP4 + FP8),启动命令如下:
先解决问题,再了解资讯。选择你现在要完成的任务。

用户尝试用 vLLM 加载 nvidia/Qwen3.6-27B-NVFP4 (Dense 架构,混合精度 W4A16_NVFP4 + FP8),启动命令如下:
![[Bug]: GPT-OSS Harmony: vLLM silently returns `content: null` with `finish_reason="stop"` when its parser ends in a non-terminal state](https://www.chat-gpts.plus/wp-content/uploads/2026/07/45736-079cc018-768x403.jpg)
用户在 vLLM 中部署 GPT-OSS Harmony 模型(基于 HarmonyEncodingName.HARMONY_GPT_OSS 编码),通过 OpenAI 兼容的 API 发送请求。当模型采样输出格式错误的 assistant turn(例如省略了 ` ` 标记)时,vLLM 未能检测

用户在 Stable Diffusion WebUI 的 txt2img 或 img2img inpainting 模式下,通过“Extra Networks”选项卡点击加载 LoRA 或 embedding 时报错。部分用户反映,手动输入 LoRA 标签时不会触发问题,仅通过点击加载时出现。

在摩根大通工作 38 年、主导其 AI 战略的首席数据与分析官 Teresa Heitsenrether 将于 2026 年底退休。她的离开意味着华尔街最大银行之一的 AI 中枢可能面临转型,但其任内推动的大语言模型工具和与 Anthropic 的合作项目已经建立了持续运转的基础。

一群 AI 研究者上线了名为 FLARE-AI 的众包网站,让用户和开发者可以公开报告大模型生成恶意代码、泄露隐私或诱导偏执等问题,类似 AI 领域的“DownDetector”。该计划已获美国国会立法关注,有望推动 AI 漏洞报告进入标准化、可追溯的轨道。

Cloudflare宣布从2026年9月15日起,默认阻止“混合用途”爬虫抓取带广告页面,迫使AI公司将搜索爬虫与训练和AI代理爬虫分离。这一政策旨在让出版商能够对AI公司使用其内容进行收费,而非免费获取。

演员兼投资人阿什顿·库彻宣布离开其联合创立11年的风险投资公司Sound Ventures,并与前NFX合伙人、曾主导Meta加密货币项目Libra的摩根·贝勒共同创立一家新基金。值得关注的是,新基金押注的方向并非底层大模型公司本身,而是支撑大模型运行的基础设施、能源与硬科技初创公司。

据《华尔街日报》报道,SpaceX 已向投资者展示了一款“类似手持设备”的 AI 设备原型,设计比 iPhone 更薄更轻,可能介于小型触屏手机和 Rabbit R1 之间。Elon Musk 虽在社交媒体上否认该报道,但结合 SpaceX 的制造能力、Starlink Mobile 无线野心,以及收购的 x…

Meta 在官方工程博客中披露了其面向 AI 训练优化的新型 BLOB 存储架构,旨在解决 GPU 因存储延迟而空转的问题,直接降低训练成本并加快模型迭代速度。

Google 正式推出了 Google Cloud Workbench Notebooks VS Code 扩展,让数据科学家和开发者无需离开本地 IDE,即可直接连接并使用 Google Cloud 的托管 Jupyter 环境,降低在本地开发与云端算力之间切换的门槛。