0.30.0 allow GPU offload for projectors on NVIDIA DGX Spark GB10

用户在 Ollama 0.30.0 或更高版本(如 v0.30.8)中运行多模态模型(例如 qwen3-VL 35B)时,系统日志显示投影仪被强制卸载到 CPU,导致视觉编码(prompt eval)速度极慢(从 12-15 秒暴增至 467 秒)。硬件平台包括 NVIDIA DGX Spark G
先解决问题,再了解资讯。选择你现在要完成的任务。

用户在 Ollama 0.30.0 或更高版本(如 v0.30.8)中运行多模态模型(例如 qwen3-VL 35B)时,系统日志显示投影仪被强制卸载到 CPU,导致视觉编码(prompt eval)速度极慢(从 12-15 秒暴增至 467 秒)。硬件平台包括 NVIDIA DGX Spark G
![[Bug] Gemma4 reduces words to two literals](https://www.chat-gpts.plus/wp-content/uploads/2026/07/15270-9f7a194d-768x403.jpg)
用户在 Ollama 中运行 Gemma4 模型,使用德语(也可能涉及其他语言)进行上下文对话或文本生成时,模型会错误地将单词缩减为仅保留首字母和尾字母(例如 “something” 变成 “sg”),导致输出出现大量不存在的错误单词。

用户在 macOS Apple Silicon 上通过 ollama create --experimental --quantize 命令(例如 int4 , int8 , mxfp4 , mxfp8 , nvfp4 )对 safetensors 格式模型进行量化时触发 panic。输

7月15日起,包括豆包、千问在内的大厂AI产品,将集体下架“拟人化互动服务”,即那些能陪你聊天、谈恋爱的AI角色聊天机器人。这不是AI工具下架,而是针对虚拟角色类Chatbot的合规清理。

人力资源社会保障部、国家发展改革委、工信部、国家数据局联合发文,明确到2030年要在人社行业全面普及AI应用。计划在2026年先完成20个基于行业大模型的场景建设,为就业、社保、人才管理等核心政务系统装上"AI引擎"。

英伟达股价从5月14日历史高点累计下跌16%,不到两个月市值蒸发约1万亿美元,目前预期市盈率仅18倍,降至2019年初水平,甚至低于标普500和纳斯达克100指数整体估值。这并非产品竞争力崩盘,而是市场资金从AI芯片龙头向存储等其他半导体赛道分流,前期炒作泡沫正在消退。

OpenAI 宣布将于本周四面向公众正式发布 GPT-5.6 系列模型,此前因美国政府以网络安全风险为由一度要求限制其发布范围。目前美国监管已放行,允许三个子模型 Sol、Terra、Luna 大规模上线。

前 OpenAI 研究员田永龙已确认加入腾讯,将参与视觉语言模型(VLM)相关研发工作。这一人事变动表明腾讯正在加速多模态大模型的人才引进与技术布局。

Cloudflare 与 OpenAI 宣布合作试点,利用 Cloudflare 全球网络中的网站实时信号(如内容更新频率、流量质量),帮助 OpenAI 的 AI 搜索引擎更精准地发现和索引开放网络上的网页内容,旨在提升回答的准确性与时效性。

Meta 正在内部测试一款名为“超级感知(Super Sensing)”功能的 AI 眼镜原型,它能通过摄像头和麦克风持续记录佩戴者周围环境——每几秒拍照一次、持续采集音频,用户之后可以用 AI 回忆看到或听到的任何内容。此项目已因隐私问题引发内部争议。