PrismML 将小型 LLM 带入搭载 Qualcomm 芯片的智能眼镜

由加州理工研究人员创立、UC Berkeley 教授 Ion Stoica 担任顾问的 PrismML,把自家 1-bit Bonsai 小模型带到高通 Snapdragon AR1 Gen 1 平台上,让 AI 智能眼镜可以在本地跑一个 20 亿参数的视觉语言模型。值得关注的是,它走的是端侧、开放权重路线…

由加州理工研究人员创立、UC Berkeley 教授 Ion Stoica 担任顾问的 PrismML,把自家 1-bit Bonsai 小模型带到高通 Snapdragon AR1 Gen 1 平台上,让 AI 智能眼镜可以在本地跑一个 20 亿参数的视觉语言模型。值得关注的是,它走的是端侧、开放权重路线…

TechCrunch Disrupt 2026 推出限时“第二张票五折”优惠,10 月 13 日开幕前购买同类型双人票即可省下最高 450 美元。对准备去旧金山找投资、找客户、找同行的创业者和开发者来说,这是降低参会门槛、组队高效社交的一次机会。

Forecasting Research Institute 的一项中期研究发现,包括顶尖计算机科学家、经济学家在内的 AI 专家,普遍低估了 AI 在数学、病毒学、网络安全和商业收入上的实际进展速度,部分里程碑提前了 5 到 10 年到来。这意味着我们对 AI 能力边界的默认判断,可能系统性偏保守。

Google 在 Gemini 3.8 Live 中上线 Live Avatar,让 AI 以会对口型、有表情的动画形象实时对话,但目前只面向 Gemini Enterprise 企业客户。

vLLM 在推理引擎中加入基于 Gumbel-max 的文本水印方案,能在不改变模型原本输出概率分布的前提下,为生成文本嵌入可检测的来源信号,主要用于判断一段文字是否由特定模型生成。

Anthropic 发布 Claude Opus 5.5,针对越来越长、上下文越来越重的编码会话做成本优化,官方估算典型 token 计费工作负载下运行成本比 Opus 5 低约 40%。这背后是编码智能体用法正在从“短问答”转向“长时间无人值守的大任务”。

安全研究者披露,黑客正通过 GEO(生成引擎优化)手段向 ChatGPT、Gemini 和 Google AI Overview 投喂污染数据,把 374 家企业的官方联系方式替换成诈骗电话。这意味着 AI 搜索结果已从“信息入口”变成可被定向劫持的攻击面。

Google DeepMind 在 Gemini 3.8 Live 基础上推出 Live Avatar,把实时对话能力与低延迟流式视频生成结合,让企业级 AI 智能体拥有可定制、能看能听能说的虚拟形象,目前已上线 Gemini Enterprise。

GitHub Security Lab 发布 Fuzzing Taskflow,让 LLM 智能体自动完成 C/C++ 项目从写测试框架到漏洞报告的全流程模糊测试,开发者只需提供一个 GitHub 仓库地址。

GitHub 开发者 Burke Holland 在 GitHub 官方博客发文提出,聊天窗口并非与 AI 协作的最优界面,多数场景下用户需要的是可为具体任务即时生成的自定义界面。GitHub Copilot 应用中把这种界面称为 canvas,它是一个可双向调用本地代码和第三方 API 的全栈小应用。