FAQ/GUIDE: I’ve figured out why CUDA isn’t available in Insightface!

用户在运行 ComfyUI 下的 IPAdapter Plus 或 Reactor 节点时,期望使用 GPU 加速,但 Insightface 模型只回退到 CPU 执行。常见表现为加载缓慢(首次加载耗时数十秒)或直接提示 CUDA 不可用。

用户在运行 ComfyUI 下的 IPAdapter Plus 或 Reactor 节点时,期望使用 GPU 加速,但 Insightface 模型只回退到 CPU 执行。常见表现为加载缓慢(首次加载耗时数十秒)或直接提示 CUDA 不可用。

Cloudflare CEO Matthew Prince 在播客中披露,AI Agent 驱动的 Bot 流量已于 2026 年上半年首次超过人类流量,预计五年内互联网总流量将暴涨 1000 倍。与此同时,AI 挖漏洞的速度可能在未来两年导致每周出现一个 Log4j 级别的严重安全漏洞,而现有商业模式因 B…

前端部署平台 Vercel 正式开源了 AI 智能体开发框架 Eve,采用“文件系统即架构”的设计理念,将指令、工具、子智能体等能力以文件形式组织,并内置持久化执行、沙箱运行和人工审批等生产级特性,意在降低构建可部署智能体的门槛。

知名设计工程师 Emil Kowalski 将多年积累的 UI 动画与组件构建原则,沉淀为一套可复用的 Skills,让 Cursor、Claude Code、Codex 等 AI 编码工具在生成界面动画时,能按资深设计工程师的审美标准做判断,而不是仅凭语法正确凑出动画。

支付宝于7月2日正式将AI助手“阿宝”(蚂蚁阿宝)从邀测转为公开公测,用户无需邀请码即可在iOS和安卓端直接搜索体验。这意味着支付宝正在将核心支付流程从“陈列式”菜单升级为“对话式”交互,是支付宝版本12以来的关键产品形态变化。

昆仑万维发布天工3.2版本,核心新功能Skywork Tags让AI智能体直接入驻Slack、飞书、钉钉等团队协作群聊,成为“共享同事”。这不同于传统AI助手需要用户迁移上下文到独立平台,目标是通过“上门服务”降低团队使用AI的摩擦,并借助公共对话积累团队上下文来提升AI效果。

谷歌宣布大幅提升 Gemini API 的免费调用额度,部分模型的每分钟请求处理量(吞吐量)从原先的数万级别跃升至百万级。这一调整直接降低了开发者与大模型交互的成本门槛,有望推动更多基于 Gemini 的轻量级应用和实验项目出现。

苹果 WebKit 团队于 7 月 1 日发布 Safari Technology Preview 247,首次内置 MCP 服务器功能,允许 AI 智能体直接与浏览器开发者工具交互,实现自动化的网页调试、性能测试与兼容性检查,标志着浏览器原生支持 AI 开发流程的实质性进展。

《华尔街日报》爆料 SpaceX 在 IPO 前向投资者展示了一款集成 xAI 技术的 AI 手机原型机,马斯克随即在 X 平台发文彻底否认该消息,称该报道完全虚假。

纳睿雷达正式发布了“睿宸”AI气象大模型及配套的相控阵雷达系统,将AI技术直接应用于气象探测和预报,旨在提升短时临近预报的精度和时效性。