Show HN:在 macOS 上为每张照片和每一帧视频提供 AI 搜索

macOS 开源工具 SCM 把本地文件夹里的照片和视频做成可自然语言搜索的素材库,视频能精确到某一帧、某句台词,全程离线推理,不上传云端。

macOS 开源工具 SCM 把本地文件夹里的照片和视频做成可自然语言搜索的素材库,视频能精确到某一帧、某句台词,全程离线推理,不上传云端。

24 岁的 Margareth Felicia Gono 在求职期间用 Claude 搭建了一套个人求职追踪系统,把 186 次投递、19 场面试转化为可分析的数据漏斗,并通过面试录音的情感分析定位自己的表达问题,最终入职 DoorDash 任高级助理。

Meta 首席 AI 官 Alexandr Wang 成为该公司首位 Z 世代高管,并成功为尚未大规模公开的 AI 产品 Muse 制造了市场热度。这背后是 Meta 在 AI 竞赛中换用更年轻、更擅长造势的领导者来争夺开发者与用户注意力。

Google 将从 10 月 9 日起按订阅层级限制 Gemini 模型访问,免费用户只能用 Flash-Lite,AI Plus 用户失去 Pro 模型,付费墙从“用量限制”正式延伸到“模型可用性”。
![RuntimeError: Worker failed with error 'MLA kv_data_type torch.uint8 is not supported. Supported dtypes: [torch.float16, torch.bfloat16, torch.float8_e4m3fn].', please check the stack trace abov](https://www.chat-gpts.plus/wp-content/uploads/2026/10/57713-741c6632-768x403.jpg)
这个报错通常出现在 vLLM 用 H100 等 Hopper 显卡加载 GLM5.3-Flash 并启用 --kv-cache-dtype fp8 时,MLA 的 KV Cache 实际收到了 torch.uint8 ,而当前支持的 dtype 只有 torch.float16 、 torch.bf

当你用 LangChain 的 ChatOllama 连接本地 Ollama 模型,并把 reasoning 设为模型自定义的思考等级(例如 "xhigh" 或 "max" )时,会在请求发往 Ollama 之前就被 Pydantic 拦截报错。核心原因是 langchain-ollama 依赖声明

这不是一个运行时报错,而是关于 Add `ToolArgValidationMiddleware` — a new agent middleware that validates LLM-generated tool-call arguments 的功能请求(feature request)。如果你

Anthropic 开始在 Claude 语音功能中弹出提示,请求用户自愿授权将语音对话用于模型训练,且该选项默认关闭、可随时撤回或删除数据。它把语音训练与文本聊天训练拆成了两套独立开关。

Bitdefender 推出 macOS 安全工具 AI Guardian 公测版,在自主 AI 代理执行动作前进行拦截和审计,专门应对提示注入、工具投毒等让攻击者操纵 AI 模型的新风险。这值得关注,因为代理正在拿到文件、密钥和 API 权限,安全边界已经从"保护人"扩展到"保护代理本身"。

Mem0 是一个给 AI Agent 外挂的持久化记忆层,把向量检索、关键词搜索、知识图谱、去重重排全部封装起来,让无状态的大模型能跨会话记住用户偏好和任务上下文。它提供托管和自托管两条路线,直接指向 AI 应用“记不住事”这个长期痛点。