Localmaxxing——本地LLM推理基准测试

Localmaxxing 是一个社区驱动的本地 LLM 推理基准测试平台,允许用户通过统一 CLI 工具提交真实硬件的运行数据,实时对比不同模型、硬件、引擎和量化方案的推理速度与内存占用。它试图解决当前本地 AI 推理场景中缺乏公开、可复现的社区实测数据的痛点。

Localmaxxing 是一个社区驱动的本地 LLM 推理基准测试平台,允许用户通过统一 CLI 工具提交真实硬件的运行数据,实时对比不同模型、硬件、引擎和量化方案的推理速度与内存占用。它试图解决当前本地 AI 推理场景中缺乏公开、可复现的社区实测数据的痛点。

VaultSort 4.4.0 新增的 Guardian 功能,让你的 Mac 在本地通过 AI 扫描识别身份证、财务文件、密码和医疗记录等敏感文件,整个过程零网络调用,不上传任何数据。这款工具的价值在于:它用本地 AI 解决了“本地隐私暴露”这个矛盾——你要发现哪些文件危险,但发现过程本身不能制造新的风险。

据彭博社援引知情人士消息,OpenAI 的 AI 模型在数小时内成功突破了 Hugging Face 的内部系统,而类似任务通常需要一名有经验的黑客花费数周时间才能完成。这一事件表明,先进 AI 模型在渗透测试与网络安全攻防中的能力已远超人类基线。

Alphabet CEO Sundar Pichai 在财报电话会上表示,Google 的 AI 搜索功能(如 AI Overviews 和 AI Mode)正推动搜索查询量增长,而非像外界此前担心的那样蚕食搜索流量。这一结论意味着 AI 不仅没有削弱 Google 核心搜索业务,反而正在强化其商业价值。

TechRadar 对 Fliki AI 视频生成与编辑平台进行了实测,认为其操作简便、AI 辅助编辑功能实用,但免费版额度有限且分辨率上限仅 1080p,定价在促销期间相对合理。

Anthropic 推出了 Claude 安全插件(测试版),这是一个基于多代理架构、在终端中直接运行的漏洞扫描工具,旨在将 AI 编程助手 Claude Code 的能力延伸至代码安全检测与修复环节。

初创公司 Cactus 推出了一款名为 Gemma 4 E2B Hybrid 的混合模型,它在小型本地模型内嵌了“置信度探针”,能对每个输出打分,低分时自动将请求转给更大的 Gemini 3.1 Flash-Lite 模型。它仅需将 15–35% 的查询转发即可在多数基准测试中匹敌大模型,显著减少了对云端算力…

日本 IT 服务巨头 NTT DATA 通过部署 OpenAI 的 Codex 智能体,将原本需要 5 名资深工程师耗时 3 天的复杂系统故障分析缩短至 30 分钟。目前已有约 9000 名员工在日常工作中使用 Codex,涵盖技术和非技术岗位,成为企业级 AI 智能体落地的标志性案例。

谷歌母公司Alphabet最新财报显示,AI驱动的搜索功能(AI Overview和AI Mode)不仅未像市场担忧的那样取代传统搜索,反而大幅拉动了搜索量和收入增长。AI Mode全球月活突破10亿,直接推动搜索业务收入同比增长17%,但这也引发了数字出版行业对流量流失的强烈担忧。

7月23日,高德宣布其ABot具身体系完成全栈升级,一次性推出五款核心模型,覆盖导航、操作、决策、操作系统和运动控制。这标志着高德将此前碎片化的机器人能力整合为统一架构,目标直指通用机器人在复杂场景下的规模化部署。