在Apple Silicon上实测LLM推理速度,附带原始数据(CC BY 4.0)

Macyou 发布了在 M4 版 Mac mini 上运行主流开源大模型的实测推理速度:3B 模型达 46.7 tok/s,8B 模型约 20–22 tok/s,14B 模型约 11.7 tok/s。数据公开且可复现,为开发者评估 Apple Silicon 本地推理能力提供了真实参考。

Macyou 发布了在 M4 版 Mac mini 上运行主流开源大模型的实测推理速度:3B 模型达 46.7 tok/s,8B 模型约 20–22 tok/s,14B 模型约 11.7 tok/s。数据公开且可复现,为开发者评估 Apple Silicon 本地推理能力提供了真实参考。

Feyn Labs 于 2026 年 7 月 21 日发布了开源图像背景去除模型 FeyNoBg,在 8 项基准测试中拿下 4 项 SOTA,同时公开了训练库 NoBg。相比此前广泛使用的 BiRefNet,FeyNoBg 在超高分辨率图片(如 UHRSD-TE)上准确率提升超 2%,让高质量自动抠图向开发者…

比亚迪确认其人形机器人产品将于今年8月在郑州“迪空间”体验中心首次公开亮相,优先瞄准商业服务场景,如展厅接待、产品讲解和用户互动,而非直接进入工厂产线。这标志着传统汽车制造巨头正从智能汽车向具身智能终端延伸,人形机器人的商业化落地进入可验证阶段。

选择大模型时不能只看模型名字,同一模型在不同 API 提供商手中,延迟、吞吐量、稳定性和实际回答质量都可能天差地别;OpenRouter 发布的这份评估指南,为开发者提供了一套可量化、可操作的提供商性能衡量方法,帮助避免被单一基准测试误导。

针对“LongCat基础模型负责人裴鹏即将离职”的传闻,美团官方快速否认,称消息不实。事件之所以引发关注,是因为LongCat-2.0作为首个全依赖国产算力的万亿参数行业大模型,刚发布不到一个月,核心人物的去留直接影响外界对其技术投入的决心。

开源项目 TaiXu-Admin 发布 V0.1.2 版本,将大型语言模型对话、检索增强生成(RAG)和智能体(Agent)协同等核心能力整合到一套统一的后台管理系统中,降低了开发者在本地搭建、测试和管理多智能体应用的门槛。

OpenAI CEO Greg Brockman 近日对外透露,公司正计划通过 API 将 ChatGPT 的语音交互能力开放给智能眼镜等可穿戴设备。不过他同时承认,这个 API 目前仍处于非常早期的原型阶段,距正式落地还有相当距离。

月之暗面(Moonshot AI)于7月28日正式开源了拥有2.8万亿参数的Kimi K3模型权重及技术报告,并同步公开了支持其训练的三大基础设施技术。这是目前全球参数规模最大的开源大模型,上线数小时便登顶AI代码工具排行榜,甚至获得了马斯克的公开点赞。

机器人初创公司 Enigma 获得 7100 万美元种子轮融资,试图打造一种像拧音量旋钮一样直观的机器人控制方式,并已开放全球在线实验,让任何人都能远程与 100 多台实体机器人互动。这反映出资本开始押注“交互体验”而非单纯的模型能力。

微软发布了一套由红、蓝、绿三类AI代理协同工作的安全系统Project Perception,其专用模型MAI-Cyber-1-Flash在漏洞评估基准CyberGym上得分96%(比Anthropic的Mythos高12个百分点),成本降低约50%,将于8月3日进入公开预览。这标志着安全行业从依赖单一模型转…