标签: Gemini

用 AIPerf 大规模基准测试 LLM 推理

用 AIPerf 大规模基准测试 LLM 推理

NVIDIA 推出 AIPerf,作为 GenAI-Perf 的官方继任者,用于大规模测试大模型推理性能。它用多进程架构替代单进程方案,避免压测工具自身成为瓶颈,并支持 15 种以上端点类型和真实流量回放。

世界模型公司藏了不少秘密

世界模型公司藏了不少秘密

TechCrunch 记者在 All In 大会主持世界模型圆桌后发现,包括 Yann LeCun 的 AMI Labs 和 Fei-Fei Li 的 World Labs 在内,这个赛道的主要玩家几乎都不肯透露自己在做什么产品、面向什么市场。这不是低调,而是一种刻意的战略沉默。

AI幻觉险些触发美军行动

AI幻觉险些触发美军行动

今年春季,美军一次针对中国船只的武装行动在军机已经升空后被紧急叫停,原因是驱动该行动的情报出自一个 AI 聊天机器人的“幻觉”。这起事件把大模型错误如何沿指挥链上行的问题,摆到了军事决策桌面上。

Copilot 代码审查:更出色的审查体验

Copilot 代码审查:更出色的审查体验

GitHub 在 2026 年 9 月 18 日为 Copilot 代码审查推出正式版更新,让审查进度可视化、自动解决评论更智能,并在批量采纳建议时自动生成提交信息。这次改动把 AI 代码审查从“一次性给意见”推向“持续跟踪问题状态”的工作流工具。