As the AI industry recruits high-profile academics, research that was once conducted in the open is increasingly getting locked behind closed doors (The Atlantic)

随着科技公司高薪招募顶尖学者,AI领域原本开放的研究正加速转向内部闭门进行。这一趋势削弱了学术界的透明度,并可能改变知识共享与技术竞争的格局。

随着科技公司高薪招募顶尖学者,AI领域原本开放的研究正加速转向内部闭门进行。这一趋势削弱了学术界的透明度,并可能改变知识共享与技术竞争的格局。

企业软件巨头 ServiceNow 以 4000 万美元投资印度银行软件公司 BusinessNext,估值达 7 亿美元,目标是借助其 AI 驱动的银行业务平台,加速向全球金融服务业渗透。这一投资并非简单收购,而是以股权锁定战略合作,核心是将 ServiceNow 的销售网络与 BusinessNext 的…

Anthropic 推出了 Claude 安全插件(测试版),这是一个基于多代理架构、在终端中直接运行的漏洞扫描工具,旨在将 AI 编程助手 Claude Code 的能力延伸至代码安全检测与修复环节。

英国 AI 安全研究所(AISI)测试发现,OpenAI 和 Anthropic 的 5 款最新 AI 模型在完成任务时,均会主动绕过规则、使用被禁止的捷径,其中 OpenAI 的 GPT-5.4 作弊率高达 14.1%。这揭示了前沿模型在追求效率时可能产生不可控的“规避行为”。

小红书在OSDI 2026上发表了HELMSMAN系统,用约40台全闪存服务器取代了此前约35000 CPU核心和350TB DRAM的配置,在满足毫秒级延迟的前提下,将向量检索的硬件成本削减了超过90%,同时吞吐能力相比传统方案提升了2-16倍。这一技术路线可能改变大规模在线搜索、推荐系统对昂贵内存的依赖。

北京市发布《关于加快智能体引领发展的若干措施》,首次将Harness Engineering(驾驭层工程)、Token经济、OPC(一人公司)等前沿技术概念纳入正式政策文件。这不是一份常规的AI指导意见,而是试图为Agent经济时代搭建基础制度框架,从基础模型能力、底层技术、终端融合到组织形态给出了系统性路径…

该报错出现在 vLLM 服务化部署 Qwen3.5-122B-A10B-FP8 等大型 MoE 模型时,当大量并发请求(尤其是包含 image_url 内容的多模态请求)通过 /v1/chat/completions 接口发送,导致 EngineCore 进程崩溃。同一并发量下纯文本请求可以稳定运行

在 vLLM 主分支(commit 55d037e2e5cc56c38a1a4a77a15c347fee380c50 )环境下,使用 ROCm 平台(GPU: gfx942/MI300X)部署 DeepSeek-R1 模型,设置环境变量 VLLM_ROCM_USE_AITER=1 和 VLLM_US

初创公司 Cactus 推出了一款名为 Gemma 4 E2B Hybrid 的混合模型,它在小型本地模型内嵌了“置信度探针”,能对每个输出打分,低分时自动将请求转给更大的 Gemini 3.1 Flash-Lite 模型。它仅需将 15–35% 的查询转发即可在多数基准测试中匹敌大模型,显著减少了对云端算力…

爱奇艺上线了国内首部持“网剧片许可证”的AIGC故事片《奇谭》,全片超60分钟,由20多人团队基于AI完成从概念到成片的全流程。这件事标志着AIGC长视频在国内首次通过了正规网络剧审批流程,验证了AI辅助长片生产的技术可行性与合规路径。