Standardize test image fixture loading for COCO images

用户在运行 Transformers 测试时,例如在本地执行 pytest tests/test_image_processing_common.py 或特定模型测试(如 tests/models/vitpose/test_image_processing_vitpose.py ),测试中直接使用

用户在运行 Transformers 测试时,例如在本地执行 pytest tests/test_image_processing_common.py 或特定模型测试(如 tests/models/vitpose/test_image_processing_vitpose.py ),测试中直接使用

用户在使用 transformers v5 加载所有 CodeLlama 系列模型( codellama/CodeLlama-7b-hf 、 codellama/CodeLlama-7b-Instruct-hf 、 codellama/CodeLlama-7b-Python-hf 、 codella

知名科技博主 Peter Yang 在 X 上公开吐槽 Claude Code 的浏览器功能严重拉胯,直言希望 Anthropic 招些靠谱的人修好这个功能。这一抱怨引发 4600+ 次浏览,反映出开发者对 AI 编程工具体验的高期望与当前产品成熟度之间的落差。

一位AI产品观察者指出,Anthropic的Claude Code至今只集成了Google Drive一个Google Workspace应用,而ChatGPT却已深度连接Gmail、Calendar、Docs等多个生产力工具。这一差距意味着Claude在AI辅助工作流中的实用性和生态渗透力明显落后,可能影响…

Netflix 联合 CEO Ted Sarandos 在最新财报电话会上披露,该公司目前约有 300 个项目正在使用 AI 工具,主要集中在后期制作环节。这一数字反映出 AI 已经从实验性工具变为影视工业的标准化组件,但其引发的行业争议远未平息。

通义实验室发布 Wan-Streamer v0.2,将 AI 视频对话的端到端响应延迟压缩至约 550ms(含 350ms 网络传输),同时将输出分辨率从 192×336 提升至 640×368。这是目前公开信息中延迟最低的全双工视频交互模型之一,通过“Thinker-Performer”双通路架构在高画质与…

NVIDIA 正式推出 Nemotron 3 Embed 系列开源嵌入模型,其中 8B 参数版本在最新 RTEB 基准测试中位列第一,为 RAG 和语义搜索场景提供了更强的大模型嵌入方案。

一种名为 Schema 的“推理框架(Harness)”在 ARC-AGI-3 基准测试的公开集上,配合 Claude Opus 4.8 和 Fable 5 模型达到了 98.98% 的成绩,接近人类水平(100%)。它不修改模型权重,而是通过改进模型使用方式——即如何观察、建模、预测和修正——大幅提升了 A…

2026年7月17日,阶跃星辰(StepX)在上海WAIC 2026展会上展示了STEPX Neo样机,这是全球首款以大模型为底层架构、原生集成智能体(AI Agent)的手机,而非传统语音助手的简单升级。

在2026年世界人工智能大会上,银河通用机器人创始人王鹤预测,具身智能技术将在2028年前迎来重大突破,其性能将比肩对话式AI如ChatGPT。这一预测为机器人行业的商业化时间表提供了具体锚点,也将推动相关训练与计算需求加速爆发。