AI聊天机器人阅读X光片时,即使出错也自信满满,相当危险。

印度Ashoka大学CRASH Lab发布的RadLE 2.0基准测试显示,当前主流大模型在放射科诊断中普遍存在“高自信误诊”问题。测试中,人类放射科医生得分988.7分(满分2000),而最佳AI模型仅获758分,且许多模型在错误答案上表现出完全自信,这直接威胁患者安全。

印度Ashoka大学CRASH Lab发布的RadLE 2.0基准测试显示,当前主流大模型在放射科诊断中普遍存在“高自信误诊”问题。测试中,人类放射科医生得分988.7分(满分2000),而最佳AI模型仅获758分,且许多模型在错误答案上表现出完全自信,这直接威胁患者安全。

Epoch AI 的最新研究显示,当 AI 模型被要求模仿特定作者的写作风格时,主流的 AI 文本检测器(如 Pangram、GPTZero 和 Originality.ai)的漏检率会从接近 0% 骤升至平均 13%。其中科学写作领域的漏检率最高,在 24% 至 29% 之间,这直接威胁到学术界和教育场景中…

通义千问于 2026 年 7 月 19 日发布了 Qwen3.8,一个参数量高达 2.4T(万亿)的开源大模型。该模型声称性能仅次于 Fable 5,并通过阿里云 Token Plan 服务上线预览版,开发者可立即试用。

用户通过 Docker 部署 Open WebUI v0.10.2,创建了自定义工具,该工具使用 python-docx 生成 .docx 文件,并通过 __event_emitter__ 以 type: "file" 方式发送文件。在聊天中触发工具后,前端显示工具执行状态,最终助手消息仅包含工具的

用户在 Python 环境中执行 import transformers 命令,或脚本中导入该库时触发,常见于同时安装了 PyTorch、TensorFlow、JAX/Flax 等多种框架的开发环境。问题在 GitHub Issue #44273 中被报告,后续在 PR #45013 中有修复尝试,

在 Hugging Face Transformers 库的 Trainer 中,当用户从 checkpoint 恢复训练,并且 dataloader 包含随机操作(例如在 Dataset 的 __getitem__ 中应用随机噪声、数据增强或使用随机采样器)时,训练过程可能无法复现原始不间断运行的

用户在使用 n8n (版本 2.31.1,部署于 Docker 云端)时,尝试通过自定义连接器(Conector Personalizado / MCP)连接 Claude 。用户报告所有流程均无法连接 Claude,此前可以正常工作。问题在 Enterprise 许可证沙箱环境中复现。

用户在虚拟化 Intel Xeon 6 / Granite Rapids 主机(GCP C4 系列, c4-standard-24-lssd ,Xeon 6985P-C)上运行 Ollama 官方发行版(0.31.1–0.32.1,包括 Docker 和原生 Linux 安装),所有模型在首次推理时

一段引发Hacker News热议的视频观点认为,当前AI行业的估值泡沫正在复刻当年互联网泡沫破裂的路径,投资者和从业者需警惕AI基础设施建设过热带来的回调风险。

Elon Musk旗下SpaceX宣布开源AI编码工具Grok Build CLI,并承诺在所有用户层面默认关闭数据留存功能,此前该工具被曝在用户不知情下上传完整代码仓库至云端,引发隐私争议。