腾讯混元发布 HyOCR-1.5:端到端 OCR 大模型全栈开源,推理提速 6.37 倍

腾讯混元发布了仅 1B 参数(约十亿参数)的端到端 OCR 大模型 HyOCR-1.5,实现训练、推理、权重全栈开源,并引入 DFlash 投机解码框架,将推理速度最高提升 6.37 倍。该模型在文档解析、古文字识别、图表解析等多项基准测试中达到或超越更大规模模型的表现,为轻量化、高性能的 OCR 方案提供了…
先解决问题,再了解资讯。选择你现在要完成的任务。

腾讯混元发布了仅 1B 参数(约十亿参数)的端到端 OCR 大模型 HyOCR-1.5,实现训练、推理、权重全栈开源,并引入 DFlash 投机解码框架,将推理速度最高提升 6.37 倍。该模型在文档解析、古文字识别、图表解析等多项基准测试中达到或超越更大规模模型的表现,为轻量化、高性能的 OCR 方案提供了…

德国AI协会(KI Bundesverband)领衔的研究联盟发布了开源大模型Soofi S(30B参数,激活3.2B)。该模型在英语和德语基准测试中,得分超过OLMo 3 32B和Apertus 70B等完全开源竞品,并且是首批完全在德国电信工业AI云上训练完成的大模型。
![[Bug]: Observation/trace ids used verbatim as S3 object keys; non-S3-safe ids (base64 with '=') fail on MinIO](https://www.chat-gpts.plus/wp-content/uploads/2026/07/14457-de7e06c6-768x403.jpg)
用户在 Langfuse 自托管部署中,使用 MinIO 作为 S3 对象存储后端,通过 LiteLLM 的 langfuse 回调记录 Responses API 的生成事件。LiteLLM 传入的 observation ID 格式为 resp_= (包含 base64 填

用户在 Langfuse(self-hosted, v3.157.0)中创建数据集,并使用 Python SDK(3.14.5)通过 itemclient.run 等 API 对数据集进行多次评测。每次评测都使用同一个 run name(例如 "eval-run-1" ),导致在 Langfuse

用户在使用 Langfuse v3.205.1 EE(v4 自托管预览版) 时,配置了 LANGFUSE_MIGRATION_V4_WRITE_MODE=events_only 写入模式,通过 Python SDK v4 向新的 Project 写入 traces/observations 数据。打

OpenAI 取消了 Codex 每 5 小时的使用限制,但用户实测发现 GPT-5.6 Token 消耗极高,此前依赖的 Skills(如 Superpowers)反而成为负担。官方随即发布提示词指南,强调结果导向、精简上下文、设定边界和验收标准。

2026年7月,工信部NVDB平台发布风险预警,指出Claude Code存在安全后门隐患,可收集用户敏感信息;蚂蚁安全近期开源了SingGuard-NSFA和SingGuard两套安全框架,试图从底层定义智能体行为与多模态感知的安全边界,而非继续依赖事后打补丁。

云原生计算基金会(CNCF)正式将招商银行基于HAMi构建的AI计算调度平台列为官方标杆案例,表明这一由中国团队发起的开源技术在金融级生产环境中获得国际权威认可,解决了算力孤岛和资源闲置等普遍性瓶颈。

AI 视频广告制作工具 Creatify 推出了新版 AI Media Buyer 功能,它能连接主流广告平台(如 Meta、Google、TikTok),自动审计广告投放、发现浪费、生成新素材并自动执行,整个过程通过对话完成,并且会持续学习账户历史。这标志着 AI 从“帮你做素材”进化为“帮你做投放决策”。

AI创业公司“自建算力更便宜”的共识被打破。一位行业专家通过公开模型和实际案例证明,只有当GPU集群利用率超过52%时,自建才能跑赢调用API——而大多数团队的实际利用率往往在30%-50%之间,自建反而更贵。这揭示了API厂商利用信息不对称的定价策略。