刚刚,百度开源拿下全球第一!作者疑似 DeepSeek 出走大神

百度开源了一款名为 Unlimited OCR 的超轻量 OCR 模型,以 500M 激活参数(总参数 3B)在端到端文档解析基准上打败了 Qwen3-VL(235B)等大模型,综合得分 93.23%。技术报告作者名单中,技术总监仅署名为“YY”,而核心贡献者之一魏浩然(DeepSeek OCR 前核心作者)…

百度开源了一款名为 Unlimited OCR 的超轻量 OCR 模型,以 500M 激活参数(总参数 3B)在端到端文档解析基准上打败了 Qwen3-VL(235B)等大模型,综合得分 93.23%。技术报告作者名单中,技术总监仅署名为“YY”,而核心贡献者之一魏浩然(DeepSeek OCR 前核心作者)…

在掘金社区本周的 AI 话题热议中,一位开发者提出了企业落地智能体的核心选择困境:是部署私有化的 Dify 平台,还是在小团队条件下直接写代码?这一问题折射出当前中小企业 AI 应用落地中“成本、效率与可控性”之间的真实博弈。

2026年6月,清华教授唐杰带领的智谱AI推出编程能力排名全球第二的大模型GLM-5.2,在国产模型被质疑差距拉大的焦虑时刻,证明了中国AI在“让模型干活”这一关键能力上已跻身世界前三。

Meta 在 2025 年 4 月后的几周内,通过强制抽调核心工程师做数据标注、记录键盘鼠标操作为 AI 训练数据、放宽 AI 代码审核标准等激进手段,将二十年来以“工程师自主权”为核心的工程文化几乎摧毁,直接导致了 Facebook 和 Instagram 的 SEV0 级宕机事故。这并非孤例,而是“AI…

即将加入OpenAI的AI研究员Alisa Liu复盘了自己57场面试的经历,发现顶级AI公司最看重的并非论文和前沿判断,而是机器学习编程、LeetCode算法题和Transformer的手写实现能力。这一复盘在AI圈引发广泛共鸣,揭示了当前AI岗位招聘的核心门槛。

百川智能联合清华大学团队发布医疗增强大模型Baichuan-M4,在权威医疗评测HealthBench中超越GPT-5.5,核心变化是从被动问答转向主动问诊,并引入全程记忆与证据锚定技术,提升了AI在临床决策中的安全性与可用性。

2026年高考成绩公布之际,国内多所“双一流”高校宣布大幅扩招,总名额创近年新高;与此同时,AI与机器人成为新增本科专业最集中的方向,9所高校首次开设“具身智能”本科专业,释放出高等教育体系向人工智能产业加速输送人才的明确信号。

字节跳动火山引擎在2026年6月发布Seedance 2.5视频生成大模型,支持一次性输入50个多模态素材并直接生成30秒原生视频,同时宣布与周星驰合作,允许用户基于其经典电影进行二次创作。

2026年6月23日,字节跳动在火山引擎FORCE动力大会上发布了豆包大模型2.1Pro及多款生成模型,同时明确对普通用户的日常功能永久免费,并计划推出面向专业场景的付费“专业版”办公模式,标志着豆包正式启动“免费大众+付费专业”的商业化双轨策略。

字节跳动旗下豆包视频生成大模型 Seedance 2.5 在 2026 年字节跳动引擎原动力大会上亮相,支持最长 30 秒单次视频生成,目前已开启企业级测试,预计 7 月初面向全球市场正式发布。这是当前公开信息中单次生成时长最长的视频模型之一,直接挑战此前行业普遍存在的 15–20 秒创作瓶颈。