MiniMax 计划推出新一代大模型 参数规模 2.7 万亿

稀宇科技(MiniMax)正在筹备发布参数规模达2.7万亿的新一代大模型,意图通过大幅提升参数量强化复杂任务处理与逻辑推理能力。这一规模远超当前主流模型,直接体现出头部玩家在算力与研发上的不惜重注。

稀宇科技(MiniMax)正在筹备发布参数规模达2.7万亿的新一代大模型,意图通过大幅提升参数量强化复杂任务处理与逻辑推理能力。这一规模远超当前主流模型,直接体现出头部玩家在算力与研发上的不惜重注。

在 ICML 2026 颁奖现场,2016 年经典论文 A3C 的第一作者 Volodymyr Mnih 直言,如果当年有充足 GPU,这项开创性工作根本不会诞生。他用亲身经历揭示:学术创新常源于资源约束,持久影响力来自“最小创新”而非炫技,而规模化回报的规律早在十年前就已显现。

OpenAI 最强模型 GPT-5.6 系列(Sol、Terra、Luna)历经两周有限预览后,已获得美国商务部批准,将于本周四正式向全球公开发布。这标志着美国政府对顶级 AI 模型的监管审批节奏出现松动,也将直接拉高商用大模型的能力门槛。

在 Transformers 5.12.1 中,使用 AutoTokenizer.from_pretrained("vesteinn/ScandiBERT") 加载 vesteinn/ScandiBERT 模型的 tokenizer 时触发。该 tokenizer 的原始模型是 BPE 类型,但 t

用户在使用 Hugging Face Transformers 的语义分割模型(如 DETR、MaskFormer、Mask2Former、OneFormer 等)时,通过 post_process_semantic_segmentation 函数获取分割结果。当前该函数会强制对 logits/sc

用户在 Windows 11 环境下,使用 Transformers 5.12.1 调用 AutoProcessor.from_pretrained() 加载模型(如 "facebook/dinov3-vits16-pretrain-lvd1689m" )。当配置了 HF_ENDPOINT 环境变量

2026年,AI视频生成工具已从“能用”跨入“专业级”阶段,字节跳动Seedance 2.0以导演级分镜能力领跑国内,快手可灵3.0在物理交互上接近满分,国外Sora、Veo、Runway则在长视频、音画同步和后期整合上各占优势。36氪的横评显示,当前工具已能覆盖从零基础短视频到专业影视预演的全场景。

小米汽车确认全新子品牌“SKYNOMAD”(澎程),首款增程SUV预计2026年下半年发布;OpenAI首席未来学家约书亚·阿奇亚姆在任职九年后宣布离职;粉笔创始人张小龙因个人事务辞任CEO及董事会主席。

一位开发者用 Grok 4.5、GPT-5.5 和 Claude 做了同一件事——让它写一篇关于“用这三个模型构建相同应用”的博客。结果引发了一场关于 AI 写作风格趋同、成本与质量比较,以及“AI 检测工具缺失”的真实讨论。

开发者发布了一款名为 Frugon 的本地 CLI 工具,能分析用户已有的 OpenAI 风格 API 调用日志,识别出哪些任务可以使用更便宜的模型替代,从而在不显著牺牲质量的情况下降低 LLM 使用成本。实测数据显示,一次 5.6 万次调用的模拟月账单可以从 549.46 美元降至 343.91 美元,节省…