基于 MiniMax H3 Max 的 24 小时 AI 直播网站上线了

国内大模型公司 MiniMax 基于其最新音频模型 H3 Max,上线了一个 24 小时不间断的 AI 直播网站。这个产品把实时语音对话从“一次性问答”延展成“随时在线陪伴”,是 AI 应用形态的一次具体落地尝试。

国内大模型公司 MiniMax 基于其最新音频模型 H3 Max,上线了一个 24 小时不间断的 AI 直播网站。这个产品把实时语音对话从“一次性问答”延展成“随时在线陪伴”,是 AI 应用形态的一次具体落地尝试。

马斯克确认 SpaceX 正在得州自建燃气轮机叶片铸造厂,试图将 AI 数据中心配套发电设备的交付周期缩短最多 18 个月。但该计划可能让本已因污染遭诉讼的燃气轮机项目加速落地,环境与健康争议将进一步升温。

一位 AI 内容创作者整理了 66 个高频 AI 词汇的“人话版”解释,目的是帮零基础用户跨过 GPT、Agent、MCP 等术语门槛。这件事本身不改变技术格局,但反映出 AI 工具普及过程中,术语鸿沟正在成为真实的使用障碍。

《经济学人》提出一个关键疑问:目前 AI 的高频使用仍集中在程序员群体,其他职业尚未形成同等级别的日常依赖。这个问题直接关系到大模型商业化的天花板和下一阶段产品设计方向。

MarkTechPost Research 发布了一项以“首 token 时间(TTFT)”为核心衡量标准的大模型推理 API 基准测试,专门评估语音交互与实时 AI Agent 场景下的最低延迟服务,为开发者在选择实时应用后端时提供了新的可量化参考。

芯片设计初创公司 Agentrys 完成 2450 万美元两轮早期融资,由 MediaTek 和 Etna Labs 分别领投。这家公司瞄准的是 AI 算力需求爆发下的专用芯片设计赛道,值得关注的是其背后的联发科产业资本布局。

字节跳动原定8月发布的豆包大模型2.2宣布推迟,团队希望通过延长开发周期,在编程、工具调用和Agent能力上实现一次“全面跃升”。这背后是字节明确放弃“蒸馏捷径”、坚持自研路线的战略定力。

Hugging Face 旗下开源机器人公司 Pollen Robotics 正式开源了一款 25 厘米高、重 800 克的微型双足机器人 Microduck。它把强化学习训练、Sim2Real 迁移和 Rust 实时控制全部塞进不到 400 美元的硬件里,成为一套门槛极低的具身智能开发平台。

Murfy AI 是一款新近出现在 Product Hunt 上的 AI 工具,从产品形态看,它试图把 AI 能力嵌入到用户的日常工作中,让普通人无需理解底层模型细节即可调用生成式 AI。由于原始页面信息有限,目前公开信息显示它更偏向“AI 应用层”产品,而非底层大模型或算力服务。

当大模型参数规模逼近 7000 亿,普通消费级显卡的 8GB 显存早已无法直接加载推理,量化和蒸馏成为把模型“塞进去”并跑起来的关键技术手段。这篇文章梳理了这两条技术路线的原理和适用场景,帮助开发者理解如何在算力受限环境下部署大模型。