在8美元微控制器上运行一个28.9M参数LLM

开发者成功在Milk-V Duo——一款售价约8美元、配备256MB内存和1TOPS TPU的微控制器上,运行了一个28.9M参数的大语言模型,证明极低成本的嵌入式设备已能承担基础AI推理任务。

开发者成功在Milk-V Duo——一款售价约8美元、配备256MB内存和1TOPS TPU的微控制器上,运行了一个28.9M参数的大语言模型,证明极低成本的嵌入式设备已能承担基础AI推理任务。

以色列初创公司Elio正在开发一种专门为AI视觉任务设计的新型图像传感器,而非传统的人类观看用途,近日完成了2100万美元A轮融资,由Innovation Endeavors和Xora联合领投。这标志着AI硬件开始从“通用传感器+后端算法”迈向“传感器即AI推理单元”的新阶段。
![DeepSeek暂停融资,此前关于与美国算力差距的评论泄露(转录文本)[pdf]](https://www.chat-gpts.plus/wp-content/uploads/2026/07/ai_cover_2-813-768x403.jpg)
DeepSeek 主动暂停新一轮融资,导火索是一场内部投资者会议的录音被泄露——创始人梁文锋在会中坦承中国大模型在算力层面与美国仍差一个数量级,这种敏感表述外流可能动摇投资者预期。

独立开发者 Owen Song 发布了 Inflect-Micro-v2,一个仅有 9.36M 参数的端到端文本到语音模型,可在 CPU 上以 6 倍实时速度运行,并在社区盲测中取得 66.2% 的偏好率。它证明了极低参数量也能实现可用的语音合成,为本地化、低算力部署提供了新选择。

中国正通过大规模开放AI模型源代码、并在发展中国家系统性地培训开发者和用户,试图构建一个区别于西方主导的AI全球秩序。这一策略不仅降低技术门槛,更意在扩大自身在AI标准与生态上的影响力。
![DeepSeek因有关与美国计算能力差距的言论泄露而暂停募资(文字记录)[pdf]](https://www.chat-gpts.plus/wp-content/uploads/2026/07/ai_cover_5-769-768x403.jpg)
DeepSeek 创始人梁文锋在一份泄露的投资者交流会记录中直言与美国在计算能力上的差距,该言论导致公司紧急暂停新一轮募资。事件暴露了中美 AI 博弈中算力敏感度升级,也打乱了中国最受关注的开源大模型公司的融资节奏。

德国老牌云服务商 Hetzner 推出了一项名为 Hetzner Inference 的实验性 AI 推理 API,目前仅支持一个开源模型,且不提供任何 SLA 或计费。这标志着以低价裸金属服务器闻名的 Hetzner,正试水大模型推理这一基础设施层,可能改变中小开发者的算力选择格局。

随着AI视频、音频和图像生成等创意生产工作负载在企业中普及,LTX CEO Zeev Farbman在TechRadar撰文指出,将这部分推理任务从云端迁移到边缘或本地环境,正从技术选项变为成本与数据控制的必然选择。核心驱动是:创意生产的高迭代量导致云成本失控,且敏感IP资产不适合在公网流通。

ServiceNow最新研究显示,尽管企业投入巨额资金部署AI工具,但实际应用率极低——只有9%的英国组织进入“增强”阶段。问题不在AI技术本身,而是企业文化和员工信任感的缺失导致工具被弃用。

2025 年美国 AI 私人投资已达 2859 亿美元,支撑近 2000 家新创 AI 公司。但决定下一阶段成败的关键并非芯片,而是“在哪跑、归谁管”。《欧盟 AI 法案》等监管落地正推动企业将数据从美国超大规模云迁移至本地化云基础设施,一场“云大迁移”正在重塑全球算力版图。