在8的微控制器上运行一个拥有28.9M个参数的大语言模型

一位开发者成功在仅8美元的ESP32-S3微控制器上运行了拥有2890万参数的大语言模型,利用Google Gemma模型的逐层嵌入(Per-Layer Embeddings)技术,将模型主体放在闪存中按需读取,突破了微控制器512KB SRAM的内存瓶颈,实现约9.5 token/s的本地文本生成。

一位开发者成功在仅8美元的ESP32-S3微控制器上运行了拥有2890万参数的大语言模型,利用Google Gemma模型的逐层嵌入(Per-Layer Embeddings)技术,将模型主体放在闪存中按需读取,突破了微控制器512KB SRAM的内存瓶颈,实现约9.5 token/s的本地文本生成。

Debian 项目正式发起一项通用决议投票,核心提案(A 方案)要求全面禁止使用大语言模型或生成式 AI 工具撰写的任何贡献进入官方仓库、文档和通信。这可能是主流 Linux 发行版首次对 AI 辅助开发亮出“红牌”,其走向将对整个开源社区产生连锁影响。
![DeepSeek因有关与美国计算能力差距的言论泄露而暂停募资(文字记录)[pdf]](https://www.chat-gpts.plus/wp-content/uploads/2026/07/ai_cover_5-769-768x403.jpg)
DeepSeek 创始人梁文锋在一份泄露的投资者交流会记录中直言与美国在计算能力上的差距,该言论导致公司紧急暂停新一轮募资。事件暴露了中美 AI 博弈中算力敏感度升级,也打乱了中国最受关注的开源大模型公司的融资节奏。

Zilliz 联合创始人郭人通将在 2026 年 AICon 深圳站分享其内部如何用 AI Agent 构建“Agentic-Native”增长模式——让 Agent 承担重复认知与跨系统协调,支撑业务超线性扩张,同时避免支持团队线性膨胀。这提供了一个从工具到企业执行主体的 Agent 工程化实战案例,核心在…

日本AI公司Sakana AI发布了专为网络安全自动化设计的“编排模型”Fugu-Cyber,在CyberGym和CTI-REALM两大基准测试中取得86.9%和72.1%的成绩,直接挑战传统安全运营中的人工研判与多工具协同瓶颈。

项目管理平台 Monday.com 宣布裁员约 600 人(占总员工 20%),并将原因归为“AI 驱动增长战略”下的架构重组。这不是孤例——2026 年以来,美国科技公司因 AI 已裁减近 14 万个岗位,但 Financial Times 分析发现,这些公司宣布裁员后 30 个交易日内股价平均落后纳斯达克…

xAI 发布了 Grok 的命令行工具(CLI),并内置 /tutorial 命令帮助用户快速上手。这是 xAI 从对话界面走向开发者工具链的关键一步,让程序员和高级用户可以直接在终端中调用 Grok 模型。

OpenAI 正在将 ChatGPT 集成到医疗机构使用的电子病历系统中,让医生能够直接在病历界面调用对话式AI来帮助撰写、查询或整理患者信息。这一动作意味着大模型开始切入医疗数据最核心、合规门槛最高的环节。

AI 实验室 Midjourney 收购了拥有约 430 万月活用户的社交占星应用 Co-Star。此举不仅意味着 Midjourney 的产品线从图像/视频生成扩展到消费级社交领域,更可能为其推出独立移动应用铺路。

Bluesky将其AI助手Attie升级为一个开放社交研究工具,新增“Quests”功能,允许用户无需编程即可查询整个AT Protocol生态中的趋势与信息。此举意在用户增长放缓背景下,通过AI工具探索变现路径,并提升平台的数据可探索性。