据报道,Google “Frozen v2″芯片将Gemini架构直接集成到硅片中,以提升效率

Google 正在内部研发一款名为“Frozen v2”的专用服务器芯片,其核心创新是将 Gemini 模型的架构(而非权重)直接固化到硬件中。该芯片有望在 AI 推理(即模型响应查询)的效率上比现有 TPU 提升 6 到 10 倍,计划于 2028 年部署,并被视为 Google 探索超专用 AI 芯片的试…

Google 正在内部研发一款名为“Frozen v2”的专用服务器芯片,其核心创新是将 Gemini 模型的架构(而非权重)直接固化到硬件中。该芯片有望在 AI 推理(即模型响应查询)的效率上比现有 TPU 提升 6 到 10 倍,计划于 2028 年部署,并被视为 Google 探索超专用 AI 芯片的试…

一份由社区开发者整理的技术路线图指出,大多数多步骤 AI 智能体(Agent)因采用线性串行架构而效率低下,Claude Code 已内置“动态工作流”工具,可直接构建节点与边组成的图结构,实现智能体的并行化、分支与循环,从而替代传统的排队执行。

OpenClaw 作者 Peter Steinberger 展示了单人在五台机器上并行运行 30 多个 AI 编程任务,借助 Git Worktree 功能实现代码独立管理。这一实践表明,AI 编程工具已从“辅助写代码”进化到“规模化并行研发”阶段。

Cursor 在内部测试了一种新型 AI 智能体集群架构,将任务拆解为“规划者”和“执行者”两类角色,使用 Grok 4.5 模型在4小时内通过了80%的 SQL 测试集,而旧架构在2小时内就失败中断。这一设计旨在解决单智能体在长周期任务中容易“迷失”的问题。

Replit 于 2026 年 7 月 20 日推出全新统一工具栏,将数据库管理、双因素认证(2FA)、SEO 扫描器等常用开发工具整合进一个界面,旨在降低开发者在平台内切换工具的摩擦。这一更新直接提升了 Replit 作为云端 IDE 的工具完整性和安全性,对依赖其进行快速原型开发与部署的个人开发者产生直接…

用户在运行 llama-server 时使用了包含 Agentic Content UX 改进(#25450)的 WebUI 构建,并连接了 MCP 服务器使模型能够调用工具。当用户在 WebUI 设置中关闭 "Show tool call in progress" 开关后,工具调用块仍然在推理过程

用户在运行 llama-server (基于 llama.cpp)时,WebUI 界面中的文本输入框(textboxes)高度出现异常(borked),在多个浏览器中均可复现,无论是否使用浏览器插件。该问题在移动端浏览器上同样存在。

xAI 推出了 Grok 的 Microsoft Excel 插件,用户可以直接在表格中用英语提问、自动生成公式和运行场景分析,无需离开工作簿。该插件免费可用,标志着 Grok 正式进入办公软件生态。

2026年7月,中国公司Moonshot.AI发布的Kimi K3开源模型在性能上与头部美国模型持平,且允许用户免费下载本地运行。这一事件直接导致美国股市部分下跌,并深刻动摇了OpenAI和Anthropic等闭源公司的商业模式与IPO前景。

《第九区》导演Neill Blomkamp发布了一部长达13分钟的科幻恐怖短片《Nightborne》,完全通过Seedance 2.0视频生成模型制作,并宣布将以此模式制作长片。这一动作将AI视频生成从实验性片段推向结构化叙事作品的制作流程,直接回应了行业对AI在创意产业应用的质疑。