标签: 大模型

AI 现在能设计电路板了吗?

AI 现在能设计电路板了吗?

AI 已经能完成从电路原理图设计、仿真到迭代修复的闭环工作流,但一旦涉及 PCB 布线这类几何空间推理任务就会“失灵”。这件事之所以重要,是因为它正在帮我们重新划定“大模型自动补全”与“真正智能”之间的清晰边界。

今晚别刷Netflix了。 去看这个SpaceX AI工程师1小时的课程。 这是我见过最清晰、端到端讲透GrokBot到底该怎么真正用起来的课。 从单agent开始,一路到loop、graph、多智能体协作、verification和agent-friendly架构。 不管你是从没认真跑过agent,还是已经天天在用GrokBot,看完都会把很多“原来如此”的点一次打通。 真正核心就这几层: 1. 99%的人只用1个agent,没用l…

今晚别刷Netflix了。 去看这个SpaceX AI工程师1小时的课程。 这是我见过最清晰、端到端讲透GrokBot到底该怎么真正用起来的课。 从单agent开始,一路到loop、graph、多智能体协作、verification和agent-friendly架构。 不管你是从没认真跑过agent,还是已经天天在用GrokBot,看完都会把很多“原来如此”的点一次打通。 真正核心就这几层: 1. 99%的人只用1个agent,没用l…

SpaceX 的一位 AI 工程师发布了一堂约 1 小时的公开课,系统讲解如何从单个 agent 起步,逐步搭建包含 loop、graph、多智能体协作和验证机制的真实工作流。课程内容被社区认为是目前最清晰的 GrokBot 端到端实战指南,重点在于纠正“只用单个 agent 等于没真正用起来”的普遍误区。

读知乎回答有感,浅谈一下后训练 benchmark https://t.co/wA8Q06vZVe Any benchmark will be saturated,而随着工业界后训练的发展,reasoning / coding 的 benchmark 越来越泛化 / 众包化。其实 LLM eval 一直是个草台班子,每家都可以有自己的 setting,而任何 setting 只要不被强行统一就存在操作的空间,最早可以调 tempera…

读知乎回答有感,浅谈一下后训练 benchmark https://t.co/wA8Q06vZVe Any benchmark will be saturated,而随着工业界后训练的发展,reasoning / coding 的 benchmark 越来越泛化 / 众包化。其实 LLM eval 一直是个草台班子,每家都可以有自己的 setting,而任何 setting 只要不被强行统一就存在操作的空间,最早可以调 tempera…

AI 研究员 Xiuyu Li 指出,后训练时代的模型评测正从“统一标准”走向“众包化”,任何中心化榜单都可能被操纵,而真正前沿的 agent 能力已经开始超越单一 benchmark 的评估范围。

Google AI Mode 显示同款商品价格比传统搜索贵 21.6%

Google AI Mode 显示同款商品价格比传统搜索贵 21.6%

有用户在 Hacker News 上测试发现,Google AI Mode 展示的同款商品价格比传统搜索高出约 21.6%,原因是 AI Mode 调取的是偏信息型的自然搜索结果(常为厂商建议零售价),而非独立购物模式里的比价排名。争议背后是:AI 搜索的“正确答案”与用户“想省钱”的真实意图存在系统性错位。

鸿蒙 AI Coding 的研发新范式与工程实践

鸿蒙 AI Coding 的研发新范式与工程实践

华为发布了面向鸿蒙(HarmonyOS)的 AI Coding 工具链 DevEco Code 和 DevEco CLI,通过双引擎加开放市场的方式,解决 ArkTS 语料稀缺、多设备适配复杂等大模型编程落地难题。这标志着 AI 编程竞争已从通用代码生成,转向针对特定生态的深度工程化整合。