顶级模型一句话,AI 写出了能玩的 QQ飞车

一位开发者用三句提示词分别让 Claude Opus 5.5 生成了《QQ飞车》同人竞速、《穿越火线》运输船团队竞技和"鹈鹕骑单车追鱼"三个可玩的 3D 网页游戏,每个都是单文件 HTML,外部请求为零。它说明大模型已经能把成熟玩法规则落成可运行原型,但性能预算、设备边界和手感调校仍是明显短板。

一位开发者用三句提示词分别让 Claude Opus 5.5 生成了《QQ飞车》同人竞速、《穿越火线》运输船团队竞技和"鹈鹕骑单车追鱼"三个可玩的 3D 网页游戏,每个都是单文件 HTML,外部请求为零。它说明大模型已经能把成熟玩法规则落成可运行原型,但性能预算、设备边界和手感调校仍是明显短板。

一支包含复旦大学研究者的团队复盘了自家 7440 亿参数大模型 Atria Dawn Preview 的开发过程,发现 AI 承担了 96.5% 任务中的执行工作,但目标与方法的最终决定权仍有 85% 以上握在人类手里。

Hacker News 上一个讨论帖关注到:用户仅通过切换 Chat Template(对话模板),就能让大模型从“厂商安全口吻”切换成“我作为语言模型”的自我指涉语气,从而绕过部分厂商预设的“合规话术”。这暴露了当前 LLM 对齐与系统提示词之间的结构性脆弱点。

一篇被 COLM 2026 与 KONVENS 2026 研讨会接收的论文发现,决定大模型说“我只是一个 AI”还是“我感觉……”的关键开关,可能不是模型权重,而是部署时套上的 Chat Template。这一发现直接关系到我们该如何看待模型关于自身的说法。

《纽约时报》记者 Lily Kuo 的报道指出,中国 AI 业界与部分舆论对“AI 存在性风险”的警告持怀疑态度,认为这套叙事带有明显的西方色彩,甚至可能是用来拖慢中国 AI 公司追赶美国对手的手段。这个分歧值得关注,因为它可能影响未来全球 AI 安全规则由谁来定义。

开发者“去伪存真”在掘金分享了从零开发 MCP 工具 smart-excel-mcp 的完整过程,把多个 Excel 的列提取、合并归档与邮件发送,串成由大模型直接驱动本地 Python 进程的自动化工作流。

一篇来自掘金的技术解读厘清了 MCP(Model Context Protocol)在 Agent 工具调用链路中的真实位置——它管的不是模型怎么"想",而是应用怎么"接"。对正在搭 Agent、写工具适配的开发者来说,这能省下不少重复造轮子的功夫。

Layoutr 是一款在 Product Hunt 上线的 AI 室内设计工具,主打用生成式图像能力把房间照片或设计需求快速变成可视化方案。它值得关注的点在于:室内设计正成为图像生成模型最容易落地、也最容易变现的垂直场景之一。

OpenAI 在 Product Hunt 上线了名为「GPT-6 Sol & Luna」的产品页面,从命名看像是把下一代大模型拆成了两个不同定位的版本。目前公开信息有限,页面本身未提供可核实的参数与发布时间。

Product Hunt 上出现了一份面向“一人企业”的 AI 工具合集,试图把分散在设计、写作、客服、财务等环节的 AI 应用打包成单人可用的工具箱。它本身不是某款新产品发布,而是一份选品清单,反映出一人公司正成为 AI 工具争夺的用户场景。