在 Claude Code 中测试 Moonshot AI 的 Kimi K3

Moonshot AI 发布 2.8 万亿参数的 Kimi K3,称将是首个该规模的开源权重模型,实测在 Claude Code 工作流中表现接近顶级闭源模型,成本比 Claude Opus 4.8 低约 40%。开源大模型与闭源前沿的差距正在缩短到数月级别。

Moonshot AI 发布 2.8 万亿参数的 Kimi K3,称将是首个该规模的开源权重模型,实测在 Claude Code 工作流中表现接近顶级闭源模型,成本比 Claude Opus 4.8 低约 40%。开源大模型与闭源前沿的差距正在缩短到数月级别。

开发者 @goan999999 在 X 平台分享了一个针对 Codex 的配置技巧:通过本地自定义代理 `luna_worker`,让 ChatGPT Plus 用户调用一个名为 `gpt-5.6-luna` 的模型,并以多 Agent 分工的方式绕开额度限制,实现接近“无限 token”的 vibe cod…

Product Hunt 上出现了一个名为“Prompt Engineer”的产品页面,从标题与分类看,它面向提示词工程这一热门方向,试图将“写提示词”从个人经验变成可复用、可产品化的能力。目前公开信息显示,该页面的具体功能与定价尚未完整披露。

OpenAI在2026年7月底解散了专门评估灾难性AI风险的“Preparedness”团队,相关工作被拆解到其他部门。这次组织调整发生在多名安全高层离职、内部担忧加剧的背景下,引发外界对OpenAI安全治理优先级的新一轮讨论。

一款名为 AadidevGPT 的产品在 Product Hunt 上线,从名称和发布渠道看,它瞄准的是“面向开发者的 GPT 类工具”这一细分赛道。目前公开信息显示,该产品处于早期曝光阶段,具体能力和定价尚未明确。

X 用户 Thibault Sottiaux 指出,不同 AI 模型对同一段文本的分词数量并不相同,业界流行的“每百万 token 价格”对比实际上并不科学——低价 token 不等于低账单。他建议从业者把注意力转向“每个成功结果的价格”。

AI 基础设施公司 Pathway 完成 3000 万美元种子轮融资,估值达 5 亿美元。它押注的是基于生物启发设计的“Post-Transformer”BDH 架构,试图在 Transformer 之外寻找下一代大模型的技术路线。

一篇发表于 Hacker News 的分析文章认为,AI 解决数学难题的能力未必源于更强的推理,而可能来自近乎无限的“符号工作记忆”(也就是上下文窗口),这恰好补上了人类工作记忆容量有限这一生物学短板。

一位开发者用 OpenAI Codex 作为“自动研究”工具,在 GPU 内核优化竞赛中把基线方案的运行速度提升了 232 倍;这件事说明大模型驱动的 Agent 已经能从试错中学习,并在底层系统优化领域取得实用成果。

8月15日,独立博主@NFT_Chen 公布了一套针对 DeepSeek V4 Pro 0813 的配置优化方案:通过开源插件动态控制工具暴露数量,能让同款模型跑分从 91 提升至 98/99。这件事提示我们,大模型评测分数与运行环境强相关,默认配置远不是模型能力的上限。