花998美元把3.8B LLM训练到0.384 CORE – Hugo Vergnes

开发者 Hugo Vergnes 用约 998 美元租用 8 张 B200,在 43 小时内训练出一个 3.8B 参数模型 little-lm,CORE 得分 0.384,超过 GPT-2 的 0.2565。它说明个人开发者用几千美元也能训练出有实际能力的小模型。

开发者 Hugo Vergnes 用约 998 美元租用 8 张 B200,在 43 小时内训练出一个 3.8B 参数模型 little-lm,CORE 得分 0.384,超过 GPT-2 的 0.2565。它说明个人开发者用几千美元也能训练出有实际能力的小模型。

AI 安全领域知名研究者 Paul Christiano 将加入 OpenAI Foundation 董事会,并进入其安全与安保委员会。这意味着 OpenAI 在治理层面继续把“安全”作为对外释放的核心信号。

OpenAI 旗舰模型 GPT-6 Astra 已正式上线亚马逊云科技(AWS)的 Amazon Bedrock 平台,全球企业客户可在 AWS 的安全管理体系内直接调用该模型。这既是顶级闭源大模型深入企业云生态的关键一步,也把“数据不被用于训练”的合规承诺摆上了台面。

美国 NSA、CISA 和 FBI 联合指控 DeepSeek、月之暗面、阿里巴巴、MiniMax、阶跃星辰和智谱六家中国 AI 公司,自 2024 年底起通过大规模“蒸馏”手段提取美国前沿模型能力,包括 Claude、GPT、Gemini 和 Grok 的多个版本。这不仅是技术纠纷,更意味着中美 AI 竞争…

一项公开实验显示,给 Qwen3.8 A95B 灌入 GPT-5.5 Pro 前 1% 的推理内容后,其答案与 GPT-5.5 Pro 的相似度从 16.79% 跳升到 34.97%,涨幅远超其他开源模型,暗示 Qwen 的训练数据可能与 GPT 系列关系更近。

OpenAI 发布了一份免费的 GPT Image 2.5 提示词(Prompt)指南,系统讲解了图像生成与编辑时提示词的写法,核心是"先讲目的、再讲细节",并强调图片编辑要明确锁定不许改动的元素。

Images 2.5 发布后,一份整理生图提示词的 GitHub 项目清单开始在社群流传。提示词工程正从手工试错转向可检索、可复用的资产库,这比模型本身的版本号更值得创作者留意。

OpenAI 官方针对旗舰模型 GPT-6 Astra 发布了节省 Token 的实用指南,核心建议是默认使用低推理强度,仅在高难度任务时动态升级。这为重度 API 使用者提供了一条降低推理成本的明确路径。

OpenAI 于 2026 年 9 月 9 日前后发布 ChatGPT Images 2.5 生图模型,并新增 Sketch 功能,用户已开始将其与字节跳动旗下即梦 5.0 Pro 进行大规模效果对比,文生图竞争进入新阶段。

据 Business Insider 援引消息人士称,Salesforce 正在谈判以约 20 亿美元收购 AI 客户研究平台 Listen Labs,而该公司在今年早些时候的估值还仅为 5 亿美元。若交易达成,将是 Salesforce 在 AI 应用层的一次高溢价押注。