使用 NVIDIA NeMo 生成金融人工智能研究的综合数据

NVIDIA 发布了一套基于 NeMo 框架的迭代式合成数据生成方案,用于解决金融大模型微调中真实数据稀缺、类别失衡的问题。该方案在 6 天内用单台 8 路 B200 节点生成了约 50 万条独特新闻标题,并开源了数据集,有望降低金融 NLP 研究的门槛。

NVIDIA 发布了一套基于 NeMo 框架的迭代式合成数据生成方案,用于解决金融大模型微调中真实数据稀缺、类别失衡的问题。该方案在 6 天内用单台 8 路 B200 节点生成了约 50 万条独特新闻标题,并开源了数据集,有望降低金融 NLP 研究的门槛。

OpenAI 于 2026 年 7 月 9 日发布 GPT-5.6 系列,共三个尺寸:Luna、Terra 和 Sol。该系列主打长周期智能体任务效率,以更低推理成本在特定基准上超越了 Anthropic 的 Claude Fable 5,但其代码任务表现仍存争议。

OpenAI 最新前沿模型 Sol 已获准面向公众广泛发布,但外界对其获准过程的透明度提出质疑——包括政府如何评估安全性、谁参与测试、测试标准是什么,目前都缺乏明确公开信息。这一局面引发了业界对“权力由谁掌握”的深层担忧。

巴黎 AI 语音公司 Gradium 宣布完成总额 1 亿美元的种子轮融资,新投资者 Nvidia 加入。这家由法国 AI 实验室 Kyutai 分拆而来的公司,正试图在 AI 语音实时对话领域打开局面,并获得雷诺等大客户。

OpenAI 最新旗舰模型 GPT-5.6 Sol 在综合基准测试中只比 Anthropic 的 Claude 5(代号“Fable 5”)低 1 分,但单次任务成本仅为后者的三分之一,而且其在编程代理和办公任务场景下表现突出,正在重塑高端大模型的性价比标杆。

谷歌宣布,将在其广告中心(My Ad Center)中为广告添加“如何制作”标签,明确标注广告是否使用了AI生成或编辑的内容。这是大型广告平台首次将AI广告披露从选举广告扩展到常规商业广告,直接回应消费者对合成内容真实性日益增长的担忧。

《纽约时报》等原告指控 OpenAI 在版权诉讼中隐瞒了其有能力搜索训练数据和聊天记录的关键事实,并涉嫌删除数十亿条 ChatGPT 输出内容,违反法庭证据保全令。这一指控可能动摇 OpenAI 在案中的核心抗辩理由,并影响整个 AI 版权审判的走向。

Nemotron Labs 发布了 3 Puzzle 75B A9B 模型,这是一款通过压缩混合专家(MoE)架构优化的大语言模型,能在推理时实现 2.03 倍的服务器吞吐量提升,同时保持高精度。这意味着开发者可以在更少的硬件成本下运行更强的 AI 服务。

Meta 于 2026 年 7 月 9 日正式发布 Muse Spark 1.1,一款面向自主编码任务的多模态 AI 模型,直接对标 OpenAI 和 Anthropic 的同类产品。Meta 通过低价策略(输入 $1.25/百万 token,输出 $4.25/百万 token)和强调企业级自动化能力入场,C…

谷歌宣布从2026年7月9日起,将在搜索、Discover和YouTube广告中自动标注“由AI创建或编辑”标签。这项举措旨在提升广告透明度,让用户能快速识别AI生成的营销内容。