Neon 联手 Castform 训出 4B 文档搜索小模型:准确率超 GPT-5.6 Sol,成本只要百分之一

Neon 与 Castform 合作训练了一款仅 4B 参数的文档搜索模型,据称在准确率上超过 GPT-5.6 Sol,而成本只有后者的百分之一。如果这一结果可复现,说明小参数模型在垂直搜索场景中的性价比可能远超大模型。

Neon 与 Castform 合作训练了一款仅 4B 参数的文档搜索模型,据称在准确率上超过 GPT-5.6 Sol,而成本只有后者的百分之一。如果这一结果可复现,说明小参数模型在垂直搜索场景中的性价比可能远超大模型。

TechRadar 编辑尝试用 ChatGPT 完成手机上的日常任务,结果发现 ChatGPT 在秒表、闹钟这类系统功能上完全不可用,在单词游戏、观星等任务上也只部分可行。这个测试说明 AI 离取代手机 App 还很远,但真实暴露了 AI 助手的能力边界。

传统存储厂商 DDN 的预期年收入将从 AI 热潮前的 3 亿美元增长到今年年底的 10 亿美元,增长主要来自 AI 合作伙伴关系。这显示 AI 产业的投资红利正从芯片、大模型向外扩展,高性能存储成为算力基础设施中不可忽视的一环。

开源插画师David Revoy持续收到“作品是AI生成”的评论,即使他发布了延时绘画视频也无法扭转。这件事反映出AI图像生成技术普及后,人类创作者的“原创性证明”正变得异常艰难。

Anthropic 大幅下调 Claude Fable 5 在生物领域的防护触发率,使健康、教育类问题的“降级回答”减少约 85%,但在病毒学、毒理学等高风险方向仍保持严格回退机制。

字节跳动正讨论训练参数超过5万亿的大模型,规模超过阿里Qwen 3.8-Max和月之暗面K3,同时张一鸣在内部明确禁止蒸馏开源模型,要求团队接受短期损失、坚持长期自研。

OpenAI 宣布取消 ChatGPT 的文本聊天限制,并推出 GPT-5.6 系列模型 Luna 与 Sol。对普通用户来说,免费和 Go 用户将获得默认模型升级与更高推理模式;对行业来说,AI 助手竞争正从“能用”转向“高频、可靠、配额合理”。

斯坦福大学科学家利用类似 ChatGPT 的“基因组语言模型”,设计出首批 AI 生成的噬菌体病毒,并在实验中成功杀死了耐药性大肠杆菌。这既是合成生物学的里程碑,也为生物安全治理提出了新挑战。

专注AI代理业务运营基础设施的初创公司Naïve完成2850万美元A轮融资,由Nexus领投,累计融资3200万美元。资本正在押注AI代理从“能对话”走向“能干活”的底层工具层。

一篇关于“用 AI 飞行教练学 FPV 无人机”的帖子在 Hacker News 引发讨论,资深玩家普遍认为学习飞行不需要 AI:今天的设备足够易用,真正重要的是动手练习、理解发射机/接收机与动力系统原理。这场争论本身折射出 AI 工具在低延迟物理操控场景下的边界问题。