Ask HN: 当前的设备端大型语言模型(LLM)毫无用处吗?

一位用户在测试名为 lfm2.5 的小型本地模型时,发现模型把“hey”误读为“heat”,并且在整个推理过程中持续这个错误,导致对话完全偏离。这一事件引发了对当前设备端(本地)大模型实用性的广泛质疑——如果连三个字母的单词都无法正确识别,这些模型是否真的值得部署和依赖。

一位用户在测试名为 lfm2.5 的小型本地模型时,发现模型把“hey”误读为“heat”,并且在整个推理过程中持续这个错误,导致对话完全偏离。这一事件引发了对当前设备端(本地)大模型实用性的广泛质疑——如果连三个字母的单词都无法正确识别,这些模型是否真的值得部署和依赖。

7月11日,电子科技大学牵头成立OpenLET成都工作组,这是国内首个国家级具身智能开源数据社群在西南地区的重要布局。工作组将联合川渝地区40余所高校及科研机构,共享真机数据并开源垂直数据集,旨在大幅降低具身智能技术的研发门槛,推动人形机器人从实验室走向规模化应用。

OpenAI 代号为 GPT-5.6 Sol Ultra 的新模型,在人类精心设计的提示词和 64 个子智能体并行推理的帮助下,约一小时内生成了图论中“圈双覆盖猜想”的完整证明。该猜想自 1970 年代提出以来未被完全攻克,数学家认可其证明巧妙,但也批评 AI 未引用前人关键成果。

剑桥大学一项基于对27名前成员访谈的研究发现,尼日利亚极端组织博科圣地及其分支ISWAP已系统性地使用ChatGPT、Claude、Gemini、Grok、Meta AI、DeepSeek等主流AI聊天机器人,用于策划袭击、开发更强大的爆炸装置、维护武器并提升行动安全性。研究指出,ISIS自2023年起便为博…

用户在运行 Kohya SS 的 WD14 captioning 功能时,程序尝试从 Hugging Face 下载 selected_tags.csv 文件,但下载过程因网络超时而中断。

用户使用 Kohya SS 的 LoRA 训练功能训练 SDXL 模型时,训练日志一切正常,但生成的 safetensors 文件中缺少 TE 键值(TE keys),导致训练出的 LoRA 模型无法保留人物身份特征,面部变得千篇一律,细节丢失。该问题在 Linux、Windows 以及 Docke

Rubrik 于 6 月 9 日发布 Rubrik AI 平台,转向以代理为中心(agentic-first)的架构,让 AI 自主推理并执行用户定义的业务目标,目标是大幅缩短网络韧性任务的完成周期。

IT基础设施服务商Kyndryl与AWS宣布扩大合作,重点从实验转向部署“代理式AI”(Agentic AI),并投入联合工程和人才培训,帮助大型企业将AI从概念验证落地到核心业务系统。

曾因推票能力强、覆盖6个行业而走红的券商首席分析师赵宇阳,于近日被曝职务从“证券投资”变更为“一般证券业务”,本人也已退出多个工作群。经多方信源交叉验证,其大概率已因言论不当等问题受罚,市场对此高度关注。

表面上看,Meta 和 SpaceX 在出售“多余算力”,但 Anthropic 却在以近 12GW 的规模疯狂预订未来算力。所谓“算力过剩”,本质是局部冗余与全局紧缺并存的错配状态,能立即调用的前沿算力依然极度稀缺。