标签: 大模型

让AI停止假装成人类的系统提示

让AI停止假装成人类的系统提示

一位开发者因无法忍受大模型过度模仿人类社交用语(如“好问题!”“让我想想”),编写了一套系统提示让AI回归“工具式”简洁输出,并将该提示开源分享,引发社区对AI交互设计方向的讨论。

Claude 5代模型的上下文工程新规则

Claude 5代模型的上下文工程新规则

围绕Claude 5代模型的讨论,揭示了一个核心矛盾:LLM本质上通过语言进行“思考”和抽象概念编码,但人类思考主要依赖非语言的、多模态的认知过程,语言只是有损的翻译。这一差异正成为模型上下文工程和交互体验设计的关键新规则。

Quote of the day by Vladimir Putin on AI: ‘Whoever becomes the leader in this sphere will become the ruler of the world’ — an outlook on geopolitical dominance

Quote of the day by Vladimir Putin on AI: 'Whoever becomes the leader in this sphere will become the ruler of the world' — an outlook on geopolitical dominance

俄罗斯总统普京在2017年Google发表Transformer架构论文后预言“谁掌握AI谁将统治世界”,如今这一判断随着俄乌冲突中自主武器实战、中美AI军备竞赛白热化而加速兑现。AI领导权已从商业竞争升格为国家战略博弈的核心变量。

成为大型LLM实验室的研究工程师

成为大型LLM实验室的研究工程师

AI 研究员 Max Mynter 用 18 个月的系统准备,从一名自学的机器学习工程师成功拿到 Mistral(欧洲顶级大模型实验室)的研究工程师 offer。他详细拆解了战略(长期技能积累与网络建设)和战术(刷题、面试技巧)的配合方法,对想进入头部 LLM 团队的开发者有直接参考价值。

成为大型LLM实验室的研究工程师

成为大型LLM实验室的研究工程师

一位求职者在Hacker News上分享自己应聘大型AI实验室研究工程师的经历,发现offer水平、面试难度与公司知名度之间几乎“无规律可循”,同一求职者获得的最高与最低薪酬报价相差可达3倍。这再次引发了行业内对AI人才市场高度随机性和幸存者偏差的讨论。

Inflect-Micro-v2: 仅用9.36M参数实现完整语音

Inflect-Micro-v2: 仅用9.36M参数实现完整语音

独立开发者 Owen Song 发布了 Inflect-Micro-v2,一个仅有 9.36M 参数的端到端文本到语音模型,可在 CPU 上以 6 倍实时速度运行,并在社区盲测中取得 66.2% 的偏好率。它证明了极低参数量也能实现可用的语音合成,为本地化、低算力部署提供了新选择。

教授期中考试,35名学生里有32人用AI写答案,错得离谱被抓包。

教授期中考试,35名学生里有32人用AI写答案,错得离谱被抓包。

美国历史教授Jason Gibson在期中考试中通过一个隐藏提示词(要求无意义使用“Madagascar”),发现35名学生中有32人直接用AI生成答案,且未做任何校对,答案荒谬到将马达加斯加与工业革命强行关联。此事两周内视频播放超千万次,暴露了当前学生群体中大规模使用AI作弊且缺乏基本审慎的现状,也再次引发…