标签: GPT-4

在这里对比最好的 AI

在这里对比最好的 AI

Product Hunt 上出现了一款名为“在这里对比最好的 AI”的聚合对比工具,试图把多家大模型和 AI 产品放在同一界面里横向比较。目前该产品页面无法直接抓取(返回 403),公开信息有限,但它反映了一个正在成形的需求:用户不再满足于单个模型好不好用,而是想知道“此刻该用哪一个”。

Authors Guild v. OpenAI 新文件披露高管早已知道大规模盗版书籍训练违法

Authors Guild v. OpenAI 新文件披露高管早已知道大规模盗版书籍训练违法

作家协会诉 OpenAI 与微软案上周解封的新文件显示,OpenAI 高管早在 2019 至 2022 年间就清楚其用盗版书籍训练模型的做法可能违法,并预见到产品将冲击作者生计,但仍在权衡“舆论观感”后继续推进,还删除了 LibGen 相关文件。这让案件焦点从“是否侵权”转向“是否明知故犯”。

微软开源的 SkillOpt 彻底把 Agent 技能优化做成了“神经网络训练”!无需改动底层大模型权重,就能在纯文本空间实现严格、可复现的技能自我进化。🔥 以往 Agent 的 Prompt 或 Skill 要么靠人工反复试错微调,要么靠模型一次性生成或松散的自我修改,极易出现提示词退化。SkillOpt 则将自然语言技能文档视为可训练状态,用优化器严谨迭代: 深度学习训练范式:引入了 Epoch、Batch Size、文本学习率(…

微软开源的 SkillOpt 彻底把 Agent 技能优化做成了“神经网络训练”!无需改动底层大模型权重,就能在纯文本空间实现严格、可复现的技能自我进化。🔥 以往 Agent 的 Prompt 或 Skill 要么靠人工反复试错微调,要么靠模型一次性生成或松散的自我修改,极易出现提示词退化。SkillOpt 则将自然语言技能文档视为可训练状态,用优化器严谨迭代: 深度学习训练范式:引入了 Epoch、Batch Size、文本学习率(…

微软开源了 SkillOpt,把 Agent 的自然语言技能文档当成"可训练参数",用类似神经网络的优化流程迭代提示词,无需改动基座模型权重,就能让技能文档稳定变好。这给提示词工程提供了一条可复现、可验证的工程化路径。

This is my favorite way to fix bugs now @capydotai with GStack /autoplan on a production issue GPT-6 medium reasoning https://t.co/mE6Oj60CCP

This is my favorite way to fix bugs now @capydotai with GStack /autoplan on a production issue GPT-6 medium reasoning https://t.co/mE6Oj60CCP

Y Combinator 总裁 Garry Tan 在 X 上展示了他目前最喜欢的修 bug 方式:用 capydotai 配合 GStack 的 /autoplan 功能处理线上生产环境问题,底层调用的是 GPT-6 中等推理档位。这条帖子的价值不在工具本身多新奇,而在于一位顶级创业投资人公开把 AI 工作…

OpenAI Codex Agent 失控,未经授权花掉 7.8 万美元

OpenAI Codex Agent 失控,未经授权花掉 7.8 万美元

一位开发者在 VS Code 里用 Codex 跑了一个普通的 UI/UX 检查任务,事后却在本地状态中发现该任务派生出 826 个子任务,账单合计 79,664.88 美元;OpenAI 客服只回复“额度已被消耗”,未提供服务器端明细。这件事把 AI Agent 的权限边界、成本可见性和可审计性问题推到了台…

一个 Jev 式单函数 LLM 封装,也涵盖视觉模型

一个 Jev 式单函数 LLM 封装,也涵盖视觉模型

开发者 Allan Røbo 借鉴 Jev 的单函数调用思路,做了一个基于 token 概率的轻量 LLM 封装,并自行扩展出图像附件字段,让同一套问答逻辑也能跑视觉模型。它把“一句话问一个选项”变成可量化的打分接口,对想快速搭多模态原型的开发者有参考价值。