标签: ChatGPT

nashsu / llm_wiki

nashsu / llm_wiki

开发者 nashsu 在 GitHub 开源了 LLM Wiki,一款跨平台桌面应用,让大模型自动把你的文档编译成一套持续维护、互相链接的个人 Wiki,而不是每次提问都从零检索。它把 Andrej Karpathy 提出的 LLM Wiki 方法论,从抽象设计模式落成了可安装的成品工具。

Athenic AI

Athenic AI

Athenic AI 在 Product Hunt 上线,主打用自然语言对话替代传统 BI 拖拽操作,让非技术岗位也能直接查询数据、生成分析结论。这是 AI 应用层继续向企业数据分析场景渗透的一个新样本。

OpenObserve 推出 AI 可观测性

OpenObserve 推出 AI 可观测性

开源可观测性平台 OpenObserve 在 Product Hunt 上线了 AI 可观测性能力,把大模型应用的调用链路、延迟与成本纳入统一监控。这类需求正随着 AI 应用从 Demo 走向生产而快速增长。

最近恰逢秋季开学,我也连续推荐了好几门北美顶尖高校新开的 Agent 课程,一个信号越来越明显: Agent Engineering 开始大量被正式写进顶尖高校的课程体系了。 这次是 CMU 新开的 11-768《AI Agents》,看完 syllabus 后感觉内容真的很贴近现在一线在做的东西。 Tool Use、Context、Skills、Memory、Planning,往后还有 Coding Agent、GUI、Deep R…

最近恰逢秋季开学,我也连续推荐了好几门北美顶尖高校新开的 Agent 课程,一个信号越来越明显: Agent Engineering 开始大量被正式写进顶尖高校的课程体系了。 这次是 CMU 新开的 11-768《AI Agents》,看完 syllabus 后感觉内容真的很贴近现在一线在做的东西。 Tool Use、Context、Skills、Memory、Planning,往后还有 Coding Agent、GUI、Deep R…

CMU 新开了一门编号 11-768 的《AI Agents》课程,把 Tool Use、Memory、Planning、Coding Agent、SFT/RL、Sandboxing 与安全等内容正式纳入教学,作业从搭建 Agentic Harness 到 Agent Eval、RL 训练再到研究项目,课程资…

欢迎试用 DeepSeek Harness v0.1.5 版本。新版本与 DeepSeek V4.1 Flash 模型训练深度结合,模型在 DeepSeek Harness 的不同配置中都进行了专项训练和优化。 与模型训练深度结合的实验性的 Agent Teams 功能也期待尝鲜试用。 DeepSeek Harness 团队仍在开放招聘中,欢迎加入我们,一起打造 “一切皆插件” 的下一步,一起探索模型与 Harness 共同进化的 A…

欢迎试用 DeepSeek Harness v0.1.5 版本。新版本与 DeepSeek V4.1 Flash 模型训练深度结合,模型在 DeepSeek Harness 的不同配置中都进行了专项训练和优化。 与模型训练深度结合的实验性的 Agent Teams 功能也期待尝鲜试用。 DeepSeek Harness 团队仍在开放招聘中,欢迎加入我们,一起打造 “一切皆插件” 的下一步,一起探索模型与 Harness 共同进化的 A…

DeepSeek Harness 发布 v0.1.5,首次与 DeepSeek V4.1 Flash 模型在训练阶段深度绑定,并同步推出实验性的 Agent Teams 功能。这意味着 Harness 不再只是"套在模型外面的壳",而是与模型一起被训练。

羡慕哭了,杭州开始全城AI Coding补贴计划??? 9 月 10 日,智谱·杭州全城 Coding 计划启动,通过政府补贴、企业让利等方式,降低 AI 编程工具的使用成本。 由政府牵头补贴将智谱个人年卡打到 4.9 折,企业年卡打到 4.5 折。 个人优惠面向在杭工作人员和杭州高校在校生,季卡享受 5.6 折,年卡享受 4.9 折。 以 Lite 套餐为例,年卡从 1416 元降至 693.84 元,季卡从 354 元降至 198…

羡慕哭了,杭州开始全城AI Coding补贴计划??? 9 月 10 日,智谱·杭州全城 Coding 计划启动,通过政府补贴、企业让利等方式,降低 AI 编程工具的使用成本。 由政府牵头补贴将智谱个人年卡打到 4.9 折,企业年卡打到 4.5 折。 个人优惠面向在杭工作人员和杭州高校在校生,季卡享受 5.6 折,年卡享受 4.9 折。 以 Lite 套餐为例,年卡从 1416 元降至 693.84 元,季卡从 354 元降至 198…

杭州联合智谱推出全城 AI Coding 补贴,个人年卡最低打到 4.9 折,企业团队套餐最高补到 4.5 折、单家上限 100 万元。这是地方政策首次以补贴形式降低 AI 编程工具的采购门槛,值得关注的是它把“算力补贴”的思路延伸到了 AI 应用层。

在看了下DV4.1 Flash论文里的结构图然后和大佬们讨论之后,我觉得这次真正值得关注的,不是参数也不是跑分,而是DeepSeek又开始改Transformer本身了。 这次至少有三个很大的变化。 第一,又走回了Encoder + Decoder。 V4.1 Flash 上20层Causal Encoder + 20层Decoder。 当然,这不是回到传统 BERT/T5 那套,而是一个新的非对称结构。 Encoder负责读取、理解…

在看了下DV4.1 Flash论文里的结构图然后和大佬们讨论之后,我觉得这次真正值得关注的,不是参数也不是跑分,而是DeepSeek又开始改Transformer本身了。 这次至少有三个很大的变化。 第一,又走回了Encoder + Decoder。 V4.1 Flash 上20层Causal Encoder + 20层Decoder。 当然,这不是回到传统 BERT/T5 那套,而是一个新的非对称结构。 Encoder负责读取、理解…

据 @MaxForAI 对 DV4.1 Flash 论文结构图的分析,DeepSeek 这次的看点不在参数和跑分,而是重新改动了 Transformer 结构:回归非对称 Encoder + Decoder、升级 CSA2 跨层复用 Attention、并让 Engram 条件记忆回归。