标签: LLM

智能免费,然后呢?–Data Systems for, of, and by Agents

智能免费,然后呢?--Data Systems for, of, and by Agents

UC Berkeley 的 BAIR 团队发文指出,AI 推理成本正以每年中位数 50 倍的速度下降,GPT-4 级模型推理成本从 2023 年初的每百万 token 约 30 美元降至现在不足 1 美元,近乎免费的智能即将到来。这将颠覆数据系统的设计逻辑,催生出为智能体(Agent)服务、由智能体运行、并让…

MadsLorentzen / ai-job-search

MadsLorentzen / ai-job-search

开发者 MadsLorentzen 在 GitHub 上开源了一个基于 Claude Code 的 AI 求职框架,能自动评估职位匹配度、定制简历和求职信,并模拟面试准备,是 AI Agent 在垂直招聘场景的一次完整产品化尝试。

Misc. bug: llama-server silently ignores -md (speculative decoding never engages) when the unified KV cache is active

Misc. bug: llama-server silently ignores -md (speculative decoding never engages) when the unified KV cache is active

用户在 llama-server 中运行推测解码时,通过 -md 参数加载草稿模型,并在启动日志中观察到 kv_unified = 'true' 。尽管草稿模型已加载到内存,但推测解码从未启用:生成阶段无草稿初始化日志、无接受统计、速度与无草稿基线相同。当前确认的最可能原因与 --spec-type