ValueError: ViTMAEForPreTraining does not support Flash Attention 2.0 yet.

当你在 Transformers 中用 ViTMAEForPreTraining 预训练 MAE 并尝试开启 Flash Attention 2.0 时,会直接抛出不支持的错误;优先确认 Transformers 版本是否已升级到 v4.50.0 或更高,并检查 attn_implementatio

当你在 Transformers 中用 ViTMAEForPreTraining 预训练 MAE 并尝试开启 Flash Attention 2.0 时,会直接抛出不支持的错误;优先确认 Transformers 版本是否已升级到 v4.50.0 或更高,并检查 attn_implementatio

当你在 Ollama 中通过 top_logprobs 请求超过 20 个候选 token 时,请求会在进入后端前被 Ollama 自己的请求校验拦截,报错信息为 top_logprobs is capped at 20, but nothing downstream requires that 。

GitHub 为 Copilot 代码审查补上了独立的个人设置页和企业级默认审查强度,让自动审查、草稿 PR 与新推送的触发规则不再只能“一刀切”。这意味着 AI 代码审查正从个人尝鲜走向企业可管控的常规工程环节。

ChatGPT 的语音功能迎来重大升级,开始接入邮箱、日历和 Slack 等外部插件,并运行在 OpenAI 的新模型上。这意味着语音助手正从“聊天工具”变成一个能直接操作日常应用、执行多步骤任务的助理型入口。

Anthropic 称其新设湿实验室用近 950 个 Claude 智能体、21 小时、2.1 亿 token,从 DNA 数据库中筛出一套此前未被描述的噬菌体酶系统,并将其意义与 Crispr 相提并论,但目前尚不清楚它究竟能做什么。

The Verge 记者实测 Meta 的 AI agent 产品 Muse,让它处理拖延已久的杂事。Muse 在购物下单类任务上表现积极,甚至能直接推进到信用卡支付环节,但在需要打电话沟通的任务上仍无法完全独立完成。

Anthropic 为 Claude Code 发布 v2.1.281 版本,这次更新没有新模型,而是一次以稳定性、企业网关和会话恢复为主的大修补,修掉了多个可能导致会话崩溃、重试失控和历史丢失的底层问题。

用 AI 从植物和微生物里找新药的 Enveda 完成 3.11 亿美元 E 轮融资,估值达 20 亿美元,一年内翻倍。它手里的候选药物已经推进到人体临床试验阶段,这在至今没有 FDA 批准 AI 药物的行业里属于少数派。

在 Langfuse 自托管版开启 Settings → Feature Previews → Improved Message Rendering(normalizedIoPreview)后,Formatted 视图会丢弃 OpenAI 风格 ChatML assistant 消息里 messag

当你在 Langfuse 仪表盘上查看分数分析时,如果使用的是带小数的分数(0–1 置信度、LLM-judge 评分、cost、latency 等),数值分数直方图会把值分到错误的桶里,透视表的 subtotal/grand total 行也会给出偏大或偏小的平均值。这两个错误都不会报错,只会静默返