标签: 算力

自托管AI软件工厂

自托管AI软件工厂

围绕“自托管 AI 软件工厂”的热门讨论显示,开发者正在尝试用本地 GPU 运行开源编码模型(如 Qwen)替代 Claude 等闭源前端模型,但实际体验表明本地模型在复杂任务、上下文管理和自主性上仍明显落后,大多数人选择让 Claude 主导、Qwen 处理局部任务的混合架构。

更好的被屏蔽用户管理工具

更好的被屏蔽用户管理工具

GitHub 更新了个人账户和组织的屏蔽用户管理工具,新增搜索、排序、筛选、备注和到期时间查看等功能。这次更新让社区治理从“一刀切”转向更精细化的操作,对依赖开源协作的 AI 开发者尤其重要。

GPU读取内存时会发生什么?

GPU读取内存时会发生什么?

一篇技术文章通过逆向工程,详细追踪了英伟达 RTX 4090 上一条 GPU 内存读取指令从寄存器到 DRAM 芯片的完整硬件路径。它揭示了 CUDA 开发者直觉上依赖、但英伟达从未完整公开的 L1/L2 缓存、TLB 和显存控制器协同细节,对追求极致性能的 GPU 开发者具有直接参考价值。

AI;DR,还是别做人类代理

AI;DR,还是别做人类代理

Hacker News 上围绕“AI 代理是否应该被构建为人类代理”的讨论引发关注,核心争议在于:当前 AI 代理产品在自主性和可靠性未达标前,强行复制人类工作流可能带来更大风险。

DeepSeek-v4-flash-vision-exp

DeepSeek-v4-flash-vision-exp

DeepSeek 发布了名为 deepseek-v4-flash-vision-exp 的实验性视觉模型,它能直接读取图片中的文字、图表和画面内容,并通过标准 OpenAI 兼容接口调用。这是 DeepSeek 在文本能力之外,向多模态方向迈出的实质性一步。