标签: LLM

llama.cpp is slow on GPU

llama.cpp is slow on GPU

报错“llama.cpp is slow on GPU”通常发生在用户误将 -t 参数设置为 GPU 核心数而非 CPU 线程数,或未通过 --n-gpu-layers 将模型层正确卸载到 GPU。优先排查 -t 和 --n-gpu-layers 参数是否合理。

OpenJDK 针对生成式AI的临时政策

OpenJDK 针对生成式AI的临时政策

OpenJDK 社区通过一项临时性政策,禁止贡献中包含由大语言模型(LLM)生成的代码(即使是部分内容),理由是 AI 输出的不可控性可能引入安全隐患,且“提示词”正成为实质源码,接受 AI 代码如同接受未知来源的二进制。这可能是首个主流开源项目对 AI 辅助编程做出系统性限制。

Compile bug: cuda build warning

Compile bug: cuda build warning

Compile bug: cuda build warning — 该警告出现在使用 GCC 11.2 等旧版本编译器编译 llama.cpp 并启用 CUDA 后端时,可能是编译器对 std::vector::insert 主机端代码的误报。优先排查编译器版本,升级至 GCC 12+ 即可消除。