Eval bug: Gemma4 E4B crashes with –flash-attn on

用户在 llama.cpp 的 llama-server 、 llama-cli 中加载 Gemma 4 E4B GGUF 模型(包含 MTP draft model),同时启用了 --flash-attn on (Flash Attention),并通常带有 --spec-type draft-m

用户在 llama.cpp 的 llama-server 、 llama-cli 中加载 Gemma 4 E4B GGUF 模型(包含 MTP draft model),同时启用了 --flash-attn on (Flash Attention),并通常带有 --spec-type draft-m
![Misc. bug: log says `http://::1:8080` instead of `http://[::1]:8080`](https://www.chat-gpts.plus/wp-content/uploads/2026/06/25135-cded6097-768x403.jpg)
用户在 Windows 系统上运行 llama.cpp 的 llama-server 命令,并使用 --host ::1 参数指定 IPv6 监听地址。

因股价年内暴涨超400%而停牌核查的昀冢科技,在确认无应披露未披露重大事项后,将于7月1日复牌。同时,公司主动澄清其MLCC产品未用于AI服务器,且2025年亏损1.9亿元,资产负债率高达87.35%,给市场炒作情绪浇了一盆冷水。

根据《纽约时报》调查,87%的美国竞选策略师已日常使用AI,从选民分析到内容生成全面嵌入竞选流程;与此同时,欧盟通过《政治广告透明度条例》和《AI法案》对AI在竞选中的使用施加严格限制,形成鲜明对比。

以隐私保护著称的Proton公司于6月30日发布了AI聊天机器人Lumo的2.0版本,新增图像识别、图像生成与持久记忆功能,响应速度提升76%,在不牺牲隐私的前提下对标主流AI助手。

Meta通过承包商Covalen秘密开展“Cannes”项目,让数百名员工假扮未成年人向ChatGPT、Gemini和Character.AI发送涉及自杀、自残、毒品等敏感提示词,并记录聊天机器人的回应。该测试至少持续到2026年4月,而被测试的公司对此毫不知情。

Hugging Face 与 EvalEval 联盟将各自的评估标准互通,允许用户在模型页面直接查看并交叉引用来自不同来源的评估结果,解决了 AI 模型得分分散且难以横向对比的长期问题。

DeepSeek V4 正式版定档 7 月中旬,并宣布高峰时段 API 价格翻倍,同时韩国计划投入 800 万亿韩元建设半导体集群,苹果 2027 年产品线也已曝光,涉及 iPhone 19 Pro 系列和折叠设备。AI 模型的商业化节奏与芯片供应链的长期布局正在同步加速。

韩国总统李在明于6月29日公布了一项总额超千万亿韩元的产业投资计划,重点投向半导体和AI数据中心。此举规模空前,旨在巩固韩国在全球AI算力与存储芯片领域的竞争地位。

谷歌于 6 月 30 日凌晨宣布,面向所有符合条件的美国用户,开放 Gemini 的个性化 AI 图像生成功能。此前该功能仅限付费订阅用户使用,此次扩大意味着谷歌正在加速将深度个性化能力下放至免费层级,以扩大用户基数和生态覆盖面。