GLM 5.2 在我们的基准测试中击败了 Claude

开发者社区的一项非正式基准测试显示,GLM 5.2 在多模态代理任务中表现出色,在速度、成本和性能上均优于 Claude 和 GPT-4 等闭源模型,引发了关于开源大模型实际可用性和成本效益的讨论。

开发者社区的一项非正式基准测试显示,GLM 5.2 在多模态代理任务中表现出色,在速度、成本和性能上均优于 Claude 和 GPT-4 等闭源模型,引发了关于开源大模型实际可用性和成本效益的讨论。

智谱AI(Z.ai)发布开源模型GLM-5.2,部分研究显示其在漏洞发现和网络安全任务上接近Anthropic的Mythos水平,但通用能力仍落后于Anthropic和OpenAI。

SpaceX 在 IPO 后宣布以 600 亿美元收购 AI 编程工具 Cursor,意在获取其海量开发者数据和算力闭环,推动自家模型 Grok 进入企业级市场,同时与微软 GitHub 直接竞争。
![[推广] [aitokensflux] 主打 cx-Pro20 / cc-Max20, GPT 0.2 倍率,进群私聊机器人 /cdk 每天领 5 美元,活动到 7 月 3 日](https://www.chat-gpts.plus/wp-content/uploads/2026/06/ai_cover_3-993-768x403.jpg)
AI API 中转站 “Ai Tokens Flux” 正在通过每天发放 5 美元额度的活动,推广其 GPT 系列(0.2 倍率)和 Claude 系列 API 服务。该活动面向所有 QQ 群用户,持续至 2026 年 7 月 3 日,意图在开发者市场中获取早期用户和测试反馈。

日本AI初创公司Sakana AI发布了一款名为“Orchestration Model”(编排模型)的新模型,被社区评价为“类似神话的模型”——带有贬义,指其表现不实或夸大。目前该模型引发了对亚洲AI公司技术实力的质疑和行业讨论。

开发者 spacepacket1 在 GitHub 上开源了 e3d-pod2vid,这是一套能将分角色对话音频(如 NotebookLM 生成的播客)一键转化为带语义配图、字幕和可选 TTS 换声的 YouTube 就绪视频的 AI 管线,并集成了多平台社交发布功能。

OpenAI 于 6 月 26 日发布 GPT-5.6 系列三款模型——Sol、Terra、Luna,分别对应旗舰、中端和入门。旗舰 Sol 在编程基准 Terminal-Bench 2.1 上以 91.9% 的成绩,击败了仅占据榜首 17 天的 Anthropic Mythos 5(88.0%)。Sol 首…

6月25日,OpenAI 再次更新 ChatGPT 的默认模型 GPT-5.5 Instant,这次核心不是提升推理能力或跑分,而是强化意图理解和多轮对话粘性,让模型更“懂你”——代价是用户需要主动让渡部分上下文控制权。

中国AI公司DeepSeek宣布启动大规模招聘,计划将每个部门的规模至少扩大一倍,并公开宣称“人类现在正处于通用人工智能(AGI)的前夜”。该公司刚完成约74亿美元的外部融资,估值超500亿美元,正从研究导向转向更商业化的产品路线。
![[Claude] 用了 4 个月的 Claude 今天被 suspended](https://www.chat-gpts.plus/wp-content/uploads/2026/06/ai_cover_2-994-768x403.jpg)
一位使用 Claude 4 个月的用户,在未进行任何异常操作的情况下,突然收到 Anthropic 的封号邮件,理由是触发“支持国家/地区政策”的内部调查。这起事件暴露了 AI 服务在跨境合规执行上的模糊地带和误伤风险。