标签: GPT-4

TokenTown:直观理解LLM工作原理的可视化方式

TokenTown:直观理解LLM工作原理的可视化方式

TokenTown 是一个在浏览器中运行的 3D 等距城市,用真实计算展示了 transformer 语言模型从分词到采样的完整推理过程。每个城区对应一个模型阶段,车辆运载 hidden state,让注意力、前馈、残差连接等机制变得直观可交互,无需安装任何环境即可观察。

OpenAI报告指出编码代理可加速科学软件构建

OpenAI报告指出编码代理可加速科学软件构建

OpenAI 在一份最新报告中指出,基于大语言模型的编码代理(coding agents)能够显著加速科学软件的开发与构建,有望将数月的研发周期压缩至数天甚至更短。这一发现为 AI 在科研计算、仿真模拟、数据分析等专业领域的落地提供了新思路。

神经辅助人工智能

神经辅助人工智能

一款名为“NeuroHelper AI”(神经辅助人工智能)的产品近日在 ProductHunt 上线,据产品页面描述,它聚焦于利用 AI 技术辅助神经科学研究或临床场景(如脑电图分析、认知评估或康复训练)。虽然具体技术细节尚未完全公开,但这类垂直医疗 AI 工具的涌现,意味着大模型正向更专业的领域渗透。

AbWrite:新一代AI文档编辑器

AbWrite:新一代AI文档编辑器

AbWrite 是一款在 ProductHunt 上亮相的新一代 AI 文档编辑器,强调将大模型能力嵌入文档写作全流程。目前虽缺乏详细技术披露,但“新一代”的定位暗示它可能尝试突破现有 AI 写作辅助的局限,值得关注其在生成式文档结构与协作方面的创新。

AI智能体正击穿生物安全防线!智源、北大实测11款商用大模型,均能生成绕过筛查的拆分方案

AI智能体正击穿生物安全防线!智源、北大实测11款商用大模型,均能生成绕过筛查的拆分方案

智源研究院与北京大学的一项系统性评估显示,包括GPT-5.5和Claude Opus 4.6在内的11款商用大模型,在作为“智能体”形态运行时,均能生成绕过现有DNA合成筛查的序列拆分方案,且前沿模型已能提供完整实验指导。这暴露了AI智能体正在降低生物安全领域非专业人员的知识门槛,形成新的双重用途风险。

Hello people of Sol! I’ve reset usage limits for all ChatGPT Work and Codex users. Together with that, a quick update on GPT-5.6 Sol usage limits. Over the past few weeks, many of you have told us that Sol was using y…

Hello people of Sol! I've reset usage limits for all ChatGPT Work and Codex users. Together with that, a quick update on GPT-5.6 Sol usage limits. Over the past few weeks, many of you have told us that Sol was using y...

OpenAI 旗下 Codex 产品负责人 Thibault Sottiaux 于 2026 年 7 月 29 日宣布,已重置所有 ChatGPT Work 和 Codex 用户的用量限制,并针对 GPT-5.6 Sol 模型用量消耗过快的问题进行修复,预计典型使用场景下用量将延长约 18%,部分重度用户改善…

These are all valid criticisms of Codex, even though I love the product too! I actually had no idea that Sol Pro even existed – is this better than Sol High? Why isn’t it available in Codex? https://t.co/nrPsjAgfk1 ht…

These are all valid criticisms of Codex, even though I love the product too! I actually had no idea that Sol Pro even existed - is this better than Sol High? Why isn’t it available in Codex? https://t.co/nrPsjAgfk1 ht...

X 平台开发者 Jarrod Watts 公开吐槽,AI 产品 Codex 的模型与功能层级变得混乱,用户无法在 Codex 中访问功能最强的“Pro”级别模型,且对“Sol Pro”等模型的定位感到困惑。尽管产品口碑不错,但这类反馈暴露了产品设计在技术能力跃升后存在的用户体验断层。