Show HN:Nightcrawler – 在智能手机上运行的本地 AI 渗透测试代理

一名开发者把 1.2B 参数的大模型跑在 OnePlus 8 手机上,做成了一个能自动选择目标、执行命令、生成报告的本地 AI 渗透测试代理,全程不依赖云端 API。真正值得关注的不是攻击能力,而是“小模型 + 端侧硬件 + 复杂工作流”这套组合在安全测试中的实际可行性。

一名开发者把 1.2B 参数的大模型跑在 OnePlus 8 手机上,做成了一个能自动选择目标、执行命令、生成报告的本地 AI 渗透测试代理,全程不依赖云端 API。真正值得关注的不是攻击能力,而是“小模型 + 端侧硬件 + 复杂工作流”这套组合在安全测试中的实际可行性。

由前 Salesforce 高管创立的 June 公司,试图用 AI 来简化 AI 在企业里的部署过程,并获得了 Marc Benioff 旗下 Time Ventures 领投的 2000 万美元融资。它瞄准的是大企业“买了模型却用不起来”的真实痛点,值得关注。

月之暗面否认了“最早本月提交港股IPO申请”的传闻,但其刚完成超35亿美元F轮融资、估值达350亿美元,且已于7月完成股份制改造,资本节奏依然受到市场高度关注。

OpenAI新模型Astra在数学领域表现亮眼,但知名学者Gary Marcus发文提醒:用单一学科成功推导通用能力强弱,是典型的“合成谬误”。这件事之所以值得关注,是因为它关系到整个行业如何正确评估大模型的真实能力。

DeepSeek 于 2026 年 8 月 3 日正式发布 V4-Flash 稳定版,并同步上线国家超算互联网,提供 API 调用和模型文件下载。这款新模型在多项基准测试中已接近当前最强闭源模型,同时大幅降低了开发者和企业用户的接入门槛。

阿里巴巴发布 Qwen3.8-Max,一个总参数 2.4 万亿、单次查询激活 950 亿参数的开放权重大模型,目标不是回答单轮问题,而是连续数天自主完成复杂任务。模型权重预计下周公开,这可能是国内大模型在“自主智能体”方向最激进的一次开源动作。

腾讯CodeBuddy产品线全面接入DeepSeek-V4-Flash正式版,新模型在代码生成与智能体任务执行上较上一代明显增强,开发者已可通过WorkBuddy、CodeBuddy IDE等产品直接体验。

开发者尝试用 AI 把遗留 COBOL 程序迁移到 Java,结果发现 AI 连旧系统里的错误也一并“翻译”了过来。这个案例再次说明:AI 代码转换和真正意义上的系统现代化之间,还隔着巨大的差距。

DeepSeek 于 8 月 3 日推出 V4 Flash API 公测版,主打智能体(agent)能力大幅提升;消息公布后,竞品智谱股价盘中一度跌超 13%,国产大模型的 agent 能力竞赛正式进入白热化阶段。

金融 AI 项目 MicroWorld 把市场参与者、信息差和策略博弈直接放进世界模型,用分层多智能体和均值场博弈求解均衡价格。它的意义在于让 Agent 从“调用工具”走向“建模环境与其他 Agent”,但目前仍以合成演示和事后回放为主,实时有效性尚未被真实数据验证。