标签: API

兄弟们最近这类AI地铁换装视频非常的火爆,随随便便大几十w的浏览。但在猫哥这里轻松复刻,用GPT 6 Astra加持优化后的反推skill,一次性直接出,用的还是MinMax H3 图生视频模式,效果也相当能打 。没办法猫哥穷鬼一个,用不起Seedance2.5。 详细提示词👇 https://t.co/UwhmBcWWD4

兄弟们最近这类AI地铁换装视频非常的火爆,随随便便大几十w的浏览。但在猫哥这里轻松复刻,用GPT 6 Astra加持优化后的反推skill,一次性直接出,用的还是MinMax H3 图生视频模式,效果也相当能打 。没办法猫哥穷鬼一个,用不起Seedance2.5。 详细提示词👇 https://t.co/UwhmBcWWD4

AI创作者“知识猫”推出一套针对MiniMax H3视频模型的反推提示词模板,用GPT辅助解析参考视频,把近期火爆的“地铁换装”类短视频生成门槛大幅降低,单条内容在X平台获近20万次浏览。

最近看到一个挺有意思的 TTS 项目:sanoTTS。 它的思路很直接:把 TTS 做到足够小。 最小的 heart-nano 只有 294K 参数,模型权重 337KB,最大的也就 2.27M 参数。甚至可以直接跑在大约 $3 的 ESP32-S3 上,不需要云端,也不需要 NPU。 而且浏览器里也能直接跑,WebAssembly 全部在本地完成,不需要把文本上传服务器。 目前有 11 个声音、6 种语言,Python、NPM、Ar…

最近看到一个挺有意思的 TTS 项目:sanoTTS。 它的思路很直接:把 TTS 做到足够小。 最小的 heart-nano 只有 294K 参数,模型权重 337KB,最大的也就 2.27M 参数。甚至可以直接跑在大约 $3 的 ESP32-S3 上,不需要云端,也不需要 NPU。 而且浏览器里也能直接跑,WebAssembly 全部在本地完成,不需要把文本上传服务器。 目前有 11 个声音、6 种语言,Python、NPM、Ar…

开源项目 sanoTTS 展示了把语音合成模型压缩到极致的能力——最小权重仅 337KB,能在约 3 美元的 ESP32-S3 芯片或浏览器本地运行,无需联网或云端算力。它让“设备自己开口说话”从概念变成了可动手尝试的开源方案。

Anyone that works in AI is working the hardest they’ve ever worked in their lives. On the surface it’s somewhat ironic (AI should give us back time!), but the reality is that it’s the most fun, fascinating and empower…

Anyone that works in AI is working the hardest they've ever worked in their lives. On the surface it's somewhat ironic (AI should give us back time!), but the reality is that it's the most fun, fascinating and empower...

Vercel 创始人 Guillermo Rauch 在社交平台 X 上直言,AI 从业者正经历职业生涯中最辛苦的阶段,并称当下为“智能革命”。这一看似与“AI 解放时间”矛盾的观察,揭示了行业高速竞争下的真实工作状态。