Imbutus

新闻

21 Sept 2026, 00:36

新增图像捆绑包:Qwen-Image 2.1——一个模型生成、编辑并抠图

Qwen-Image 2.1 已上线 Media 页面,排在图像列表首位。一个 7B 模型就能完成此前 Qwen 捆绑包需要两个模型才能做的事。

  • 文本 → 图像。 原生 2K(2048×2048)输出,招牌或海报上的文字拼写清晰正确。
  • 最多 10 张参考图的编辑。 上传要修改的图片,以及需要从中借用元素的图片,在提示词里用 <image1>、<image2> 指向它们。人脸、商品和画面其余部分保持不变。
  • 原生透明 PNG。 让它去掉背景,得到的是真正的 alpha 通道——无需额外抠图步骤,发丝边缘也没有白边。

随附三个开箱即用的工作流:qwen21-text-to-image、qwen21-image-edit、qwen21-background-removal。24 GB 起可运行。

打开 Media → Qwen-Image 2.1。

19 Sept 2026, 15:00

新模型:GLM-5.3-abliterated——按 token 计费的前沿模型

GLM-5.3-abliterated 已加入模型列表:一款去除拒答的前沿级模型,上线前已在我的平台上完成全面测试。

  • 随时可用,无需 GPU。 无需启动任何东西,也无需等待模型加载——它立即作答,空闲时不产生任何费用。
  • 按 token 计费,而非按小时。 每 1M 输入 token $3.90,每 1M 缓存输入 $0.39,每 1M 输出 $6.50。
  • Abliterated。 直接回答,不说教。
  • 1M 上下文,支持推理。 仅限文本。

该模型运行在第三方服务上,对话可能会被记录。

在模型列表中选择 GLM-5.3-abliterated,或通过 API 调用 imbutus/glm-5.3-abliterated。

18 Sept 2026, 03:12

新语音 bundle:AuK——清理任何语言的录音

Media 页面新增 AuK:腾讯的 1.5B 语音模型,用自然语言指令驱动。

  • Enhance——它在这里的原因。 去除任意长度录音的噪声和混响,输出同样长度。不限语言。克隆前先把参考音频洗干净。
  • 声音设计——附赠。 用文字描述声音,无需参考音频,AuK 直接把这句话说出来。
  • 另有: 语音克隆、按每条字幕时长生成的 SRT 配音、通过转写文本换声。

所有开口说话的功能——设计、克隆、配音——仅支持英文和中文;其他语言出来的是听起来流畅的胡话。其他语言请用 Fish Audio S2 或 Chatterbox。24 GB 即可运行。

Media → AuK → auk-enhance。

17 Sept 2026, 09:00

用 root 通过 SSH 登录你自己的媒体 pod

Media 页面上每个运行中的 bundle 现在都会把它所在机器的 root 交给你。ComfyUI 登录信息下方有一行折叠的 Pod 的 SSH:一条命令可复制,一个密钥可下载。

  • 每次都是新密钥。 我为每个 pod、每次重启都生成一对新的 ed25519 密钥。从不复用,随 pod 一起销毁。
  • 是 root,不是沙盒。 安装 custom nodes,放入你自己的模型和 LoRA,查看 ComfyUI 日志,用 scp 取回生成结果。
  • 无需任何配置。 下载密钥,粘贴命令,即可登录。命令里已经包含 chmod 600。
  • 交给你的 AI 智能体。 把密钥和命令交给 Claude Code、Codex 或任何有 shell 的智能体,它就能替你对 pod 做任何事:安装节点、搭建 workflow、在日志里排查错误、取回结果。
  • 所有 bundle。 图片、视频、语音——每个媒体 bundle 都带有它。

打开 Media,启动一个 bundle,就绪后展开 Pod 的 SSH。

15 Sept 2026, 03:49

新功能:OSINT、侦察与攻击安全工作流(抢先体验)

我推出一套全新的智能体安全工作流,可直接在聊天中运行,在你租用的 Kali Linux 主机上实时执行:

  • OSINT — 针对邮箱、人物、公司、域名、电话和用户名的调查。
  • 侦察 — 主动扫描:子域名、端口、服务以及基于模板的漏洞检查,并对发现的任何 HTTP/HTTPS 服务进行完整的 Web 应用扫描 — 爬取、参数与 JWT 解码、SQL 注入与 XSS 可能性检查、密钥扫描以及 JWT 弱密钥检测。
  • Attack — 将标记的可能性转化为已确认的漏洞,附带可用的非破坏性概念验证,并生成面向客户的报告,为每个发现提供可复现的攻击。

它们协同工作 — 每次运行都会把结果存入你 Kali 主机上的共享数据库,后续工作流复用先前结果,每次运行都会保存可下载的报告。

注意:它们需要在新租用的 Kali 主机上运行——即本公告之后创建的主机。如果你已有较早的主机,请先终止它并租用一台新的,以获得完整工具集。

这是一次抢先预告:这些工作流是全新的,仍处于测试与打磨阶段。欢迎试用,并通过支持渠道反馈。

02 Sept 2026, 06:07

MiniMaxDirector 视频教程

这个节点有完整讲解了:34 分钟,按你实际会遇到的顺序,覆盖 MiniMax H3 全部有文档记载的功能。

  • 时间轴。 画面、镜头与声音各有轨道;帧指针、切分片段,以及片长为什么会对齐到 5 + 17 帧。
  • 从文件中取出实体。 人物、服装、道具、场景、风格、动作、声音 —— 每一个都成为一张带编号的卡片,可以粘贴到任意片段,并在所有镜头中保持一致。
  • 对话。 描述声音,选择说话的人、语言,以及在画内还是画外。
  • 参考。 分镜、首帧与尾帧、关键帧,以及文件保留多少 —— 包括把一张照片里的脸换到另一张照片的人身上。
  • 一个完整示例,在结尾从零搭建并生成。

观看:MiniMax Director — 完整讲解。其他配音:English、Русский。

它已经在你的 GPU 上。 启动 MiniMax H3 套件并打开 MiniMaxDirector 工作流 —— 套件会从 GitHub 加载最新版本。在自己的机器上,从 ComfyUI 注册表安装 minimax-director,或把 github.com/imbutus/ComfyUI-MiniMaxDirector 克隆到 custom_nodes/。

25 Aug 2026, 03:18

三个新模型,两个下线

LLM 页面新增了三个模型,同时下线了两个。

  • huihui-ai/Huihui-Ornith-1.5-9B-abliterated——小巧、便宜,且为代码调优。 9B,支持图像输入,262k 上下文,已去审查。它也是这里第一个同时带两个标签的模型:既属于经济型,也属于编程型,在两个分组里都能找到。
  • huihui-ai/Huihui-Ornith-1.5-35B-A3B-abliterated——更大的 Ornith。 同一家族的 35B 混合专家模型,支持图像输入,262k 上下文,已去审查。它接替 Ornith 1.0。
  • huihui-ai/Huihui-CyberStrike-OffSec-35B-abliterated——安全专精,独立成类。 35B,针对渗透测试与红队工作微调,支持图像输入,262k 上下文,已去审查。这类模型现在带 offsec 标签,不再混在通用模型里。
  • 两个模型已下线。 Qwen3.6 35B-A3B 与 Ornith 1.0 35B 不再提供:Ornith 1.5 已覆盖它们的用途,通用场景仍推荐 Qwen3.8 27B。您此前在它们上运行的会话仍保留在历史记录中。
  • 标签可以叠加。 模型不再只能有一个徽章,这正是 9B 能同时显示为经济型与编程型的原因。

打开 LLM 页面即可启动其中任意一个。

22 Aug 2026, 21:08

MiniMaxDirector 0.16.0:H3 指南要求的一切

我在八月发布的节点此后又累积了 264 次提交,0.16.0 把它们收在了一起。想法没有变 —— 你把一部片子铺在时间线上,而不是塞进一个提示词框 —— 但如今从中产出的、H3 真正读取的内容多了许多。

  • 每个人、每样东西都有一张卡片。 人物、道具、服装、场景、风格:各占一张卡片,卡上放着它出自的那张图、它的描述和它的声音。这是唯一描述文件的地方,所以片段上不必重复。
  • 声音与画面出自同一次生成。 写下台词、选好面孔,它就会按 H3 训练时的确切格式编译 —— 包括跨越剪辑点的台词,以及被片尾切断的台词。
  • 一张面孔可以移到另一个人身上。 卡片还能从视频里取动作、从录音里取音色,而这些都写在它所属的主体定义之内,不会独立漂着。
  • 片子携带的每个文件都在同一个列表里。 把文件拖到轨道上以放置到某一刻,或让它作用于整段片子。文件丢失时会自行说明,运行会被拒绝,而不是悄悄生成错误的东西。
  • 实时检查器核对指南明确写出的规则:片长、时长在 2–15 秒之外的参考视频、无法完成所要求任务的标记。
  • 节点的高度就是你打开的内容的高度,整个作品可导出为一个 JSON。

完整说明:0.16.0 发布说明。

它已经装在你的 GPU 上了。 启动 MiniMax H3 套装,打开 Docs → Media → MiniMax H3 → MiniMaxDirector 工作流。套装会从 GitHub 载入最新发布,你无需更新任何东西。

在你自己的机器上,把 github.com/imbutus/ComfyUI-MiniMaxDirector 克隆到 custom_nodes/,或在 0.16.0 通过 ComfyUI 注册表审核后安装 minimax-director。需要 ComfyUI 0.31.0 或更高版本。MIT 许可。

18 Aug 2026, 15:00

Qwen3.8 27B 已上线

LLM 页面上线了最新一代 Qwen:huihui-ai/Huihui-Qwen3.8-27B-abliterated,全精度稠密 27B,已去审查。

  • 回答更慢,但也更聪明。 默认以最大推理强度运行,因此首个 token 会明显比小模型慢。这段等待正是关键所在:它在把问题想透,而不是抢着回答。如果你要的是快速一来一回,选更小的模型更合适。
  • 能看图。 在同一段对话里附上图片直接提问,与其他内容无缝衔接。
  • 262k 上下文。 足以在一次会话中装下整个代码库或一叠文档。
  • 全精度,未丢弃任何权重。 用的就是作者发布的原始权重,因此需要更大的显卡,首次对话前约需 10 分钟。

每小时 $2.40。打开 LLM 页面即可启动。

04 Aug 2026, 15:00

MiniMaxDirector:为 H3 打造的时间线

我为 MiniMax H3 写了一个 ComfyUI 节点并开源发布:MiniMaxDirector。与其把整部片子塞进一个提示词框,不如把它铺在时间线上 —— 画面里发生什么、镜头如何运动、听到什么 —— 节点会将其编译成 H3 真正读取的那个结构化提示词。

它能为你做什么:

  • 三条轨道。 镜头、摄影机与音频,每个片段都有自己的文本和时间范围。
  • 剪辑时间点自动计算,模型会被准确告知每个镜头从何时开始。
  • 只使用合法时长。 片段会被对齐到 H3 接受的长度,生成不会因为算术问题而失败。
  • 把文件附加到片段上,它会自动成为提示词中带编号的引用,无需手动输入标记。

它已经装在你的 GPU 上了。 启动 MiniMax H3 套装,打开 Docs → Media → MiniMax H3 → MiniMaxDirector 工作流;该图已可直接运行,无需安装。

在你自己的机器上,它已发布到 ComfyUI 注册表,名称为 minimax-director:可在 ComfyUI Manager 中搜索,或执行 comfy node install minimax-director。源码与问题反馈:github.com/imbutus/ComfyUI-MiniMaxDirector。MIT 许可。

← PrevPage 1