#NIM

MiniMax H3 视频模型开源部署指南:含越狱编码器与提示词模板
MiniMax H3 视频生成模型正式开源,这是一个全模态视频生成系统,支持文字、图片、视频、音频多模态输入,输出最高 2K 分辨率、最长 15 秒、24FPS 的视频,音频是原生 32kHz 立体声。玩法包括文生视频、图生视频、视频生视频…
阿里低调上线 HappyShrimp 音乐模型:对比 Suno 和 MiniMax,5 美元/月 150 首
阿里近期低调发布了一款新的音乐模型——HappyShrimp(快乐虾米)。与此前高调宣传的视频模型「欢乐马」不同,这款音乐模型的上线几乎没有任何造势,官网链接甚至在搜索时都会绕路。 直达地址:happyshrimp.…
WorkBuddy + SRT 白板动画 Skill:零门槛制作手绘风格解说视频
手绘视频曾经需要专业美术功底,现在有人将其做成了 Skill,让 AI 自动完成绘图效果。本文分享从零开始用 AI 创作手绘视频的完整流程,涵盖文案生成、配音、SRT 字幕转换和视频合成。 步骤一:Skill 下载与安装 这个 Skill…
MiniMax H3 vs Seedance 横测:7 大视频生成场景对比评测
这个月视频模型集中爆发:MiniMax H3 开源、字节 Seedance 2.0 升级到 2.5、阿里 Wan3.0 发布。本文主要对比 H3 和 Seedance 2.0 fast,从成本和 7 种经典场景的表现进行评测。 评论区中…
MiniMax 开源 MV 生成 Skill:用歌词和音乐自动生成分镜脚本
MiniMax 开源了一个视频提示词 Skill,能够根据歌曲音频和 LRC 歌词文件,自动生成 MV 分镜脚本提示词。如果接入了视频生成模型,还可以直接把视频制作出来。这个 Skill 已上传到魔搭社区,点击访问。 核心功能:AI MV…
MiniMax-H3-Turbo-Lora:8 步推理加速视频生成,质量不输原生 20 步
MiniMax-H3 是一个通用的全模态生成系统,支持文本、图像、视频和音频多种输入组合,可以生成分辨率高达 2K、持续时间长达 15 秒的具有原生立体声音频的视频。 之前介绍了 MiniMax-H3 的特点和实测效果,当时生成的视频跑了 …
MiniMax-H3 视频提示词写作教程:T2VA/I2VA/FL2VA/L2VA 四种任务全解析
你兴冲冲打开 MiniMax-H3,输入「一个女孩在雨中奔跑,画面唯美」,点了生成。 等了半分钟,视频出来了。镜头乱晃,女孩的脸走形,没有脚步声,没有雨声,背景音乐像从电梯里偷录的。 你关掉页面,心想:就这? 但问题大概率不在模型,在你的提…
MiniMax H3 本地部署教程:RTX 3060 即可运行,0 成本制作 AI 漫剧
MiniMax H3 现已上线。作为 33B 参数的开源全模态视频模型,支持最高 2K、24fps、15 秒视频输出,还可原生同步生成立体声音频,依托 Apache2.0 开源协议,RTX4090 这类消费级显卡就能本地部署,调用成本仅为同…
MiniMax H3 开源:全模态视频生成模型,支持 2K/15 秒/立体声
MiniMax 正式开源了新一代通用视频模型 H3。这是一个全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。得益于以任务泛化为导向的系统设计,H3 …
MiniMax H3视频模型上线:开源路线、多模态输入、0.23元/秒对标Seedance
MiniMax 近日正式上线 H3 视频生成模型,带来了一项关键升级:支持"全能参考"模式。与此前的首尾帧生成方式不同,H3 允许用户直接输入人物形象、场景素材、音频片段等多模态内容,模型自动理解并生成连贯视频。这种工作流的改变,大幅降低了…