苏米的课上线啦,5大精品课程,从零开始学习AI开发和AI提效!
耗时两个月终于把苏米的课 - AI 课程文档给上线了!
课程地址:ke.xmsumi.com
搭起来其实挺快的,主要时间都在整理课程内容上面,特别耗时间。
初心
大家好,我是苏米。
作为一个产品经理,这两年我一直在疯狂体验各种 AI 工…
MiniMax-H3-Turbo-Lora:8 步推理加速视频生成,质量不输原生 20 步
MiniMax-H3 是一个通用的全模态生成系统,支持文本、图像、视频和音频多种输入组合,可以生成分辨率高达 2K、持续时间长达 15 秒的具有原生立体声音频的视频。
之前介绍了 MiniMax-H3 的特点和实测效果,当时生成的视频跑了 …
Prime Agent:会自我沉淀经验的开源 AI 代理架构,9.2k Stars
现在的 AI 编程助手有个老毛病:干着干着就「失忆」。上下文窗口一满,前面聊的全忘;终端一关,它立刻下班;任务一长,还容易跑偏。
Prime Agent就是冲着这些痛点来的。它是 Prime Intellect 开源的编码与研究代理(9.2…
阿里 CosyVoice Studio 实测:一站式 AI 语音平台,能听能说能聊
8 月初,阿里接连发布多个重磅产品。
千问办公开启公测,对标 WorkBuddy;Qwen3.8-Max 正式上线,总参数量 2.4 万亿;视频生成模型 Wan3.0 开启公测,单次可生成 30 秒视频。
不过最值得关注的是阿里新上线的 C…
AirLLM:4GB 显存跑 70B 大模型的逐层加载推理方案
之前通过 Ollama、SGLang 在本地部署过大模型的朋友都知道,受限于显卡显存,基本上只能部署小参数且量化后的模型。
这些模型在本地跑基本是残血状态,拿来玩玩还可以,但效果往往差强人意。
最近在 GitHub 上发现一个 3 万 St…
MiniMax-H3 视频提示词写作教程:T2VA/I2VA/FL2VA/L2VA 四种任务全解析
你兴冲冲打开 MiniMax-H3,输入「一个女孩在雨中奔跑,画面唯美」,点了生成。
等了半分钟,视频出来了。镜头乱晃,女孩的脸走形,没有脚步声,没有雨声,背景音乐像从电梯里偷录的。
你关掉页面,心想:就这?
但问题大概率不在模型,在你的提…
Seedance 2.5 视频生成实测:LibTV 平台 5 分钟长片直出,每秒仅 0.4 元
Seedance 2.5 官方单条视频上限只有 30 秒,但通过 LibTV 平台,可以一次性生成 4 分 46 秒的连贯视频。LibTV 是火山引擎官方合作伙伴,模型原厂直连,每条生成自带 taskid 可验证。
目前 LibTV 限时活…
Firecrawl anydoc 开源:14 种文档格式转 Markdown,比 LibreOffice 快 256 倍
做 RAG 或 Agent 开发时,处理几百个 PDF、Word、PPT 并转换为 Markdown 是个常见痛点。传统方案如 LibreOffice 速度慢(单文档 1 秒以上),Python 解析库遇到复杂表格会乱码,文件后缀名伪造还会…
Higgsfield 开源 AI 长视频制作全流程:95 分钟 AI 电影,50 万美金制作费全公开
Higgsfield 在官网发布了一部 95 分钟的 AI 生成电影,全程使用 AI 视频生成,耗费约 50 万美金。更重要的是,他们将整个制作流程全部开源,包括所有提示词和技巧。
这套开源资料对 AI 视频创作者极具参考价值,尤其…
NAS 本地部署 llama.cpp 教程:Vulkan 核显加速,流畅运行 Qwen3.5 模型
llama.cpp 是一款纯 C/C++ 开发的开源大模型离线推理引擎,所有 AI 计算都在本地完成。支持 Linux、Windows、macOS 及多种 GPU 后端(CUDA、HIP、SYCL、Vulkan、WebGPU),提供 1.5…