#部署

Claude Code 和 Codex 作为 DeepSeek Harness 子 Agent 实战:几分钟上手部署教程
DeepSeek Harness 终于开源啦,昨天早上的 DeepSeek V4 pro 发布说实话,确实让很多人失望,价格...能力 但没关系,DeepSeek 的 flash 依旧抗打,最重要的还是DeepSeek Harness开源了…
AirLLM:4GB 显存跑 70B 大模型的逐层加载推理方案
之前通过 Ollama、SGLang 在本地部署过大模型的朋友都知道,受限于显卡显存,基本上只能部署小参数且量化后的模型。 这些模型在本地跑基本是残血状态,拿来玩玩还可以,但效果往往差强人意。 最近在 GitHub 上发现一个 3 万 St…
NAS 本地部署 llama.cpp 教程:Vulkan 核显加速,流畅运行 Qwen3.5 模型
llama.cpp 是一款纯 C/C++ 开发的开源大模型离线推理引擎,所有 AI 计算都在本地完成。支持 Linux、Windows、macOS 及多种 GPU 后端(CUDA、HIP、SYCL、Vulkan、WebGPU),提供 1.5…
MiniMax H3 本地部署教程:RTX 3060 即可运行,0 成本制作 AI 漫剧
MiniMax H3 现已上线。作为 33B 参数的开源全模态视频模型,支持最高 2K、24fps、15 秒视频输出,还可原生同步生成立体声音频,依托 Apache2.0 开源协议,RTX4090 这类消费级显卡就能本地部署,调用成本仅为同…
Modal 每月免费 30 美元:轻松部署 Kimi K3 等开源模型
Kimi K3 的完整模型权重正式开源后,多家云服务商开始陆续提供支持。今天介绍一个可以免费使用 K3 等开源模型的平台——Modal。其 Starter 套餐每月免费提供 30 美元的计算额度,支持多种国产开源模型…
Openship:6.7k Star 的开源自托管部署平台,桌面 CLI 双模式替代 Heroku
开源自托管部署平台 Openship(GitHub 6.7k Stars,Apache 2.0 协议)把从代码提交到应用上线的所有脏活累活打包成一个工具——装 Nginx、配 SSL、搞数据库、写 Dockerfil…
Light OCR:跑在本地的轻量 OCR 引擎,Node.js + C++ 原生支持
Light OCR 是一个运行在本地的 OCR 工具,面向 Node.js 和 C++ 开发者。不需要联网,安装后即可直接识别图片中的文字,返回识别内容、置信度和位置坐标。 核心特性 本地处理:图片和 OCR 结果始终留在本机,数据不外…
SmartTable:开源私有化多维表格,本地离线+团队协作双模式
做项目管理、客户台账、任务追踪时,不少人嫌弃飞书/Airtable云端数据不安全,私有化商业工具又价格高昂;Excel做不了关联数据,自建数据库门槛太高。今天分享一款全栈开源多维表格SmartTable,对标飞书多维表格,支持本地离线、私有…
ChatGPT Sites体验:用自然语言描述网站,一句话完成部署上线
ChatGPT 最近上线了一个叫 Sites 的功能——你用自然语言描述一个网站,它帮你写出来,然后直接帮你托管上线,给你一个能访问的 URL。 不是生成代码让你自己部署,是写完直接上线。这不就是"vibe codi…
本地离线语音方案:SenseVoiceSmall + MeloTTS 组合实战指南
本地离线语音方案一直是开发者的痛点。云端语音服务虽然方便,但在电梯、地下车库、飞机上等无网场景完全失效。本文对比并推荐了"SenseVoiceSmall(语音识别)+ MeloTTS(语音合成)"组合,两个模型加起来不到 500MB,在普通…