#AI

ChatGPT 与 Codex 办公提示词模板:6 个高频场景的完整写法
整理了 6 个高频办公场景的提示词模板,每个场景都提供 ChatGPT 版和 Codex 版。ChatGPT 适合处理临时粘贴的文字和边聊边调整的任务;Codex 适合读取本地文件、整合多个材料,并在获得授权后把结果保存成文件。 通用提示词…
智谱 GLM-5.3 开放权重:Hacker News 热帖与本地部署指南
智谱海外品牌 Z.ai 在 Hacker News 上开放了 GLM-5.3 的模型权重(open-weight),引发了海外开发者关注。 Open-weight 不同于 open-source:用户可以拿到训练好的模型文件进行本地推理、微…
一个HTML文件撑起整个3D世界:Kage 开源项目实测
一个 HTML 文件能做什么?有人用一段提示词让 AI 生成了京都山寺的 3D 世界,只用一个 HTML 文件融合 AI 生成内容与 Three.js 实时渲染。打开网页就是深蓝色的夜晚,山门、石阶、灯笼和远处的寺庙依次出现。没有按钮也没有…
MiniMax H3 视频模型开源部署指南:含越狱编码器与提示词模板
MiniMax H3 视频生成模型正式开源,这是一个全模态视频生成系统,支持文字、图片、视频、音频多模态输入,输出最高 2K 分辨率、最长 15 秒、24FPS 的视频,音频是原生 32kHz 立体声。玩法包括文生视频、图生视频、视频生视频…
腾讯Hy4 preview实测:对比GLM-5.3,谁的Agent编程能力更强?
腾讯发布了最新的 Hy4 preview 模型,总参数 770B,激活参数 49B,参数规模已与头部旗舰模型相提并论。为了测试实际能力,用同样的回合制游戏 DEMO 需求,对比了 Hy4 preview 和前几天发布的 GLM-5.3。 …
微信AI硬核技术开源:WeMM-Embedding 多模态搜索实测
最近几个月微信陆续灰度了很多 AI 功能,现在的微信已经不只是聊天工具,而是搜索 + AI + 聊天三位一体,初步具备了 Agent 的影子。微信 AI 的核心能力之一是对文本、图像、视频做了 RAG 处理,官方也开源了 WeMM-Embe…
不用视频模型也能加字幕:Doubao-Seed-Evolving + ffmpeg 实测教程
分享一个多模态模型的"邪修玩法":不用视频模型,也可以给视频加上炫酷字幕。 字幕效果完全不需要 MiniMax H3 或者 Seedance 系列模型,只需要一个多模态模型(如 doubao-seed-evolving)和 Agent 工具…
Lovart中文版上线:一键采集灵感,Skill 驱动完成整套设计
最近用 Lovart 制作了一个 Skill,只需要提供一张潮玩娃娃的设定图,就能自动生成一套海报风格的静态和动态海报。制作过程非常简单——给一张设定图,选择对应 Skill,什么都不用说,等待结果即可。 海报中的…
Claude Code 14条隐藏命令:6个月省200小时的开发技巧
今天先讲个身边的事。 前段时间一个周二凌晨两点,办公室里没剩几个人,我旁边的开发同事小王还在跟一个 Bug 死磕。本该30分钟搞定的问题,已经耗了三个小时。我起身接水路过他工位,瞟了一眼屏幕--Claude Code 聊天窗口里 147 条…
headlong:AI Agent微框架开源,自动执行任务并主动汇报结果
前几天凌晨,Laude Institute的工程师们都下班了,办公室里漆黑一片,只有服务器机房的灯在闪。 他们的AI Agent Audel在没有任何人给它发指令的情况下,自己翻回去检查了白天写的一个recall process功能。 它先…