追光
@追光
5小时, 11 分钟 前在线-
4、 🔴 错误:”The configured agent does not support embedded context”
原因:Hermes Agent 在 initialize 响应中声明的 promptCapabilities 只包含 image=True,缺少 embedded_context=True。Pulsar ACP Agent 插件在发送文件附件前会检查此能力声明。
源码依据(server.py → HermesACPAgent.initialize()):问题的核心依然在于 Hermes Agent 没有向 Pulsar 声明它支持 embeddedContext。…[查看更多]
-
Pulsar + Hermes Agent 本地 AI 开发环境搭建完全指南:从零配置到踩坑修复,一篇搞定 Pulsar 编辑器 + Hermes Agent + 本地 LLM 的完整联动方案。
Pulsar Editor <–ACP/stdio–> Hermes Agent <–OpenAI API–> LM Studio / Ollama
(JSON-RPC 2.0) (Python 3.11+) (Local LLM)组件
职责
技术栈
Pulsar
代码编辑器,Atom 的社区继承者
Electron + Node.js
Pulsar ACP Agent…[查看更多]
-
追光 在版块 NewVFX官方发布 ✅ 中回复了话题 AI 创作工作间|影视制作 AI 工具与创作平台 1周, 1天 前
三、TTS 语音合成
基于 MLX 框架的高保真文本转语音引擎。支持多情感播音、多语种混合朗读及高拟真声音克隆。【核心能力】
标准播音:选择预设音色,生成自然流畅的朗读音频。
情感控制:可独立调节语速、音调及情感倾向(如欢快、沉稳、激昂、悲伤等)。
声音克隆:上传 3~10 秒参考音频,AI 即可克隆该音色,并用其朗读任意文本。
多语种支持:完美支持中文、英文、日文等多语言混合朗读,发音准确。
【操作步骤】
1. 进入 Hub 工作台,点击「🎙️ 语音合成 (TTS)」标签。2. 在文本框中输入需要朗读的内容。
3. 选择目标音色;如需克隆,请上传参考音频。
4. 调节语速、情感强度等参数。
5. 点击「…[查看更多]
-
追光 在版块 NewVFX官方发布 ✅ 中回复了话题 AI 创作工作间|影视制作 AI 工具与创作平台 1周, 1天 前
二、AI 图像生成
集成 AI 本地化渲染引擎,通过文本提示词实时生成高质量的概念图、插画及影视分镜。支持所见即所得的参数微调。提示词生图:支持中英文 Prompt,精准还原画面想象。
实时预览:调整参数时画布实时更新,无需等待即可观察效果变化。
模型切换:内置多种风格模型(写实摄影、二次元动漫、概念艺术等),可随时切换。
【操作步骤】[查看更多]
-
AI 工具集第一阶段正式上线!
这次为大家带来了全新的 AI 工作间矩阵,涵盖视觉创作、声音感知、声音表达、音频重构、音乐生成与大语言模型等核心场景。
这只是开始,未来这些 AI 工具将深度串联,全面演进为全链路的自动化 AIGC 工作流(Workflow),打通从创意构思、本地脚本到云端渲染的闭环。
欢迎大家前往体验并多提反馈,一起探索 AI 创作的无限可能! -
最近将社区的一些主要介绍的AI,都开发成成品,可在线服务的AI,包括、定向高维度限制的大模型定向任务,音乐制作、字幕制作,文本配音,图形图形处理方面的,音乐制作已经开发到了尾声。接下来还有一堆开发任务,有问题的用户可以社区发帖,也可以通过联系我们上的微信联系我们。
-
ACE-Step CPP UI 是一个基于 ACE-Step 1.5 的本地 AI 音乐生成工具,采用纯 C++ 推理架构,无需 Python 环境即可运行。项目基于 acestep.cpp 构建,支持 GGUF 量化模型,可在本地完成 AI 音乐生成、歌词驱动创作、风格控制以及音频处理,是目前非常优秀的开源 Suno 替代方案之一。
相比传统 Python + Gr […]

-
不知道你使用了什么插件,或者做了什么操作出现类似问题,有可能是设置也有可能是插件,驱动等若干因素,Mac上从未遇到类似问题。凭感觉猜测有可能是Smart Cache(智能缓存)异常,它可能偷偷开始后台缓存。进入DaVinci Resolve
→ Preferences
→ System
→ User
→ Playback Settings
关闭:Render Cache: Smart改为none。也有可能是AI引擎运行的问题。
Project Settings
→ Camera RAW
→ AI Processing-
大佬 我重新装过系统 从新装过 软件 包括更新 驱动。用的21版本的 达芬奇 就是单纯 莫名其妙在工作过程中 没有规律的 CPU使用率突然过载 画面卡住 停止操作之后 CPU使用率下降 但是再次播放时间线也会很卡 然后必须关闭重新启动软件 才能解决 而且在操作时间线 明显感觉到 托帧 电脑硬件 所有的硬件都已经用测试软件测试过 。没问题。 BIOS 也进行了 调整。
-
而且 切换 剪辑 调色 渲染 节目也很卡 用的是M.20 然后用的是服务器 别人的配置跟我基本相同 他就没有这种问题
-
其实我直接用的就是 M4的苹果盒子 我用起来也很卡
-
我用的 M2 max做4K 包括运行大模型,同时进行都没有卡过。达芬奇21与fcp同时用加上logic同时处理声音,一次都没有卡过,还比较丝滑。不过也就做4K raw的片子同时加三维合成的时候偶尔会有点慢。
-
-
你这个情况比较难评估,早年入行时候倒是经常遇到类似情况,之后转移到Mac和 linux上就没遇到过这些情况。硬件的成分更高一些,软件很难造成卡顿。
-
好的大佬 感谢您的 解答 我现在也是想找到 什么愿意导致的 后续如果确实硬件我在想办法更换
-
-
-
-
追光 在版块 AI视觉创作 中发起了话题 Draw things AI图片视频创作工具新功能更新 1个月, 2周 前
Draw Things迎来重大升级:Ideogram 4与Krea 2加入,本地AI绘图进入新阶段
Draw Things近期正式支持两款前沿文生图模型:Ideogram 4 与 Krea 2。其中 Ideogram 4 参数量约93亿,在开源模型竞技场中排名第一;Krea 2 参数量达到120亿,综合表现同样优秀。
Ideogram 4:专为设计而生的AI绘图模型
Ideogram 4最大的特点是精准的文字生成和设计控制能力。它基于结构化 JSON 格式训练,可以通过提示词精确控制:
画面空间布局(Bounding Box)
色彩方案(Hex颜色)
文字排版(Typograph… -
追光 在版块 AI Agent与自动化 中回复了话题 【Hermes Agent】微信助手ClawBot网关配置与部署 2个月 前
Weixin Gateway 升级后连接故障修复方案
📋 问题描述
Herms 系统升级后,Weixin 网关无法连接,Gateway 启动失败。🔍 错误信息
ERROR: weixin: open policy without allow-all opt-in
– Weixin 的 `dm_policy/group_policy` 设置为 `’open’`
– 缺少必需的用户授权环境变量✅ 解决方案日志
步骤 1:检查当前 Gateway 状态
cat /Users/xbaby/.hermes/gateway_state.json
输出显示:gateway_state: “startup_failed”步骤…[查看更多]
-
追光 在版块 AI视觉创作 中回复了话题 打造你的 AI 替身:Draw Things 本地 LoRA 训练方法 2个月 前
把上面的参数设置好了就足够训练lora了,参数已经非常全了,目前没有观察到需要设置其他的参数。
-
追光 在版块 影视音乐硬件与AI工作站 中回复了话题 Mac技巧与故障处理|macOS硬盘、U盘、软件及音频问题解决 3个月, 1周 前
macOS系统中微信等软件已授权截图与录像权限,但使用时仍反复弹出授权请求。
排查过程:尝试通过Codex环境自动检测,但因底层执行器故障(无法启动shell进程),未能直接读取或修改系统授权数据库。
原因分析:典型TCC隐私授权记录卡死、应用路径/签名变更,或tccd服务缓存异常。
修复步骤(已指导用户手动执行):
1. 完全退出微信及相关截图/录屏工具。
2. 打开终端,执行重置命令:
/usr/bin/tccutil reset ScreenCapture
/usr/bin/tccutil reset Microphone
(若仅针对微信,可执行:/usr/bin/tccutil reset ScreenCapture com.tencent.xin…[查看更多] -
追光 在版块 AI Agent与自动化 中回复了话题 Github经典项目收集与使用AI Agent安装部署应用的方法 3个月, 1周 前
acestep.cpp:跨平台本地AI音乐生成引擎(GGML + C++实现)
官方仓库GitHub – ServeurpersoCom/acestep.cpp
开发语言:C++ (C++17 标准)
核心框架:GGML
技术定位:ACE-Step 1.5 推理后端 / 离线音频生成引擎
acestep.cpp 是一个基于 GGML 的跨平台本地 AI 音乐生成引擎,使用 C++17 实现 ACE-Step 1.5 推理后端,可在 CPU、CUDA、Vulkan、Metal、ROCm 等多种硬件上运行。项目支持文本生成音乐、歌词生成、音频合成与翻唱等功能,并提供完整 WebUI 与 HTTP API 服务。
用户只需输入音乐描述或歌词,…[查看更多]
-
追光 在版块 AI Agent与自动化 中发起了话题 Github经典项目收集与使用AI Agent安装部署应用的方法 3个月, 1周 前
使用 AI Agent 时,最好先把目标拆解成清晰的步骤,并提前规划任务流程,例如输入、处理、输出与验证,而不是只下达简单指令。结构化的任务规划可以减少反复修改,提高执行效率,并让模型更准确地理解需求,从而得到更稳定和可控的结果。
在使用 Agent 进行复杂任务时,很多人习惯直接输入一句简单指令,例如“帮我生成一个AI音乐项目介绍”或“写个安装教程”。这种方式虽然方便,但往往会导致结果不稳定,需要多次修改。
以acestep.cpp的文档整理为例,如果采用简单指令,Agent 可能只会输出一段泛化描述,缺少结构、重点不清晰,甚至遗漏关键功能。
而如果采用任务规划方式,效果会明显不同。可以先将任务拆解为四个步骤:
…
-
追光 在版块 AI Agent与自动化 中回复了话题 AI模型背后的“硬通货”:读懂 Token 的前世今生与计费方式 3个月, 2周 前
AI 大模型省 Token 技巧大全:9 个降低 API 成本与提升效率的方法
尽可能使用 CLI、规划任务、减少不必要的 Skill”非常切中要害,这些都是针对 Multi-Agent(多智能体,如 OpenAI Swarm 等框架)或自动化工作流的优秀优化策略。
在实际开发和调教大模型(尤其是多智能体/Swarm 架构)时,还可以从以下几个维度把 Token 压到极致:
4、善用 Prompt Caching(提示词缓存)
做法: 现代大模型(如 DeepSeek、GPT-4o)都支持缓存。在编写 System Prompt 或工具描述时,保持头部内容完全一致。
效果: 命中缓存的输入 Token 价格能打 1~2 折,能极大…
-
追光 在版块 NewVFX官方发布 ✅ 中回复了话题 《NewVFX架构说明及历程》不敢自满但无比自信 3个月, 2周 前
2026年3月-6月11日:北京、朝阳。今年,我将主要精力聚焦于AI模型在内容与具体服务场景中的深度应用,而非对NewVFX进行更多的底层开发。
在技术学习方面,我着重掌握了SD系列模型,大幅提升了图片创作与精细化编辑的能力;同时,深入探索了Step ace 1.5模型在音乐制作上的潜力,并熟练应用了TTS(文本转语音)及Whisper(语音识别)等模型,有效打通了多模态内容生成的链路。
在业务实践上,我将大量时间投入到Agent(智能体)的应用落地中,致力于通过AI Agent优化具体服务流程,提升内容产出的效率与交互体验。这一策略转变让我更贴近实际业务需求,也为未来NewVFX的智能化服务升级积累了宝贵的实践经验。
-
追光 在版块 AI Agent与自动化 中回复了话题 LLM深入大模型本地推理:参数全解析与底层显存带宽/GPU运作原理 3个月, 3周 前
对应M1至M5系列芯片的性能数据: Llama 7B 模型在不同量化精度下的性能测试数据
Apple M系列芯片 Llama 7B 性能对比表1. M1系列 (第一代Apple Silicon)
型号
GPU核心
内存带宽 (GB/s)
F16 PP (t/s)
F16 TG (t/s)
Q8_0 PP (t/s)
Q8_0 TG (t/s)
Q4_0 PP (t/s)
Q4_0 TG (t/s)
M1
8
68
–
- 查看更多
