追光

  • 4、 🔴 错误:”The configured agent does not support embedded context”

    原因:Hermes Agent 在 initialize 响应中声明的 promptCapabilities 只包含 image=True,缺少 embedded_context=True。Pulsar ACP Agent 插件在发送文件附件前会检查此能力声明。
    源码依据(server.py → HermesACPAgent.initialize()):

    问题的核心依然在于 Hermes Agent 没有向 Pulsar 声明它支持 embeddedContext。…[查看更多]

  • Pulsar + Hermes Agent 本地 AI 开发环境搭建完全指南:从零配置到踩坑修复,一篇搞定 Pulsar 编辑器 + Hermes Agent + 本地 LLM 的完整联动方案。

    Pulsar Editor <–ACP/stdio–> Hermes Agent <–OpenAI API–> LM Studio / Ollama
    (JSON-RPC 2.0) (Python 3.11+) (Local LLM)

    组件

    职责

    技术栈

    Pulsar

    代码编辑器,Atom 的社区继承者

    Electron + Node.js

    Pulsar ACP Agent…[查看更多]

  • 三、TTS 语音合成
    基于 MLX 框架的高保真文本转语音引擎。支持多情感播音、多语种混合朗读及高拟真声音克隆。

    【核心能力】

    标准播音:选择预设音色,生成自然流畅的朗读音频。

    情感控制:可独立调节语速、音调及情感倾向(如欢快、沉稳、激昂、悲伤等)。

    声音克隆:上传 3~10 秒参考音频,AI 即可克隆该音色,并用其朗读任意文本。

    多语种支持:完美支持中文、英文、日文等多语言混合朗读,发音准确。

    【操作步骤】
    1. 进入 Hub 工作台,点击「🎙️ 语音合成 (TTS)」标签。

    2. 在文本框中输入需要朗读的内容。

    3. 选择目标音色;如需克隆,请上传参考音频。

    4. 调节语速、情感强度等参数。

    5. 点击「…[查看更多]

  • 二、AI 图像生成
    集成 AI 本地化渲染引擎,通过文本提示词实时生成高质量的概念图、插画及影视分镜。支持所见即所得的参数微调。

    提示词生图:支持中英文 Prompt,精准还原画面想象。

    实时预览:调整参数时画布实时更新,无需等待即可观察效果变化。

    模型切换:内置多种风格模型(写实摄影、二次元动漫、概念艺术等),可随时切换。

    【操作步骤】[查看更多]

  • 追光 发了新动态 1周, 6天 前

    AI 工具集第一阶段正式上线!
    这次为大家带来了全新的 AI 工作间矩阵,涵盖视觉创作、声音感知、声音表达、音频重构、音乐生成与大语言模型等核心场景。
    这只是开始,未来这些 AI 工具将深度串联,全面演进为全链路的自动化 AIGC 工作流(Workflow),打通从创意构思、本地脚本到云端渲染的闭环。
    欢迎大家前往体验并多提反馈,一起探索 AI 创作的无限可能!

  • 追光 发了新动态 1个月 前

    最近将社区的一些主要介绍的AI,都开发成成品,可在线服务的AI,包括、定向高维度限制的大模型定向任务,音乐制作、字幕制作,文本配音,图形图形处理方面的,音乐制作已经开发到了尾声。接下来还有一堆开发任务,有问题的用户可以社区发帖,也可以通过联系我们上的微信联系我们。

  • ACE-Step CPP UI 是一个基于 ACE-Step 1.5 的本地 AI 音乐生成工具,采用纯 C++ 推理架构,无需 Python 环境即可运行。项目基于 acestep.cpp 构建,支持 GGUF 量化模型,可在本地完成 AI 音乐生成、歌词驱动创作、风格控制以及音频处理,是目前非常优秀的开源 Suno 替代方案之一。

    相比传统 Python + Gr […]

  • 追光 发布了新的动态评论 1个月, 1周 前

    你这个情况比较难评估,早年入行时候倒是经常遇到类似情况,之后转移到Mac和 linux上就没遇到过这些情况。硬件的成分更高一些,软件很难造成卡顿。

    • 好的大佬 感谢您的 解答 我现在也是想找到 什么愿意导致的 后续如果确实硬件我在想办法更换

  • 追光 发布了新的动态评论 1个月, 1周 前

    我用的 M2 max做4K 包括运行大模型,同时进行都没有卡过。达芬奇21与fcp同时用加上logic同时处理声音,一次都没有卡过,还比较丝滑。不过也就做4K raw的片子同时加三维合成的时候偶尔会有点慢。

  • 追光 发布了新的动态评论 1个月, 1周 前

    不知道你使用了什么插件,或者做了什么操作出现类似问题,有可能是设置也有可能是插件,驱动等若干因素,Mac上从未遇到类似问题。凭感觉猜测有可能是Smart Cache(智能缓存)异常,它可能偷偷开始后台缓存。进入DaVinci Resolve
    → Preferences
    → System
    → User
    → Playback Settings
    关闭:Render Cache: Smart改为none。

    也有可能是AI引擎运行的问题。
    Project Settings
    → Camera RAW
    → AI Processing

    • 大佬 我重新装过系统 从新装过 软件 包括更新 驱动。用的21版本的 达芬奇 就是单纯 莫名其妙在工作过程中 没有规律的 CPU使用率突然过载 画面卡住 停止操作之后 CPU使用率下降 但是再次播放时间线也会很卡 然后必须关闭重新启动软件 才能解决 而且在操作时间线 明显感觉到 托帧 电脑硬件 所有的硬件都已经用测试软件测试过 。没问题。 BIOS 也进行了 调整。

    • 而且 切换 剪辑 调色 渲染 节目也很卡 用的是M.20 然后用的是服务器 别人的配置跟我基本相同 他就没有这种问题

      • 其实我直接用的就是 M4的苹果盒子 我用起来也很卡

        • 我用的 M2 max做4K 包括运行大模型,同时进行都没有卡过。达芬奇21与fcp同时用加上logic同时处理声音,一次都没有卡过,还比较丝滑。不过也就做4K raw的片子同时加三维合成的时候偶尔会有点慢。

      • 你这个情况比较难评估,早年入行时候倒是经常遇到类似情况,之后转移到Mac和 linux上就没遇到过这些情况。硬件的成分更高一些,软件很难造成卡顿。

        • 好的大佬 感谢您的 解答 我现在也是想找到 什么愿意导致的 后续如果确实硬件我在想办法更换

  • Draw Things迎来重大升级:Ideogram 4与Krea 2加入,本地AI绘图进入新阶段

    Draw Things近期正式支持两款前沿文生图模型:Ideogram 4 与 Krea 2。其中 Ideogram 4 参数量约93亿,在开源模型竞技场中排名第一;Krea 2 参数量达到120亿,综合表现同样优秀。

    Ideogram 4:专为设计而生的AI绘图模型

    Ideogram 4最大的特点是精准的文字生成和设计控制能力。它基于结构化 JSON 格式训练,可以通过提示词精确控制:

    画面空间布局(Bounding Box)
    色彩方案(Hex颜色)
    文字排版(Typograph…

    [查看更多]

  • 追光 发布了新的动态评论 1个月, 4周 前

    是什么系统的 Elicenser,若干系统都需要购买正版后会得到license。

  • Weixin Gateway 升级后连接故障修复方案

    📋 问题描述
    Herms 系统升级后,Weixin 网关无法连接,Gateway 启动失败。

    🔍 错误信息

    ERROR: weixin: open policy without allow-all opt-in

    – Weixin 的 `dm_policy/group_policy` 设置为 `’open’`
    – 缺少必需的用户授权环境变量

    ✅ 解决方案日志

    步骤 1:检查当前 Gateway 状态

    cat /Users/xbaby/.hermes/gateway_state.json
    输出显示:gateway_state: “startup_failed”

    步骤…[查看更多]

  • 把上面的参数设置好了就足够训练lora了,参数已经非常全了,目前没有观察到需要设置其他的参数。

  • macOS系统中微信等软件已授权截图与录像权限,但使用时仍反复弹出授权请求。

    排查过程:尝试通过Codex环境自动检测,但因底层执行器故障(无法启动shell进程),未能直接读取或修改系统授权数据库。

    原因分析:典型TCC隐私授权记录卡死、应用路径/签名变更,或tccd服务缓存异常。

    修复步骤(已指导用户手动执行):
    1. 完全退出微信及相关截图/录屏工具。
    2. 打开终端,执行重置命令:
    /usr/bin/tccutil reset ScreenCapture
    /usr/bin/tccutil reset Microphone

    (若仅针对微信,可执行:

    /usr/bin/tccutil reset ScreenCapture com.tencent.xin…[查看更多]

  • acestep.cpp:跨平台本地AI音乐生成引擎(GGML + C++实现)

    官方仓库GitHub – ServeurpersoCom/acestep.cpp

    开发语言:C++ (C++17 标准)

    核心框架:GGML

    技术定位:ACE-Step 1.5 推理后端 / 离线音频生成引擎

    acestep.cpp 是一个基于 GGML 的跨平台本地 AI 音乐生成引擎,使用 C++17 实现 ACE-Step 1.5 推理后端,可在 CPU、CUDA、Vulkan、Metal、ROCm 等多种硬件上运行。项目支持文本生成音乐、歌词生成、音频合成与翻唱等功能,并提供完整 WebUI 与 HTTP API 服务。

    用户只需输入音乐描述或歌词,…[查看更多]

    • 请教老师,在DRAW THINGS中使用FLUX-2 KIEIN 9B 8-BIT想制作图生图产品图,如何 设置,能指导一下不.谢谢。

  • 使用 AI Agent 时,最好先把目标拆解成清晰的步骤,并提前规划任务流程,例如输入、处理、输出与验证,而不是只下达简单指令。结构化的任务规划可以减少反复修改,提高执行效率,并让模型更准确地理解需求,从而得到更稳定和可控的结果。

    在使用 Agent 进行复杂任务时,很多人习惯直接输入一句简单指令,例如“帮我生成一个AI音乐项目介绍”或“写个安装教程”。这种方式虽然方便,但往往会导致结果不稳定,需要多次修改。

    以acestep.cpp的文档整理为例,如果采用简单指令,Agent 可能只会输出一段泛化描述,缺少结构、重点不清晰,甚至遗漏关键功能。

    而如果采用任务规划方式,效果会明显不同。可以先将任务拆解为四个步骤:

    …

    [查看更多]

  • AI 大模型省 Token 技巧大全:9 个降低 API 成本与提升效率的方法

    尽可能使用 CLI、规划任务、减少不必要的 Skill”非常切中要害,这些都是针对 Multi-Agent(多智能体,如 OpenAI Swarm 等框架)或自动化工作流的优秀优化策略。

    在实际开发和调教大模型(尤其是多智能体/Swarm 架构)时,还可以从以下几个维度把 Token 压到极致:

    4、善用 Prompt Caching(提示词缓存)

    做法: 现代大模型(如 DeepSeek、GPT-4o)都支持缓存。在编写 System Prompt 或工具描述时,保持头部内容完全一致。

    效果: 命中缓存的输入 Token 价格能打 1~2 折,能极大…

    [查看更多]

  • 2026年3月-6月11日:北京、朝阳。今年,我将主要精力聚焦于AI模型在内容与具体服务场景中的深度应用,而非对NewVFX进行更多的底层开发。

    在技术学习方面,我着重掌握了SD系列模型,大幅提升了图片创作与精细化编辑的能力;同时,深入探索了Step ace 1.5模型在音乐制作上的潜力,并熟练应用了TTS(文本转语音)及Whisper(语音识别)等模型,有效打通了多模态内容生成的链路。

    在业务实践上,我将大量时间投入到Agent(智能体)的应用落地中,致力于通过AI Agent优化具体服务流程,提升内容产出的效率与交互体验。这一策略转变让我更贴近实际业务需求,也为未来NewVFX的智能化服务升级积累了宝贵的实践经验。

  • 对应M1至M5系列芯片的性能数据: Llama 7B 模型在不同量化精度下的性能测试数据
    Apple M系列芯片 Llama 7B 性能对比表

    1. M1系列 (第一代Apple Silicon)

    型号

    GPU核心

    内存带宽 (GB/s)

    F16 PP (t/s)

    F16 TG (t/s)

    Q8_0 PP (t/s)

    Q8_0 TG (t/s)

    Q4_0 PP (t/s)

    Q4_0 TG (t/s)

    M1

    8

    68

    –

    [查看更多]

  • 查看更多