AI 创作工作间|影视制作 AI 工具与创作平台

社区话题 NewVFX官方发布 ✅ AI 创作工作间|影视制作 AI 工具与创作平台

15

标签: ,

正在查看 1 条回复
  • 作者
    帖子
    • #134632

      NewVFX
      参与者

      AIGC WORKFLOW

      AI 创作工作间

      从视觉、声音、语言与音乐进入不同的创作空间,每一个工作间都可以继续推进。

      6 WORKSPACES
      CREATE

      🎨01
      视觉创作

      文字生成高质量图像,支持写实、插画、3D、动漫等多种视觉风格。

      文生图 · 多风格 · 渲染

       

      🎙️02
      声音感知

      将音频转换为精准文本,支持多语言识别、标点恢复与流式转写。

      实时转写 · 多语言 · Whisper

       

      🔊03
      声音表达

      将文本转换为自然语音,提供音色、语速与情感控制,适用于影视配音。

      多音色 · 情感控制 · 配音

       

      PROCESS

      🎵04
      音频重构

      AI 分离人声、鼓组、贝斯与吉他,获得独立伴奏与高质量音频分轨。

      人声/伴奏 · 分轨 · 降噪

       

      🎶05
      音乐生成

      通过文字或旋律生成完整歌曲,覆盖歌词、旋律、编曲与人声创作。

      文生音乐 · 歌词 · 多曲风

       

      🧠06
      语言模型

      用于剧本创作、视觉分析、文案、代码与多轮逻辑推理的智能工作空间。

      图像识别 · 剧本 · 深度逻辑

       

      POWERED BY
      NEWVFX ENGINE
       · AI CREATIVE INFRASTRUCTURE
      CREATIVE UTILITIES

      小工具

      为影视制作、音乐创作与视觉特效工作准备的实用工具。

      TOOLS CENTER
      🗑️HTML 标准化工具
      清理和规范网页 HTML 代码。

       

      🎬SRT 转 VTT
      字幕格式转换与时间轴处理。

       

      🎥Nuke Menu 代码生成器
      生成 Nuke API 兼容菜单代码。

       

      🎹Kontakt 乐器配置工具
      快速生成与编辑 .nicnt 配置。

       

      NPS 网络穿透服务
      端口映射与远程连接服务。

       

      🔧FRP TOML 配置工具
      生成 FRP 配置与隧道参数。

       

    • #134636

      NewVFX
      参与者

      欢迎使用 NewVFX AI 一站式创作平台。本平台集成了音乐生成、图像绘制、语音合成、字幕转写、音频分离及智能对话六大核心引擎,旨在为创作者提供从灵感到成品的完整工作流支持。以下是各功能模块的详细操作指南。


      一、AI 音乐创作 (ACE-Step)

      【功能简介】
      基于 ACE-Step 引擎的专业级 AI 编曲平台。无论是从零开始的专业制作,还是快速捕捉灵感,亦或是风格化翻唱,都能在此完成。

      【三种创作模式】
      1. 标准创作模式
      适用场景:专业音乐制作、定制化背景音乐 (BGM)。
      操作方式:精细控制音乐风格、BPM(节拍每分钟)、时长、人声类型等参数,生成结构完整的歌曲。

      2. 一句话写歌模式
      适用场景:短视频配乐、快速灵感记录。
      操作方式:只需输入一句自然语言描述(例如:“一首关于夏天海边的轻快民谣”),AI 将自动推断所有音乐参数并生成曲目。

      3. Cover 翻唱模式
      适用场景:歌曲改编、风格转换、Demo 制作。
      操作方式:上传参考音频或指定曲目,AI 提取原始旋律,并使用新的音色或音乐风格重新演绎。

      【操作步骤】
      1. 进入 Hub 工作台,点击顶部导航栏的「🎵 AI 音乐创作」标签。
      2. 在子菜单中选择您需要的模式(标准/一句话/翻唱)。
      3. 根据提示填写描述词、调整参数或上传参考音频。
      4. 点击「✨ 交给 AI 编排并创作」按钮。
      5. 生成完成后,可在内置播放器中试听,支持下载 WAV 或 MP3 格式。
      6. 所有作品将自动保存至您的个人专辑库,方便后续管理。

      【智能联动】
      界面下方嵌入了「AI 作词架构师」:可以先与 AI 对话,生成符合 ACE-Step 规范的结构化歌词,随后一键填入上方编曲区,实现词曲同步创作。


      二、AI 图像生成

      【功能简介】
      集成 AI 本地化渲染引擎,通过文本提示词实时生成高质量的概念图、插画及影视分镜。支持所见即所得的参数微调。

      【核心能力】
      – 提示词生图:支持中英文 Prompt,精准还原画面想象。
      – 实时预览:调整参数时画布实时更新,无需等待即可观察效果变化。
      – 参数精调:支持步数 (Steps)、引导系数 (CFG Scale)、采样器 (Sampler)、分辨率及种子值 (Seed) 的深度控制。
      – 模型切换:内置多种风格模型(写实摄影、二次元动漫、概念艺术等),可随时切换。

      【操作步骤】
      1. 进入 Hub 工作台,点击「🎨 图像生成 (DT)」标签。
      2. 左侧面板输入正向提示词(希望出现的元素)和反向提示词(希望避免的元素)。
      3. 右侧面板调整模型、步数、CFG Scale、分辨率等参数。
      4. 点击「Generate」开始生成。
      5. 结果展示于中央画布,支持放大查看细节、下载图片或发送至联动区进行二次分析。

      【智能联动】
      界面下方嵌入了「图片写词助手」。可将生成的图片直接拖入对话框,AI 将分析画面内容,输出结构化的画面描述或激发新的歌词灵感。

      【计费说明】
      按 Token 消耗计费(包含输入提示词 Token + 视觉处理 Token),VIP 用户享受折扣。


      三、TTS 语音合成

      【功能简介】
      基于 MLX 框架的高保真文本转语音引擎。支持多情感播音、多语种混合朗读及高拟真声音克隆。

      【核心能力】
      – 标准播音:选择预设音色,生成自然流畅的朗读音频。
      – 情感控制:可独立调节语速、音调及情感倾向(如欢快、沉稳、激昂、悲伤等)。
      – 声音克隆:上传 3~10 秒参考音频,AI 即可克隆该音色,并用其朗读任意文本。
      – 多语种支持:完美支持中文、英文、日文等多语言混合朗读,发音准确。

      【操作步骤】
      1. 进入 Hub 工作台,点击「🎙️ 语音合成 (TTS)」标签。
      2. 在文本框中输入需要朗读的内容。
      3. 选择目标音色;如需克隆,请上传参考音频。
      4. 调节语速、情感强度等参数。
      5. 点击「生成语音」。
      6. 在播放器中试听效果,满意后下载音频文件。

      【智能联动】
      界面下方嵌入了「高情商回复助手」。可先将草稿文案送入 AI 进行口语化润色,使其更自然生动,再送入 TTS 生成配音。

      【计费说明】
      按 Token 消耗计费(包含输入文字 Token + 输出音频 Token),VIP 用户享受折扣。


      四、STT 语音转字幕

      专为影视后期打造的音视频转写工具。一键将音频或视频文件中的语音精准识别为带时间轴的字幕文件,兼容主流剪辑软件。

      【核心能力】
      – 多格式支持:兼容 MP3, WAV, M4A, FLAC, MP4, MOV, MKV, WebM 等常见格式。
      – 精准时间轴:自动生成 SRT/VTT 格式字幕,时间戳精确到毫秒级。
      – 多语言识别:自动检测语种,支持中英文及多语言混合内容的精准识别。
      – 长文件处理:支持超长音视频自动分段处理并无缝拼接,无时长限制。

      【操作步骤】
      1. 进入 Hub 工作台,点击「🎬 语音转字幕」标签。
      2. 将音视频文件拖拽至上传区域,或点击选择文件。
      3. 选择输出格式(SRT / VTT / TXT)及目标语言(可选自动检测)。
      4. 点击「🚀 开始 AI 转写」。
      5. 处理完成后,在线预览字幕内容与时间轴匹配情况。
      6. 点击「下载字幕」导出文件,可直接导入 Premiere、DaVinci Resolve 或 Final Cut Pro 使用。

      【智能联动】
      界面下方嵌入了「文案润色助手」。转写完成的口语文本往往较为松散,可送入 AI进行书面化润色,使其更符合出版或阅读习惯。

      【计费说明】
      综合计费:根据音频时长及 Token 消耗计算,VIP 用户享受折扣。


      五、UVR 音频轨道分离

      基于深度学习的音频源分离工具。能将混合音频精准拆分为独立的人声、伴奏及各乐器轨道,满足混音、采样及卡拉 OK 制作需求。

      【核心能力】
      – 人声/伴奏分离:将歌曲快速拆分为纯净人声轨和纯伴奏轨。
      – 多轨精细分离:支持拆分为人声、鼓组、贝斯、其他乐器四个独立轨道。
      – 无损品质:采用高精度分离模型,最大程度保留音质,减少 artifacts(伪影)。
      – 批量处理:支持队列模式,可一次上传多首歌曲依次处理。

      【操作步骤】
      1. 进入 Hub 工作台,点击「🎵 音频分离 (UVR)」标签。
      2. 上传需要分离的音频文件。
      3. 选择分离模式(人声+伴奏 / 四轨分离)及模型精度。
      4. 点击「开始分离」。
      5. 处理完成后,可分别试听各个独立轨道的效果。
      6. 勾选需要下载的轨道,点击「下载」导出 WAV 文件。

      【智能联动】
      界面下方嵌入了「AI 作词架构师」。分离出伴奏后,可让 AI 根据伴奏的风格、节奏和情感基调,为您撰写匹配的新歌词。

      【计费说明】
      综合计费:根据处理时长及 Token 消耗计算,VIP 用户享受折扣。


      六、AI 创作矩阵 (LLM Tester)

      【功能简介】
      多场景聚合 AI 对话工作台。内置多个专业预设角色,支持流式打字机输出、连续追问、图片上传分析及长上下文记忆。

      【内置预设角色】
      1. AI 音乐人 (lyricwriter) 🎵
      作用:根据主题生成符合 ACE-Step 规范的结构化歌词。
      特点:注重韵律与结构,适合音乐创作。

      2. 图片写词 (visionlyric) 📷
      作用:分析上传图片的画面内容,生成对应的歌词或文案。
      特点:视觉转化为文字,激发跨界灵感。

      3. 高情商回复 (commenthelper) 💬
      作用:将草稿润色为简短、幽默、友善的评论回复(50字内)。
      特点:社交场景专用,提升沟通亲和力。

      4. 代码解释 (codeexplainer) 💻
      作用:分步骤解释代码逻辑,指出潜在优化点和安全隐惠。
      特点:严谨、逻辑性强,适合开发者。

      【操作步骤】
      1. 进入 Hub 工作台,点击「💬 AI 创作矩阵」标签。
      2. 在顶部子 Tab 中切换不同的 AI 角色预设。
      3. 在底部输入框输入问题或提示词。
      4. 如需图片分析,点击 📷 按钮上传图片。
      5. 按 Enter 发送消息(Shift+Enter 换行)。
      6. AI 将以流式打字机效果逐字输出回复,体验更流畅。
      7. 支持在同一 Tab 内连续追问,AI 会自动记忆上下文语境。
      8. 点击回复气泡右下角的「📋 复制」按钮,一键复制内容。

      【高级用法:自定义参数】
      在后台 LLMS → Prompt 管理中,可为每个预设设置独立的 Temperature(温度)值:
      – t=”0.3″:严谨、确定性高(适合代码解释、事实查询)。
      – t=”0.7″:平衡模式(默认推荐)。
      – t=”0.9″:创意发散、随机性高(适合歌词创作、头脑风暴)。

      控制流式输出示例:
      [nvfxaitester presets=”lyricwriter” stream=”1″] ← 启用流式输出(逐字打印)
      [nvfxaitester presets=”codeexplainer” stream=”0″] ← 禁用流式输出(等待完整回复后一次性显示)

      【计费说明】
      按 Token 消耗计费(输入 Token × 单价 + 输出 Token × 单价 + 图片处理费)。最低消费保底 0.01 币,VIP 用户享受微内核折扣。


      七、单点嵌入助手 (AI Chat Shortcode)

      将上述任意一个 AI 预设以独立组件形式嵌入到页面或侧边栏中。访客无需进入 Hub 工作台,即可在当前页面直接使用 AI 服务。

      【两种显示模式】
      1. Inline(内联模式)
      短代码示例:[nvfxaichat preset=”commenthelper” mode=”inline”]
      效果:在文章段落中嵌入一个固定的聊天输入框,适合教程演示或互动环节。

      2. Bubble(气泡模式)
      短代码示例:[nvfxaichat preset=”commenthelper” mode=”bubble”]
      效果:在页面右下角悬浮一个可拖拽的聊天气泡按钮,点击后展开聊天窗口,不干扰正文阅读。

      【计费说明】
      嵌入助手与 Hub 内的 AI 创作矩阵共享同一套 Token 计费体系,费用透明统一。

正在查看 1 条回复
  • 在下方一键注册,登录后就可以回复啦。