音频 标签,匹配到约6个结果, 耗时0.0343秒
字节发布 Seed Audio 1.0 音频创作模型:支持精细时间控制,音色风格可控、长时稳定
目前,Seed Audio 1.0 已在火山方舟体验中心上线。...
2026-07-20
·
浏览109次
火山引擎发布豆包音频生成模型 1.0,支持多模态参考生成与长时音色一致性
火山引擎正式推出豆包音频生成模型 1.0,首次支持文本、音频等多模态参考生成,能端到端产出完整叙事音频。模型在长时生成中保持多角色音色高度一致,大幅减少后期工作,即将上线剪映、即梦等产品。#豆包音频模型##AI 音频生成#...
2026-06-24
·
浏览217次
阿里通义开源旗下首个音频生成模型 ThinkSound:可像“专业音效师”一样思考
ThinkSound 首次将 CoT(Chain-of-Thought,思维链)应用到音频生成领域,让 AI 学会一步步“想清楚”画面事件与声音之间的关系,从而实现高保真、强同步的空间音频生成 —— 不只是“看图配音”,而是真正“听懂画面”...
2025-07-04
·
浏览527次
谷歌搜索推出音频概览功能:AI 生成播客式总结
谷歌搜索推出音频概览功能,利用Gemini模型生成AI播客式总结,两位虚拟主持人互动讲解搜索结果。用户可调整音量和播放速度,还能进一步探索信息来源。#谷歌新功能# #AI应用#...
2025-06-15
·
浏览446次
SDS 技术首次用于音频:英伟达携手 MIT 推 Audio-SDS,参数化控制 AI 音效生成
SDS 技术广泛应用于文本生成 3D 图像和图像编辑中,英伟达融合该技术推出 Audio-SDS,结合预训练模型的生成先验知识,能够直接根据高级文本提示调整 FM 合成参数、冲击音模拟器或分离掩码,将信号处理的清晰可解释性与现代扩散模型的灵...
2025-05-13
·
浏览444次
可生成 AI 播客:谷歌 NotebookLM 音频概览功能新增 76 种语言支持,包含中文
谷歌宣布NotebookLM的音频概述功能新增76种语言支持,包括中文。用户可自由选择生成音频的语言,方便多语言学习。例如教师可共享不同语言资源,学生用偏好语言生成音频概览。#谷歌AI##语言学习#...
2025-04-30
·
浏览569次
上一页
·
下一页
· 当前第1页
AI 中文社