#diffusion-models
共 3 篇相关内容 · 安全漏洞、AI动态、技术文章
技术文章 3
词语如何塑造声音:风格描述TTS的交叉注意力归因分析
# 词语如何塑造声音:风格描述TTS的交叉注意力归因分析 ## TL;DR 风格描述文本转语音(Style-Captioned TTS)系统用自然语言来控制声音特性——比如"用低沉、沙哑的声音说"。但每个描述词究竟是如何影响最终语音的?
DiffusionGemma推理透明度研究:扩散语言模型的黑箱到底有多黑
# DiffusionGemma的推理透明度:扩散语言模型的"黑箱"到底有多黑? ## TL;DR 扩散语言模型DiffusionGemma在连续潜空间中执行大量计算,其推理过程的透明度一直令人担忧。这项研究将透明度分解为"变量透明度"
DiffusionGemma的推理透明度:扩散模型真的比自回归模型更难理解吗?
研究表明,扩散语言模型DiffusionGemma的推理过程并不像表面看起来那样不透明——通过可解释的token瓶颈,其不透明度仅比Gemma 4高1.1倍。