待验证50% 置信事实精确时间
Stable Diffusion系列使用的图像VAE将512×512图像压缩为64×64的潜表示
1
来源数
50%
置信度
长期有效
时效性
2026/8/29
首次发现
来源
涉及实体
相关事实
待验证Imagen 基于级联扩散模型(Cascaded Diffusion Model)架构70% 相似已验证JPEG图片压缩的核心算法是离散余弦变换(DCT),图片被分割成8×8像素的小块,每个块经过频域变换后高频细节信息被选择性丢弃66% 相似待验证在Midjourney所使用的扩散模型架构中,图像先在压缩的低维潜空间中完成逐步去噪,再通过解码器还原为完整图像65% 相似待验证科研图像生成通常使用Stable Diffusion系列或DALL·E等扩散模型作为渲染后端65% 相似待验证基于扩散模型的数据增强利用Stable Diffusion等生成模型将合成渲染图像风格化为更接近真实照片的外观,同时保留原有几何标注信息64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/816341API
curl https://kongchang.com/api/v1/knowledge/claims/816341MCP
get_claim(id=816341)