返回首页  设为首页  加入收藏  今天是:
网站首页vivo手机oppo手机华为手机苹果手机荣耀手机小米手机三星手机魅族手机中兴手机
相关文章
 谷歌下场优化扩散模型三星手…
 三星一季度手机出货量为6000…
 今日消息|北影节三星手机电…
 三星Galaxy智能手机与家电齐…
 iphone14pro开不了机什么情况…
 iphone5开不了机怎么办
 买了半年的iqoo7多次自动关机…
 奸商都不愿卖 问题最多水货手…
 苹果6s闲置太久了开不了机怎…
 努比亚Z30 Pro评测:急速充电…
 评测_天极网_专业IT门户
 2亿像素没有谁比它更懂拍星星…
 努比亚旗舰 Z30 Pro 评测:那…
 回归主流旗舰 但依旧不缺个性…
 技术联盟-E安全
 小米公司
 小米最新相关新闻
 小米手机MIUI 12新版全局搜索…
 手机IMEI码是什么?小米手机…
 苹果iPhone14可以分屏吗 苹果…
 苹果放大招:iOS 12大升级iP…
 苹果iPhone14可以分屏吗 苹果…
 iPhone6s分屏教程
 iphone8怎么分屏 iphone8手机…
 华为荣耀v9和华为v9一样吗(…
 华为荣耀v9手机怎么样(评测…
 荣耀9和荣耀V9区别
 荣耀V9值得买吗?
 华为荣耀v9怎么样?荣耀v9配…
 魅族手机图片型号大全(魅族…
 6299元起!魅族20 INFINITY无…
 【新机】魅族史上经典机型回…
 魅族手机全部机型(魅族手机…
 魅族系列手机型号大全(魅族…
 vivo Y系列首款曲面屏手机Y7…
 vivo Y系列首款曲面屏!vivo…
 【IT之家开箱】vivo Y78+ 手…
 【IT之家开箱】vivo Y78+手…
 vivo将于海外市场推出Y系列机…
 oppo手机如何隐藏软件不被发…
 oppo手机应用怎么隐藏 如图
 OPPO手机怎么将软件隐藏
 oppo手机怎么样隐藏软件 opp…
 oppo手机隐藏应用怎么设置
 三星的哪几款手机比较好
 三星 Galaxy F54 5G 手机规格…
 三星手机的最新型号有那些?
 一分价钱一分货论三星最值得…
 三星(SAMSUNG)的哪款手机最…
 华为荣耀6在哪里设定定时开关…
专题栏目
网络
您现在的位置: 手机评测网 >> 三星手机 >> 正文
高级搜索
谷歌下场优化扩散模型三星手机运行Stable Diffusion12秒内出图
作者:佚名 文章来源:本站原创 点击数: 更新时间:2023/4/29 12:18:52 | 【字体:

  静夜寂歌之祭Stable Diffusion 在图像生成领域的知名度不亚于对话大模型中的 ChatGPT。其能够在几十秒内为任何给定的输入文本创建逼真图像。由于 Stable Diffusion 的参数量超过 10 亿,并且由于设备上的计算和内存资源有限,因而这种模型主要运行在云端。

  在没有精心设计和实施的情况下,在设备上运行这些模型可能会导致延迟增加,这是由于迭代降噪过程和内存消耗过多造成的。

  如何在设备端运行 Stable Diffusion 引起了大家的研究兴趣,此前,有研究者开发了一个应用程序,该应用在 iPhone 14 Pro 上使用 Stable Diffusion 生成图片仅需一分钟,使用大约 2GiB 的应用内存。

  此前苹果也对此做了一些优化,他们在 iPhone、iPad、Mac 等设备上,半分钟就能生成一张分辨率 512x512 的图像。高通紧随其后,在安卓手机端运行 Stable Diffusion v1.5 ,不到 15 秒生成分辨率 512x512 的图像。

  在没有数据连接或云服务器的情况下,这项研究为在手机上本地运行生成 AI 开辟了许多可能性。Stable Diffusion 去年秋天才发布,今天已经可以塞进设备运行,可见这个领域发展速度有多快。

  为了达到这一生成速度,谷歌提出了一些优化建议,下面我们看看谷歌是如何优化的。

  该研究旨在提出优化方法来提高大型扩散模型文生图的速度,其中针对 Stable Diffusion 提出一些优化建议,这些优化建议也适用于其他大型扩散模型。

  组归一化(GN)方法的工作原理是将特征图的通道(channel)划分为更小的组,并独立地对每个组进行归一化,从而使 GN 对批大小的依赖性降低,更适合各种批大小和网络架构。该研究没有按顺序执行 reshape、取均值、求方差、归一化这些操作,而是设计了一个独特的 GPU shader 形式的内核,它可以在一个 GPU 命令中执行所有这些操作,而无需任何中间张量(tensor)。

  高斯误差线性单元(GELU)作为常用的模型激活函数,包含大量数值计算,例如乘法、加法和高斯误差函数。该研究用一个专用的 shader 来整合这些数值计算及其伴随的 split 和乘法操作,使它们能够在单个 AI 作画调用中执行。

  Stable Diffusion 中的文本到图像 transformer 有助于对条件分布进行建模,这对于文本到图像生成任务至关重要。然而,由于内存复杂性和时间复杂度,自 / 交叉注意力机制在处理长序列时遇到了困难。基于此,该研究提出两种优化方法,以缓解计算瓶颈。

  一方面,为了避免在大矩阵上执行整个 softmax 计算,该研究使用一个 GPU shader 来减少运算操作,大大减少了中间张量的内存占用和整体延迟,具体方法如下图 2 所示。

  另一方面,该研究采用 FlashAttention [7] 这种 IO 感知的精确注意力算法,使得高带宽内存(HBM)的访问次数少于标准注意力机制,提高了整体效率。

  Winograd 卷积将卷积运算转换为一系列矩阵乘法。这种方法可以减少许多乘法运算,提高计算效率。但是,这样一来也会增加内存消耗和数字错误,特别是在使用较大的 tile 时。

  Stable Diffusion 的主干在很大程度上依赖于 3×3 卷积层,尤其是在图像解码器中,它们占了 90% 。该研究对这一现象进行了深入分析,以探索在 3 × 3 内核卷积上使用不同 tile 大小的 Winograd 的潜在好处。研究发现 4 × 4 的 tile 大小最佳,因为它在计算效率和内存利用率之间提供了最佳平衡。

  很明显,随着每个优化被激活,延迟逐渐减少(可理解为生成图像时间减少)。具体而言,与基线 Ultra 延迟减少 52.2%;iPhone 14 Pro Max 延迟减少 32.9%。此外,该研究还对三星 S23 Ultra 端到端延迟进行评估,在 20 个去噪迭代 step 内,生成 512 × 512 像素图像,不到 12 秒就达到 SOTA 结果。

  小型设备可以运行自己的生成式人工智能模型,这对未来意味着什么?我们可以期待一波。

  原标题:《谷歌下场优化扩散模型,三星手机运行Stable Diffusion,12秒内出图》

三星手机录入:admin    责任编辑:admin 
  • 上一个三星手机:

  • 下一个三星手机: 没有了
  •  
     栏目文章
    普通三星手机 谷歌下场优化扩散模型三星手机运行Stable Dif… (04-29)
    普通三星手机 三星一季度手机出货量为6000万部 预计二季度下… (04-29)
    普通三星手机 今日消息|北影节三星手机电影短片单元论坛揭… (04-29)
    普通三星手机 三星Galaxy智能手机与家电齐聚 AWE 2023演绎星… (04-29)
    普通三星手机 三星的哪几款手机比较好 (04-28)
    普通三星手机 三星 Galaxy F54 5G 手机规格曝光:108 亿主摄… (04-28)
    普通三星手机 三星手机的最新型号有那些? (04-28)
    普通三星手机 一分价钱一分货论三星最值得入手的三款机型 (04-28)
    普通三星手机 三星(SAMSUNG)的哪款手机最值得你推荐? (04-28)
    普通三星手机 三星高管称正推动Exynos芯片回归Galaxy旗舰手… (04-27)
    普通三星手机 AWE 2023盛大开幕 三星多款热门Galaxy智能手机… (04-27)
    普通三星手机 三星成为一季度智能手机销量冠军 出货量达600… (04-27)
    普通三星手机 第 1 季度印度手机市场战报:三星第一小米下降… (04-27)
    普通三星手机 三星2023年1季以20%份额连续两个季在印度智能… (04-27)
    普通三星手机 新一代机皇三星Galaxy S23 Ultra手机获五星评… (04-27)
    普通三星手机 三星为S23系列手机推出AI驱动的Galaxy Enhanc… (04-27)
    普通三星手机 三星斩获一季度智能手机出货量冠军 Galaxy S2… (04-27)
    普通三星手机 三星Galaxy S24系列手机将采用“双芯片”设计 (04-27)
    普通三星手机 华为、三星、OPPO占据折叠屏手机品牌认知榜前… (04-27)
    普通三星手机 三星UI 20 (Android 10)更新时间表曝光您的三… (04-26)