来自通义万相的创意加速器:AI 绘画创作

news2025/1/12 10:42:15

来自通义万相的创意加速器:AI 绘画创作

  • 通义万相
  • 动手搭建“通义万相”
  • 部署方案
  • 资源准备
    • 对象存储OSS(手动部署)
    • DashScope 模型服务灵积
    • 云服务器ECS(手动部署)
    • 一键部署ROS
  • Web文生图
    • 艺术与设计创作
    • 广告与营销物料生成
    • 教育与培训资源制作
    • 游戏与娱乐内容开发
    • 时尚与服装设计
  • 资源释放
  • 体验感受

可以说,2024年是AI人工智能大火的时代,那么基于AI我们可以做哪些事呢?过去的和AI智能的聊天对话,以及现在的基于AI的文生图、文生音频、文生视频,其实AI人工智能的发展,可以说已经极大的丰富了我们的日常生活和工作。现在目之所及,在各行各业都可以看到AI的身影,比如你可以利用AI生成工作年报,或者数据分析,为决策提供依据等等。那么今天我们主要是来感受一下AI在绘画创作行业的重要作用。
在开始今天的主题操作之前,先来了解一下什么是通义万相?

通义万相

说起通义万相,大家其实也算比较熟悉了,最常用的就是文生图,我是从通义万相出来就一直在时不时的用,通义万相地址:https://tongyi.aliyun.com/wanxiang 通义万相的界面是这样的
在这里插入图片描述

这里我们注意到右上角有个【灵感值】,这个灵感值就是你每天可以免费使用通义万相的次数,过去是每天自动刷新50灵感值,现在规则改为了每天手动签到,发放50灵感值,可以累计。点击【创意作画】就可以跳转到文生图页面,输入Prompt: 阳光 帅气 小男孩 头像 ,默认风格,点击【生成创意画作】就可以从生成的四幅图中选择一副自己满意的了,操作很简单
在这里插入图片描述

那么今天我们需要做的就是【利用自研的通义万相AIGC技术在Web服务中实现先进的图像生成】,简单的说就是我们自己搭建一个类似于通义万相的文生图平台,并用自己搭建的通义万相体验生成图像。好了,简单的回忆到这里结束。下面开始精彩部分登场。

动手搭建“通义万相”

在开始动手搭建自己的“通义万相”之前,先来简单介绍一下我们的搭建方案:【ECS云服务器用于运行Web程序,以接收用户的图像处理请求;对象存储OSS则用于存储某些场景中用户上传的图片,并通过签名的方式使得通义万相可以下载该图片,模型服务通过提供基于HTTP接口的API,实现应用程序的调用。】整体方案规划图如下
在这里插入图片描述

方案部署操作文档地址:https://www.aliyun.com/solution/tech-solution/tongyi-wanxiang

部署方案

在方案部署文档中,我们选择【一键部署】方案来快速体验利用自研的通义万相AIGC技术在Web服务中实现先进的图像生成应用部署体验,下拉文档找到
在这里插入图片描述

点击【一键部署】进入到操作文档步骤页面,基于上面的方案介绍,我们需要以下基础设施和云服务:
• 1个专有网络VPC:云服务器ECS创建于此VPC下。
• 1台交换机:云服务器ECS创建于此交换机下。
• 1台云服务器ECS:用于部署示例应用程序。
• 1个对象存储OSS Bucket:用户存储用户上传的图片,并生成签名的URL提供给大模型进行下载。建议使用和ECS同地域下的OSS Bucket。
• DashScope灵积模型服务:用于示例应用程序调用通义万相的服务。

资源准备

基于上面我们整理的需要用到的基础设施和云服务,那么我们先来准备一个杭州地域的对象存储OSS。

对象存储OSS(手动部署)

登录OSS控制台:https://oss.console.aliyun.com/overview 在【杭州】地域下创建OSS Bucket,点击【Bucket列表】
在这里插入图片描述

点击【创建Bucket】,输入Bucket名称,选择【杭州】地域,其他默认选择,
在这里插入图片描述

点击【完成创建】-【我知道了,确认创建】完成OSS Bucket创建。
在这里插入图片描述

创建成功如图
在这里插入图片描述

DashScope 模型服务灵积

登录DashScope 模型服务灵积 控制台:https://dashscope.console.aliyun.com/overview 如果你还没有开通服务,你需要先开通服务
在这里插入图片描述

在首页模型服务灵积总览页面我们可以看到历史使用过的模型
在这里插入图片描述

开通服务之后点击【管理中心】-【API-KEY管理】
在这里插入图片描述

点击【创建新的API-KEY】,在弹框页面点击【复制】并保存生成的 API-KEY
在这里插入图片描述

云服务器ECS(手动部署)

创建云服务器ECS,需要先登录云服务器控制台:https://ecs.console.aliyun.com/home
在这里插入图片描述

点击【创建我的ECS】跳转到ECS创建页面,选择【按量付费】选择地域和OSS同地域【杭州】地域
在这里插入图片描述

这里如果没有专有网络、交换机 可供选择的话,可以直接点击【创建专有网络】、【创建交换机】去创建 VPC 和 Switch,操作比较简单,这里不再详细赘述,下面继续选择ECS 实例规格,这里选择实例规格【ecs.e-c1m2.large】
在这里插入图片描述

镜像选择 公共镜像【CentOS 7.6 64位】
在这里插入图片描述

系统盘默认 40GiB,安全组选择【新建安全组】勾选 80 端口
在这里插入图片描述

管理设置服务器密码选择【自定义密码】
在这里插入图片描述

高级设置更改实例名称为【wanxiang-2024】
在这里插入图片描述

最后勾选服务,点击【确认下单】完成云服务器ECS的创建
在这里插入图片描述

一键部署ROS

单击一键部署前往ROS控制台,输入应用登录用户名、密码
在这里插入图片描述

输入刚才创建 的 API-KEY ,默认 OSS 存储空间名称
在这里插入图片描述

选择实例规格类型【ecs.g7.large】输入实例密码
在这里插入图片描述

勾选后,点击【下一步】
在这里插入图片描述

进入到资源编排管理详情页,确认选择信息,以及价格信息
在这里插入图片描述
在这里插入图片描述

这里需要注意的是需要保证你的账户余额大于 100 元,否则点击【创建】会提示你充值。点击【创建】等待资源栈创建成功,整个过程大概3~5分钟
在这里插入图片描述

等待创建资源栈成功后,选择 tab 输出,点击体验地址
在这里插入图片描述

输入刚才创建时应用的用户名以及密码 demo-user
在这里插入图片描述

点击【登录】成功跳转到服务页面
在这里插入图片描述

Web文生图

基于上面的一键部署操作,完成通义万相AIGC技术在Web服务中实现,现在我们可以在Web服务页面体验通义万相的几大应用场景了

艺术与设计创作

说到艺术与设计创作,最先想到的就是敦煌飞天图,这里我输入提示词 Prompt:【生成一副敦煌飞天图】
在这里插入图片描述

生成效果如图
在这里插入图片描述

整体上看起来不管是从意境,还是从色彩搭配上,都有敦煌壁画中敦煌飞天的韵味在里面,真心不错。

广告与营销物料生成

说到广告的话,这里首先想到的就是为自己经常和的伊利牛奶生成一副广告营销图,那么我的关键词 Prompt:【生成一副伊利牛奶的宣传图】,同样是等待15~30秒后,生成效果如图,
在这里插入图片描述

整体上的色调搭配以及主体突出都是没有问题的,这里就是少了一点广告的主体在里面,没有地方可以突出给到 品牌名或者是品牌Logo,有点小缺憾。

教育与培训资源制作

提到教育与培训,那么首先想到的就是学生努力学习奋斗的模样,这里我的关键词 Prompt:【生成一副学生努力学习的图片】,生成效果如图
在这里插入图片描述

整张图对于学生努力学习的氛围以及书本的多都表现的很细腻,整体上很不错,同时也突出了学习必须要努力才有收获,不错。

游戏与娱乐内容开发

提到游戏与娱乐的话,个人首先想到的是英雄联盟的游戏,于是我就通过通义万相生成一副英雄联盟的宣传图,关键词 Prompt:【生成一副英雄联盟的游戏界面图】生成效果如图
在这里插入图片描述

这幅图从游戏角度来欣赏确实是有游戏的那种感觉的,并且这个意境也符合英雄联盟游戏的整体风格意境,也很不错。

时尚与服装设计

那么提到时尚服装设计,那么我首先想到的是生成一副时尚时装的模特图来看一下效果,关键词 Prompt:【生成一副时尚时装的模特图】生成效果如图
在这里插入图片描述

这幅服装设计图从整体上来看以及模特上身后的感觉上来看都不失为一个不错的设计,确实很时尚很Fashion。

资源释放

登录一键部署 ROS 控制台:https://ros.console.aliyun.com/cn-hangzhou/stacks 点击列表【删除】释放资源
在这里插入图片描述

在弹窗页面选择【释放资源】点击【确定】
在这里插入图片描述

输入短信验证码,完成ROS资源释放
在这里插入图片描述

体验感受

1)资源部署及场景API调用体验过程是否得到足够的引导,操作是否顺畅?
在本次利用自研的通义万相AIGC技术在Web服务中实现先进的图像生成的部署操作中,整个部署文档写的是足够的详细,大部分内容都是通过一键部署的资源栈ROS完成了,操作者只需要获取DashScope API-KEY 就可以了,操作过程简单且易操作,流程顺畅,部署指引够完善,赞一个。
2)该方案是否满足您的需求?
本次利用自研的通义万相AIGC技术在Web服务实现图像生成的方案目前足够满足个人的需求,只是在有一些场景中生成的图片可能并不完善,比如在【广告与营销物料生成】场景下,生成的关于伊利牛奶的营销图实际是有点缺憾的,作为广告营销图,但是却没有标明具体的品牌方或者是品牌方Logo,这个不能算生成的图片满足需求。而对于其他几个场景的图像生成效果还都是不错的。另外结合通义万相目前公开免费试用的能力场景来看,本次部署的通义万相风格上并不是很丰富,只有目前较为常用的风格,而通义万相的风格就比较丰富
在这里插入图片描述

3)该方案还有哪些可以改进的图片生成能力?
其实对于通义万相来说,目前最有改进空间的就是上下文的结合能力,目前的图像生成,总是基于一次的 Prompt来生成图片,而不能基于一次的 Prompt后续不断地丰富或者修正图像生成方案,从而最终完善图片到自己想要的效果,也就是没有类似 语境上下文这样的功能。希望后期可以往这方面改进,毕竟目前的文生图行业,关键词技术还不算完善,真正掌握这项技术的人只有少数,大多数人还是只能通过一次又一次的尝试来完善图片生成效果。而目前的通义万相或者说本次部署的利用自研的通义万相AIGC技术在Web服务,本身并没有上下文的概念,因此这也可能成为AIGC图像生成发展的阻力。
4)该方案该在成本、易用性、应用场景上是否有竞争力?
本次利用自研的通义万相AIGC技术在Web服务的部署操作过程,整个是很流畅简单的,那么这样就可以大大降低学习带来的成本。在成本上正如上面截图中看到的一样,整个过程的花费也就是云服务器ECS 的按小时计费,以及对象存储 OSS 按使用量计费的成本
在这里插入图片描述

综合下来算是很低的成本了。另外易用性上也比较简单,页面操作很明朗,可以自行选择图片规格、图片数量、图片风格等参数。
在这里插入图片描述

在应用场景上,结合上面提到的五大场景的测试,对于文生图还有更多的场景,比如编辑行业等,应用场景还是很有前景的。另外,产品的竞争力除了要提供好的产品外,还需要在成本上有优势,那么对于本次利用自研的通义万相AIGC技术在Web服务的部署上,成本以及产品的优势都很明显,性价比高,足够有竞争力,后续团队如果有这方面需要的话,还是很乐意推荐的。
5)在场景中使用到具体云产品的体验
在本次利用自研的通义万相AIGC技术在Web服务的部署上,主要用到的云产品包括云服务器ECS、对象存储OSS、DashScope灵积模型服务、资源编排ROS,那么对于这几款产品,个人实际在部署中总是或多或少的用到过,因此对于这几项云产品的配置基本不用看文档就可以,另一方面也说明了产品的操作配置比较便捷易记忆,基本上操作一两次就可以完全掌握。同时,在产品的功能上和性能上也是没的说,对于云服务器ECS可以升降配,操作起来也很方便,产品手册的话每一款云产品都有单独的产品手册,可以在控制台直接找到
在这里插入图片描述

包括一些场景的操作指引等也都是很详尽
在这里插入图片描述

总的来说对于阿里云产品的文档,个人是没有什么意见,云产品的文档写的总是足够的丰富到小白上手无压力。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/2275461.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

STM32F4分别驱动SN65HVD230和TJA1050进行CAN通信

目录 一、CAN、SN65HVD230DR二、TJA10501、TJA1050 特性2、TJA1050 引脚说明 三、硬件设计1、接线说明2、TJA1050 模块3、SN65HVD230 模块 四、程序设计1、CAN_Init:CAN 外设初始化函数2、CAN_Send_Msg、CAN_Receive_Msg 五、功能展示1、接线图2、CAN 数据收发测试 …

Elasticsearch:在 HNSW 中提前终止以实现更快的近似 KNN 搜索

作者:来自 Elastic Tommaso Teofili 了解如何使用智能提前终止策略让 HNSW 加快 KNN 搜索速度。 在高维空间中高效地找到最近邻的挑战是向量搜索中最重要的挑战之一,特别是当数据集规模增长时。正如我们之前的博客文章中所讨论的,当数据集规模…

时空笔记:CBEngine(微观交通模拟引擎)

CBEngine 是一个微观交通模拟引擎,可以支持城市规模的道路网络交通模拟。CBEngine 能够快速模拟拥有数千个交叉路口和数十万辆车辆的道路网络交通。 以下内容基本翻译自CBEngine — CBLab 1.0.0 documentation 1 模拟演示 1.0 模拟演示结构 config.cfg 定义了 roa…

Notepad++上NppFTP插件的安装和使用教程

一、NppFTP插件下载 图示是已经安装好了插件。 在搜索框里面搜NppFTP,一般情况下,自带的下载地址容易下载失败。这里准备了一个下载连接:Release v0.29.10 ashkulz/NppFTP GitHub 这里我下载的是x86版本 下载好后在nodepad的插件里面选择打…

基于华为ENSP的OSPF不规则区域划分深入浅出(5)

本篇技术博文摘要 🌟 OSPF不规则区域划分及其问题解决方案涉及多个技术手段,包括隧道、虚链路和路由重发布等。合理的网络设计和配置对于避免网络中出现的环路问题至关重要。通过多进程双向重发布等方式,能够有效地优化路由协议的互通性和网络…

微信小程序——创建滑动颜色条

在微信小程序中,你可以使用 slider 组件来创建一个颜色滑动条。以下是一个简单的示例,展示了如何实现一个颜色滑动条,该滑动条会根据滑动位置改变背景颜色。 步骤一:创建小程序项目 首先,使用微信开发者工具创建一个新…

【再谈设计模式】模板方法模式 - 算法骨架的构建者

一、引言 在软件工程、软件开发过程中,我们经常会遇到一些算法或者业务逻辑具有固定的流程步骤,但其中个别步骤的实现可能会因具体情况而有所不同的情况。模板方法设计模式(Template Method Design Pattern)就为解决这类问题提供了…

Chrome_60.0.3112.113_x64 单文件版 下载

单文件,免安装,直接用~ Google Chrome, 免費下載. Google Chrome 60.0.3112.113: Chrome 是 Google 開發的網路瀏覽器。它的特點是速度快,功能多。 下载地址: https://blog.s3.sh.cn/thread-150-1-1.htmlhttps://blog.s3.sh.cn/thread-150-1-1.html

EXCEL: (二) 常用图表

10. 图表 134-添加.删除图表元素 图表很少是一个单独的整体,而是由十几种元素/对象拼凑出来的。 学习图表就是学习当中各类元素的插删改。 ①图表中主要元素的定义 图表上的一个颜色就是一个系列,每个系列都对应原数据中的一列/一行值数据。 每个系…

Transformer:深度学习的变革力量

深度学习领域的发展日新月异,在自然语言处理(NLP)、计算机视觉等领域取得了巨大突破。然而,早期的循环神经网络(RNN)在处理长序列时面临着梯度消失、并行计算能力不足等瓶颈。而 Transformer 的横空出世&am…

jenkins入门13--pipeline

Jenkins-pipeline(1)-基础 为什么要使用pipeline 代码:pipeline 以代码的形式实现,通过被捡入源代码控制, 使团队能够编译,审查和迭代其cd流程 可连续性:jenkins 重启 或者中断后都不会影响pipeline job 停顿&#x…

深度学习的原理和应用

一、深度学习的原理 深度学习是机器学习领域的一个重要分支,其原理基于多层神经网络结构和优化算法。以下是深度学习的核心原理: 多层神经网络结构:深度学习模型通常由多层神经元组成,这些神经元通过权重和偏置相互连接。输入数据…

Domain Adaptation(李宏毅)机器学习 2023 Spring HW11 (Boss Baseline)

1. 领域适配简介 领域适配是一种迁移学习方法,适用于源领域和目标领域数据分布不同但学习任务相同的情况。具体而言,我们在源领域(通常有大量标注数据)训练一个模型,并希望将其应用于目标领域(通常只有少量或没有标注数据)。然而,由于这两个领域的数据分布不同,模型在…

netty请求行超出长度

说明:记录一次使用Netty异常,如下: 错误信息:An HTTP line is larger than 4096 bytes. 场景 项目是微服务架构,在使用Netty转发请求到其他服务的时候报了这个错误。因为该请求是GET方式,其中有个参数值是…

CES Asia 2025科技盛宴,AI智能体成焦点

2025第七届亚洲消费电子技术展(CES Asia赛逸展)将在北京拉开帷幕,AI智能体有望成为展会的核心亮点。 深圳市人工智能行业协会发文表示全力支持CES Asia 2025(赛逸展),称其为人工智能领域的创新发展提供了强…

linux:文件的创建/删除/复制/移动/查看/查找/权限/类型/压缩/打包

关于文件的关键词 创建 touch 删除 rm 复制 cp 权限 chmod 移动 mv 查看内容 cat(全部); head(前10行); tail(末尾10行); more,less 查找 find 压缩 gzip ; bzip 打包 tar 编辑 sed 创建文件 格式: touch 文件名 删除文件 复制文件 移动文件 查看文…

【计算机网络】lab3 802.11 (无线网络帧)

🌈 个人主页:十二月的猫-CSDN博客 🔥 系列专栏: 🏀计算机网络_十二月的猫的博客-CSDN博客 💪🏻 十二月的寒冬阻挡不了春天的脚步,十二点的黑夜遮蔽不住黎明的曙光 目录 1. 前言 2.…

机器人碳钢去毛刺,用大扭去毛刺主轴可轻松去除

在碳钢精密加工的最后阶段,去除毛刺是确保产品质量的关键步骤。面对碳钢这种硬度较高的材料,采用大扭矩的SycoTec去毛刺主轴,成为了行业内的高效解决方案。SycoTec作为精密加工领域的领军品牌,其生产的高速电主轴以其卓越的性能&a…

【漫话机器学习系列】042.提前停止训练的优势(Early Stopping Advantages)

提前停止训练(Early Stopping)的优势 提前停止是一种有效的正则化技术,在训练模型时通过监控验证集的性能来决定训练的结束点,从而避免过拟合。以下是提前停止的主要优势: 1. 防止过拟合 提前停止通过在验证集性能开…

ROS2快速入门0--节点

0:安装 wget http://fishros.com/install -O fishros && . fishros1:运行第一个机器人 ros2 run turtlesim turtlesim_node使用方向健进行控制(在另一个终端) ros2 run turtlesim turtle_teleop_key 2原理解析 打开另一个终端-->输入rqt-->Plugins-->Intr…