图像生成技术飞速发展,个人化艺术创造还有多远?

简介: 【6月更文挑战第12天】图像生成技术飞速发展,个人化艺术创造还有多远?

在当今这个创意与科技交织的时代,图像生成技术正以前所未有的速度重塑视觉艺术的边界。不管你是否有艺术细胞,不管你是否接受了系统的艺术创作教育,你都可以通过图像生成技术创造出属于你自己的艺术。

通义万相文本绘图与人像美化

在开始话题之前,我先点进去了话题中提供的体验链接:https://www.aliyun.com/solution/tech-solution/tongyi-wanxiang 最开始进去这个页面看着和通义万相感觉一点关系没有,后来再次确认了链接没有错,那么意思就是需要自己部署 【通义万相文本绘图与人像美化】 这个,然后再体验通义万相的文生图

在文档中找到部署操作的内容,这里我为了可以快速体验自己部署版的通义万相,我选择【一键部署】

进入一键部署后,部署步骤比较简单,按照部署步骤先准备账号和DashScope API-KEY ,然后点击 一键部署 到ROS控制台,选择DashScope API-KEY、ECS实例规格和可用区,以及输入实例密码


这里需要说明一点,因为创建过程中需要用到ECS服务器,那么ECS服务器默认是按量付费,如果你没有购买ECS服务器,且账户余额小于100元,就会报这个错误

错误信息

Resource CREATE failed: ResponseException: resources.EcsInstance: Your account does not have enough balance to order postpaid product. Code: InvalidAccountStatus.NotEnoughBalance RequestId: 4A2DEAEE-D4B0-30F6-AE5E-D9CA88AEC243

那么此时的解决办法就是去用户中心补足账户余额大于100元,然后再次从ROS控制台重新操作。其实在你选择完资源之后的创建页面就有账户余额不足提示的


补足余额大于100元之后点击【创建】进入部署,部署到 80% 左右,会比较慢,耐心等待


创建成功后,点击【输出】找到体验地址,


然后点击体验地址即可进入通义万相体验页面


部署结束之后,下面就开始对话题展开聊聊。

希望图像生成类应用具备哪些功能

对于图像生成类应用,那么从用户群体来看,自然是像我这样的需要文生图,并且自己不会画画的用户。文生图的一大重要场景就是可以通过输入文本内容,实现转化大脑中期待的这段文本所描述的场景。

通义万相的功能个人也用的不少,基本上是从一开始就在用,通义万相地址:https://tongyi.aliyun.com/wanxiang/creation


目前通义万相的生成效果基本是没有大方向的问题,但是在一些小细节处理上总是不太理想。比如这里我需要生成的是【可爱 姐姐 淘气 弟弟】然后生成的四幅图中我唯一比较满意的图左上角却有个图标。然后我就下载这图再次通过通义万相想要去掉这个图标,正如截图中的一样,尝试了几次都没有成功。


希望后续图像生成类应用,比如通义千问,可以有上下文的功能。当提供关键词文生图之后,那么可以基于已经生成的图片继续提出关键词进行优化,就像我需要去掉左上角图标一样。这样的话经过关键词的不断精细化和目的化,从而让图片生成的效果更符合预设的效果,从而更好的满足图像生成类应用的用户需求。

通义万相改进建议

就像上面我提到的一样,从通义万相上线到现在,自己一直是有在使用通义万相文生图的,从整体上来说,通义万相对于文本内容的把握方向是很准确的,且每次生成的图片也都是契合文本内容的。但是从使用之初到现在,并没有那次的文生图是特别满意和认可的,往往最终的选择就是四选一,从四个中挑出来一个相对满意的。


改进建议,正如上面提到的一样,希望通义万相可以有一个上下文的理解在里面,用户可以基于第一次提出的文本内容对生成的图片进行多次的精修,从而达到用户期待的效果这样。

相关实践学习
通义万相文本绘图与人像美化
本解决方案展示了如何利用自研的通义万相AIGC技术在Web服务中实现先进的图像生成。
7天玩转云服务器
云服务器ECS(Elastic Compute Service)是一种弹性可伸缩的计算服务,可降低 IT 成本,提升运维效率。本课程手把手带你了解ECS、掌握基本操作、动手实操快照管理、镜像管理等。了解产品详情: https://www.aliyun.com/product/ecs
相关文章
|
存储 分布式数据库 C语言
【初阶数据结构】树(tree)的基本概念——C语言
【初阶数据结构】树(tree)的基本概念——C语言
|
人工智能 搜索推荐
手绘与文字的完美结合:阿里的通义万相涂鸦作画体验分享
木头左介绍涂鸦作画,一个融合AI的绘画工具,让用户通过简单手绘和文字描述创造个性化艺术作品。用户需注册登录后,利用画笔、橡皮等功能创作,并能根据文字描述自动生成画作。涂鸦作画简单易用,有丰富素材库,生成效果出色,有望在教育、设计等领域广泛应用。
|
机器学习/深度学习 人工智能 自然语言处理
PGL图学习之图神经网络GNN模型GCN、GAT[系列六]
本次项目讲解了图神经网络的原理并对GCN、GAT实现方式进行讲解,最后基于PGL实现了两个算法在数据集Cora、Pubmed、Citeseer的表现,在引文网络基准测试中达到了与论文同等水平的指标。 目前的数据集样本节点和边都不是很大,下个项目将会讲解面对亿级别图应该如何去做。
|
XML Java 数据库连接
性能提升秘籍:如何高效使用Java连接池管理数据库连接
在Java应用中,数据库连接管理至关重要。随着访问量增加,频繁创建和关闭连接会影响性能。为此,Java连接池技术应运而生,如HikariCP。本文通过代码示例介绍如何引入HikariCP依赖、配置连接池参数及使用连接池高效管理数据库连接,提升系统性能。
222 5
|
弹性计算 人工智能 对象存储
来自通义万相的创意加速器:AI 绘画创作
【7月更文挑战第11天】来自通义万相的创意加速器:AI 绘画创作
|
机器学习/深度学习 算法 数据挖掘
Python 机器学习算法交易实用指南(一)(1)
Python 机器学习算法交易实用指南(一)
531 4
|
消息中间件 Oracle 关系型数据库
实时计算 Flink版操作报错之同步Oracle时出现主题为空的报错该怎么解决
在使用实时计算Flink版过程中,可能会遇到各种错误,了解这些错误的原因及解决方法对于高效排错至关重要。针对具体问题,查看Flink的日志是关键,它们通常会提供更详细的错误信息和堆栈跟踪,有助于定位问题。此外,Flink社区文档和官方论坛也是寻求帮助的好去处。以下是一些常见的操作报错及其可能的原因与解决策略。
|
机器学习/深度学习 人工智能 自然语言处理
AI超级个体:ChatGPT与AIGC实战指南
AI超级个体:ChatGPT与AIGC实战指南
636 3
|
开发框架 前端开发 Java
Spring和Spring Boot:两者的区别与应用场景
Spring和Spring Boot:两者的区别与应用场景
456 1
|
数据可视化 BI
甲骨文ERP收款自动录入:提高财务效率,实现智能化管理
通过八爪鱼rpa自动化的方式,我们可以实现财务工作的智能化管理,提高工作效率和准确性。同时,八爪鱼rpa的使用也非常简单,用户可以通过可视化的界面进行操作,无需编写复杂的代码。因此,八爪鱼rpa不仅适用于大型企业,也适合中小型企业使用。