“一丹一世界”三等奖 | 木刻时光·细密风 经验分享

简介: “一丹一世界”三等奖 | 木刻时光·细密风 经验分享

image.png

作者:老无谈藏书票

模型使用说明:

1.在提示词中需要说明”黑白木刻“,对应的英文提示是”woodcut print,black and white“等字样。

2.生成提示词后,使用”提示词优化“的选项,生图效果更好。

3.一般一次生成 4 张,就能挑选出满意的作品。

4.如果效果不好,可以调整提示词,目前个人试验,各类场景(神话、日常生活、风景、动物等)都能达到较好效果。

炼丹过程

此版本为针对黑白木刻风格进行 Lora 微调的第三代模型,相较于初代版本,在细节刻画与泛化能力上均有显著提升。

在第一版模型的开发中,我们以试验性的心态起步。然而,初版模型由于训练数据有限,效果未能达到预期。在第二版中,我们扩充了数据集,却因图片风格差异过大,导致训练效果不佳。分析原因后,我们推测是训练数据的多样性与质量未能达到要求。于是,我们对数据集进行了优化,剔除了质量欠佳的图片,并增添了风格相近但细节更丰富的图片。同时,我们将前代模型生成的部分优质图片融入数据集中,进一步丰富了训练素材。

在数据准备过程中,我们深刻认识到图片标签的重要性。早期版本中,由于部分标签由智能工具自动生成,存在诸多错误,导致模型训练出现偏差。例如,一张图片中狗趴在树上,智能标签却未能准确识别,将狗误判为树干的一部分。为此,我们对每张图片的标签进行了细致的手动调整,确保标签的准确性,从而大幅提升了模型训练效果。

在模型训练完成后,我们发现提示词对生图效果有着关键性的影响。我们通常先利用 Deepseek 生成初步提示词,再结合魔塔的提示词优化功能进行调整,一般经过两轮优化即可获得较为理想的效果。

尽管当前版本已具备一定的实用性,但仍存在较大的提升空间。未来的工作方向包括:

  1. 拓展训练数据:在保持风格一致的前提下,纳入更多样化的图片,覆盖更广泛的场景。
  2. 精细化标签:在标签中融入版画技法信息,如圆刀、三角刀、平刀等,使模型能够学习技法细节。
  3. 风格融合创新:尝试引入不同风格的数据,探索创新风格的可能性。
  4. 模型参数优化:对模型训练的具体参数进行更细致的调整,以进一步提升模型性能。
  5. 底座模型替换:尝试更换其他底座模型,评估其对生成效果的影响。



目录
相关文章
|
数据可视化 API Swift
全模态图像模型Nexus-Gen对齐GPT-4o!同时搞定,数据、训练框架、模型全面开源
OpenAI GPT-4o发布强大图片生成能力后,业界对大模型生图能力的探索向全模态方向倾斜,训练全模态模型成研发重点。
617 17
|
JavaScript
vue element plus Checkbox 多选框
vue element plus Checkbox 多选框
1084 0
|
7月前
|
存储 弹性计算 人工智能
2026年阿里云优惠券指南:领取、使用、查询与云服务器省钱技巧
在选购阿里云产品时,优惠券是降低成本的重要工具 —— 无论是个人开发者购买云服务器做项目,还是企业采购核心云资源,合理使用优惠券都能省下不少开支。但很多用户不清楚优惠券的领取渠道、查询方法,也容易在使用时踩 “不能叠加”“过期未用” 的坑。本文结合最新的优惠券体系和实操细节,梳理从领取到使用的全流程,帮大家把优惠用到实处。
|
9月前
|
人工智能 分布式计算 算法
AI战略丨大模型应用元年,让智能真正转变为生产力
在大模型能力用到企业、业务的探索过程中,阿里云提供全方位的支持,企业可以放开去尝 试各种不同的路径,共同探索智能未来。
AI战略丨大模型应用元年,让智能真正转变为生产力
|
机器学习/深度学习 数据采集 安全
MiMo-7B:从预训练到强化学习,解锁语言模型的推理潜能
目前,大多数成功的 强化学习 工作,包括开源研究,都依赖于相对较大的基础模型,例如 32B 模型,特别是在增强代码推理能力方面。业内普遍认为在一个小模型中同时提升数学和代码能力是具有挑战性的。然而,小米MiMo研究团队相信 RL 训练的推理模型的有效性取决于基础模型固有的推理潜力。为了完全解锁语言模型的推理潜力,不仅需要关注后训练,还需要针对推理定制预训练策略。
939 43
|
人工智能 自然语言处理 测试技术
UGMathBench:评估语言模型数学推理能力的动态基准测试数据集
近年来,人工智能蓬勃发展,自然语言模型(LLM)进展显著。语言模型被广泛应用于自动翻译、智能客服、甚至医疗、金融、天气等领域。而研究者们仍在不断努力,致力于提高语言模型的规模和性能。随着语言模型的蓬勃发展,评估一个语言模型的性能变得越来越重要。其中一个重要的评估指标,就是衡量语言模型的推理能力和解决数学问题的能力。
631 38
|
人工智能 自然语言处理 搜索推荐
魔搭社区模型速递(4.27-5.10)
🙋魔搭ModelScope本期社区进展:📟2341个模型,206个数据集,🎨224个创新应用,📄 15篇内容
1125 20
|
开发者
魔搭核心开发者共创会 | 邀请函
魔搭核心开发者共创会 | 邀请函
310 4
|
Android开发
Dagger Hilt - ViewModel的依赖注入及实现原理
Dagger Hilt VIewModel 依赖注入的原理
912 0
|
机器学习/深度学习 并行计算 调度
CuPy:将 NumPy 数组调度到 GPU 上运行
CuPy:将 NumPy 数组调度到 GPU 上运行
881 1

热门文章

最新文章