AI绘图

继之前尝试了用 AI 来制作 2001 年的网路游戏《魔力宝贝》风格的建筑物、地砖、墙壁、食物等素材后,这几天尝试全程用 AI 来制作人物角色动画。

其实大约一两年前也试过,用 Google Nano Banana 等的方式来生成角色行走的八方向图,然后拼合之类的。但是实际上将图片分割成一张张小图,然后拼接到一起之后,会发现角色根本无法对齐,动作也不连贯,因此可以说让目前的图像生成 AI 准确遵照指示直接生成动图的多帧图像还是不太现实的。

而在前一阵翻看《魔力宝贝》当年的旧资料时,我注意到该游戏的动图可能并不是直接手绘 2D 图像的,因为当年的杂志啦网站啦看起来有很多并不那么 2D 画风的角色怪物图。或许制作流程是这样的:先制作 3D 模型,以此保持角色各个方向以及持各种武器时的动作一致——这些 3D 模型被渲染成不那么 2D 像素风的图片,出现在《魔力宝贝》早期的网站及杂志中;而实际用在游戏中的素材,则是将 3D 转换成 2D 之后,再按一定的程序去调制出《魔力宝贝》的游戏画面风格,并最终成为了游戏图档。

这次,我就尝试模拟了这个流程,得到的结果是:

角色:砂漠の赤星

走路动作:

挥手动作:

继续阅读

继上次《《魔力宝贝》未开放职业的不存在设定图》后,这几天又尝试用 AI 试了一下做做看《魔力宝贝》风格的建筑物素材。

直接上图。教会

设计思路也是由 AI 提供,然后我从 AI 的多个提案里挑选,并且进一步深化的。具体来说就是每个建筑都有乐器构造的一座小镇。

民家

继续阅读

尝试用 Codex 制作《魔力宝贝》壁纸。我发现在 Codex 中好像能制作出比在 ChatGPT 网页聊天窗口内更高分辨率(更多像素数)的图片。以至于高达 3480*2160 。

不过因为像素数很多而且是 png 格式的,直接把原图上传到博客太占地方了,于是这里只放出缩小并压缩后的 jpeg 格式图片。

这次做了三张:传送石、小石像怪还有女性冒险者和液态史莱姆。

继续阅读

在网上学到一个用 ChatGPT 最新的图像制作功能来实现连续像素图动画(分割图)的方法。

提示词是:

Create a detailed pixel art frame animation for a game, where the final image is divided into multiple sub-images, each serving as a continuous animation keyframe. Design the sequence to depict [(这里填入你想要生成的像素图的内容)] Ensure the keyframes transition smoothly and continuously, and include as many frames as possible to achieve a high level of fluidity and detail in the animation.

我实际尝试填入的是:

Create a detailed pixel art frame animation for a game, where the final image is divided into multiple sub-images, each serving as a continuous animation keyframe. Design the sequence to depict [ChatGPT LOGO的机器人从手机屏幕里钻出来] Ensure the keyframes transition smoothly and continuously, and include as many frames as possible to achieve a high level of fluidity and detail in the animation.

于是就得到了:

继续阅读

虽说在前一篇博客里,我试了一下让 ChatGPT 用新的图像生成功能,生成像是图解翻花绳那样的有一些复杂空间结构、有内在逻辑的图片仍有问题。不过今天我又试了一下比较简单的图,而且是单张、不太强调逻辑的,幻想类的图,效果就看起来不错了。


就是这两张猫人妈妈的图。很温馨吧!

其实在生成过程中,还是陆陆续续有一些问题的,一开始我指定给 ChatGPT 的是生成猫咪宝宝的主观图,而且是躺在摇篮里的仰视图,而且我也说明了因为是主观视觉图,所以生成的图中就完全不应该出现猫宝宝的身体。结果 ChatGPT 一开始生成的图像还是比较主观的(没有猫宝宝的身体出现在图中),后来就越来越不符合我最初提出的要求了。

我猜这可能是因为 ChatGPT 新搭载的图像生成功能具有在整个对话中上下连贯衔接的功能,所以每次生成一张图,就会承接延续前一张生成图的一些元素,这也就导致了在同一个会话中生成的图片越来越偏离我最初的指示。

不过,仔细比较两张图的话会发现……猫妈妈毛的纹路惊人得一致!简直就像同一只猫人一样有说服力。

总之,但还是很温馨呀!

这么说起来……这可以说是真的「猫娘」(娘 = 妈妈)了吧?

这几天 ChatGPT 更新了新的图像生成器后,被网络上的人们纷纷称赞。确实,生成各类画风的图像有明显进步,但前提是不太注重细节,或不太注重图像内在的逻辑表现。

然而……一旦我提高了期待,让它试一试复杂的内容时,比如翻花绳……

下面四张是用 ChatGPT 新的图像生成工具来生成的翻花绳图解组图,你看明白了吗?

(一)

继续阅读

这几天好像是 Google 发布了新的 AI 工具—— Gemini 2.0 Flash 。我不是 Google AI 的经常使用者,所以我就不清楚它到底哪个模型有什么特征,或是过去的两年里是怎么迭代至今的。不过今天看了几个网上的帖子和视频,似乎用过的人都对其能力表示惊讶。特别是我看介绍说它在生成图片方面有比较好的整合能力,以及可以通过用户所输入的文本提示,针对图片进行局部进行修改。

在一个网络视频中我看到了介绍者用 Gemini 2.0 Flash 做了一个菜谱,那么我就来仿造一下——生成一个图文并茂的奇幻世界的烹饪手册。

下面展示的就是实际生成的图片。需要说明的是,图片不是一次性生成的,我的生成步骤是:先要求 AI 用文字的方式输出菜单,然后再通过多次对话指示,为每个步骤生成一个配套的图片。


好的,这是一个分为六个步骤的奇幻世界幻想菜谱:

菜名:暮光森林的低语

食材基调: 夜光蘑菇、星尘香草、龙鳞坚果、月光泉水、影豹里脊肉(少量,可选)、梦 Wind 酿制的晨露蜂蜜。

第一步:收集与净化

食材: 新鲜的夜光蘑菇(3个,需带有微弱的蓝色光芒)、月光泉水(1小杯)。

烹饪手法: 将夜光蘑菇小心翼翼地用柔软的苔藓擦拭干净,去除表面的泥土和杂质。然后,将它们浸泡在月光泉水中,让其吸收月光的能量,并去除可能存在的微小毒素(奇幻世界的蘑菇特性)。浸泡时间约为一刻钟(奇幻世界的时间单位,约等于现代的十五分钟)。

第二步:唤醒香气

继续阅读