FotoMedley 的 AI 着色页如何比较
一张看似困难的家庭照片、六幅截然不同的图画以及打印的面对面测试揭示了着色页真正令人愉悦的原因——而不仅仅是黑白。


见见测试照片
繁忙风景中的一张笑脸
男孩的表情应该是英雄:眼睛、眉毛、微笑、发际线、耳朵、肩膀形状都有相似之处。间歇泉使记忆变得与众不同,但草地和林线包含的细节比大多数人喜欢的色彩要多得多。
这创造了真正的设计选择。保留完整的度假场景并接受更密集的页面,或者隔离肖像并制作更简单、更平易近人的内容。这两个答案都不会自动正确。预期的调色师决定哪种折衷方案更好。
- 必须生存
- 眼睛、微笑、头部形状和表情
- 有用的上下文
- 间歇泉和一抹风景
- 先减少
- 草纹理、树木、云彩和微小的阴影
每个结果必须通过四项测试
相似度
感觉这张脸还是同一个人吗?
线路置信度
重要的标记能在普通打印机中保存下来吗?
着色性
是否有吸引人的空间而不是灰色的视觉噪音?
适合目的
详细信息适合此人和此项目吗?
第 1 轮 · 基于像素的转换
当每条边都获得投票时
熟悉的照片到草图配方可以去除颜色,发现对比度变化,并调整亮度或阈值。它速度快、确定性强,有时还很有吸引力。对于一片草叶是否不如眼睑重要,它也没有意见。
这个弱点在这张照片中很明显。自动版本记录了数量惊人的草地和林线纹理,同时轻轻地绘制了男孩的眼睛和嘴巴,以至于它们几乎消失了。它保留了照片的几何形状,但没有建立着色的视觉层次结构。

自动边缘转换
场景可辨认,但脸色苍白而脆弱。在墨粉稍弱的打印机上,最重要的线条可能首先消失。

较暗的手动调节
对比度越高,结果越大胆,但它会将皮肤阴影、草和树木转换为斑点和黑色簇。较暗并不等于较清晰。
第 2 轮 · 早期 FotoMedley 处理
第一个重大改进:决定重要的事情
早期的 FotoMedley 工具超越了单个图像滤镜堆栈。他们可以识别主题,简化场景的各个部分,并生成多种绘图语言。这些存档的示例并不是当前人工智能系统的预览,但它们使核心设计问题变得清晰可见。

保留场景
脸部结构变得更清晰、更暗,背景也减少到选定的轮廓。尽管地面仍然是一项相当详细的着色任务,但它仍然感觉像是一张度假照片。

留住人
移除景观会改变体验。眼睛、微笑、头部和衬衫构成了整个页面。宽阔的白色区域使其适合蜡笔,而相似之处仍然令人惊讶地具体。
一幅图画可能很漂亮,但着色页可能是错误的
同一主题可以支持完全不同类型的标记制作。交叉阴影模型具有数百个小笔划的阴影。流动的标记草图保留了场景,但给每个轮廓一个松散的、手工制作的节奏。两者都比基本的边缘过滤器更具个性,并且都改变了用户被邀请做的事情。

十字线肖像
非常适合喜欢在纹理上绘画、添加选择性颜色或将页面视为单色艺术的人。不太适合寻找大空形状的幼儿。

流动标记素描
场景仍然生动且可识别,但破碎的标记和茂密的草地纹理使其比传统的着色书页面更接近富有表现力的素描。
第三轮·打印机说实话
三种方法,一台黑白打印机
屏幕预览是宽容的。明亮的显示屏可以显示出微弱的灰色线条,而缩放则可以使微小的纹理感觉是故意的。纸消除了这些优点。这三个版本都是黑白打印并一起拍照的,使得差异更难以忽视。


解读眼睛的保真度和可用性
过滤后的眼睛和嘴巴最真实地遵循源照片,因为它们是从那些精确的像素衍生而来的。主题感知绘图用一组较小的故意标记取代了它们,因此它们的形状必然是近似的。然而在纸上,这些简化的标记更暗、更干净、更容易理解。该滤镜赢得了最佳相似度测试;重新绘制的版本通常会赢得着色页测试。

第四轮·当前的生成式AI时代
如今,系统可以重绘场景创意
FotoMedley 目前的风格使用生成式人工智能。他们不只是追踪选定的边缘,而是解释身份、姿势、物体和场景结构,然后以所需的视觉语言创建新的线条艺术。这样可以实现更强的简化和更连贯的插图,但每一个眼睛、嘴巴、轮廓和背景细节都是近似的。生成结果可以保持可识别的同一个人,而无需像直接过滤器一样精确地保留最精细的相似性。
有用的问题不再是简单的“我应该使用哪种转换强度?”这是“我正在画哪种画?”我们当前的三个结果给出了不同的答案:Coloring Book 优先考虑开放的着色空间,Ink Crosshatch 添加了受控阴影,而 Sharpie Ink Sketch 将记忆转化为大胆的图形艺术品。
2026年复赛:一种来源,三种当前风格
这些是根据同一张照片制作的真实当前 FotoMedley 结果。为了演示,源和输出已放置在同一帧中,因此我们可以比较构图、相似性、纹理和空白空间,而无需不相关的裁剪更改参数。

固定源图像
原版对模型提出了很多要求:保留小表情,保留间歇泉,并决定如何处理草、树、蒸汽和云。

图画书
最清晰的着色活动。它积极地简化了草地,以自信的轮廓描绘了蒸汽,并保持了脸部的开放性和可识别性。

墨水十字线着色页
交叉阴影线恢复了森林、头发、眼睛、脖子和衬衫的深度,同时留下了天空和大部分草地的颜色。

记号笔墨水素描
最大胆的诠释。浓重的森林黑色和突出的面部标记创造了最具戏剧性的艺术作品,而且还为用户预先着色了页面的更多部分。
三人都看懂了这张照片
这是过滤器示例的重大飞跃。当前的每种风格都会识别间歇泉前的男孩,并连贯地重新绘制场景。选择不再是在模糊边缘和噪声边缘之间;而是在模糊边缘和噪声边缘之间进行选择。它介于三种有意的绘画体验之间。
按调色师选择,而不是按技术选择
| 调色师或目的 | 良好的起点 | 为什么 |
|---|---|---|
| 有蜡笔的幼儿 | 着色书或蜡笔轮廓 | 大空间、大胆轮廓、有限纹理 |
| 年龄较大的儿童或休闲成人 | 图画书或动漫 | 结构清晰,更具个性 |
| 有铅笔的耐心成人 | 墨水十字线 | 纹理支持分层和精细细节 |
| 个人纪念品或礼物 | 测试两种风格 | 相似度可能比细节水平更重要 |
进行一个小测试,实际上可以教会你一些东西
使用一张清晰的照片并制作两个有目的的变体,而不是随机的六个变体。从着色书作为基线开始。当完成的绘图比大的开放着色区域更重要时,将其与耐心的铅笔调色师的 Ink Crosshatch 或 Sharpie Ink Sketch 搭配使用。
下载两者,以相同的尺寸打印,然后将所需的蜡笔、铅笔或记号笔放在旁边。判断相似性、线条信心、开放空间和工具配合。更好的页面是有人伸手想要着色的页面。
- 1
修复一种来源和作物
- 2
选择一个基线和一个挑战者
- 3
以相同尺寸打印
- 4
每个区域一小块区域上色
判决结果
基本滤镜最忠实地保留了最精细的相似性,因为它们继续使用原始的摄影几何形状。他们不能很好地决定哪些准确的边缘应该成为强线,哪些纹理应该消失,以及调色师需要在哪里打开纸张。当前的生成人工智能接受改变细节的小风险,以换取编辑和风格控制。在本次测试中,Coloring Book 生成了最吸引人的着色页,Crosshatch 平衡了着色空间与建模细节,Sharpie 生成了最强的成品插图。出于着色的目的,这种权衡通常是非常值得的。
对一张照片进行公平测试
从着色书开始,添加为调色师选择的一种风格,然后打印两者,然后再决定哪个结果获胜。
在样式实验室中比较样式