蚂蚁隔壁班 · 分享会实录

制造《新美国人》如何凭空创作一部AI摄影集-朱朝晖分享会实录

分享会配图

海报设计:二姑娘

蚂蚁隔壁班-- 朱朝晖在线分享会声音版

语音整理:玫瑰之上

大家好,我是朱朝晖。非常感谢令胡歌老师的邀请,也非常荣幸在2024年的起始,和各位分享我去年完成的一部AI摄影集《新美国人》。

我先作个自我介绍,我叫朱朝晖。我把自己定义成非职业摄影师。我的职业是编辑,在一个叫“读库”的文化出版公司工作,简单地说,我是一个做书的。在我看来,非职业意味着不靠摄影吃饭,它既等于业余也不等于业余。在汉语里,业余有双重意思,一个是非职业,还有一个是不专业。我确实也不认为自己的摄影不专业,今天想分享的,可以说是我在业余时间干的一件不算业余的事儿。

接下来让我们直奔主题,围绕我去年完成的一部AI摄影集《新美国人》。您可能零零星星看到过《新美国人》的一些内容,在《读库》的首发内容,实际上也并不是完全版本,而且结构也相应有略微调整。今天的分享,因为技术条件限制,无法用PPT来同步展示。所以我把《新美国人》的完整内容,做了一个大概两分多钟的小视频。我现在分享视频,让您对这部摄影集先有一个整体印象。

已关注

关注

重播 分享 赞

关闭

观看更多

更多

退出全屏

切换到竖屏全屏退出全屏

蚂蚁摄影已关注

分享视频

,时长02:48

0/0

00:00/02:48

切换到横屏模式

继续播放

进度条,百分之0

播放

00:00

/

02:48

02:48

倍速

全屏

倍速播放中

0.5倍 0.75倍 1.0倍 1.5倍 2.0倍

超清 流畅

您的浏览器不支持 video 标签

继续观看

制造《新美国人》如何凭空创作一部AI摄影集-朱朝晖分享会实录(12000字)

观看更多

原创

,

制造《新美国人》如何凭空创作一部AI摄影集-朱朝晖分享会实录(12000字)

蚂蚁摄影已关注

分享点赞在看

已同步到看一看写下你的评论

视频详情

这部摄影集是我和AI合作完成的,所以我想这次分享会也由我和AI合作完成。在合作完成摄影集的过程中,基本上是我来提问,由AI来回答,那么这次我想把角色反转一下,由AI提问,由我回答。AI生成的问题,我会逐一展示给大家。

AI:在你的观点中,《新美国人》的首要特征是书籍,而AI生成的影像只是其中的一部分。人们在概念上如何更加接受AI生成的影像?

这是AI提出的第一个问题。关于这个问题,我想从一个典型凡尔赛的八卦开始回答。

这部摄影集在完成的第二个月,就得了一个国际摄影奖:IPA专业组AI影像类第二名。可我觉得它该得第一,至少有得第一的实力。

参加这个评选是个非常偶然的事。我做完这部摄影集以后灵机一动,该拿它参加个摄影比赛,而且应该是国际比赛那种,是骡子是马拉出去遛遛,按所谓国际标准和国际规则,看看这部摄影集的价值到底有多少。于是我就上网搜了一下,发现IPA正在进入年度评选的最后截止期的延长期。我就把素材按参赛要求简单整理了一下,在“最后的最后”的截止期最后一天把它送出参赛了。然后非常快,大约两三个星期后,我就收到了评委会主席的贺信,作品已经正式进入评委TOP5候选名单了,同时还发给我评委撰写的作品评语。

分享会配图

评委大致的意思是:“永远别把话说得太绝对。我几乎没有办法想象,有一天我自己竟然为人工智能作品鼓掌,但这确实发生了。新书的设想是这么简约和优雅,完成度又如此之高,以至于感觉进入了一个现实的平行世界。”

我觉得这个评语还挺受用的。但隔了两个星期以后,我又收到了一个评委会通知:对不起,我们的评选规则临时改了,按新的规则,您的参赛类别从摄影书类被自动转到AI影像类。

我当时参赛的类别是摄影书,临时被转到另外一个类别,当然就有点吃亏。IPA是个含金量挺高的国际奖项,能得第二名已经是非常好了,但从凡尔赛的角度,我还是有点遗憾的。

分享会配图

这是IPA的获奖页面,左侧的作品是第一名。我仔细看了第一名作品,主题是著名历史人物,包括弗里达、达利,还有希区柯克等,身处各自的标志性场景里。总之是具有典型特征的AI创作。

于是我就想,如果弗兰克当年拿自己的《美国人》作品去参加摄影比赛,他能不能获得第一名?然后我就想通了。

这里有个小插曲,我收到评委会的转类别通知后,还给评委会回复了一封信,进行申诉和说明。信的大致内容是:《新美国人》作为一本摄影书,图像只是其中的一个组成部分,它和策划、编辑、设计、印刷等构成一个整体,缺一不可。《新美国人》的首要特征是书,AI只是它的第二特征。

这也是我想在第一个问题里,用得瑟的方式来说明,AI作品形式的摄影集和摄影集形式的AI作品,它们各自的落点是不同的。

AI:在摄影创作中,你如何平衡“好奇心态”和“严肃创作”的需求?

这个问题事关AI创作的意义,我觉得非常重要。

《新美国人》还在设想阶段没成型的时候,我和艺术评论家袁园老师有过一面之缘。那天大家都喝高了,更加百无禁忌去聊AI摄影。袁园老师问我:“你认为你是一个玩家,还是一个专业选手?”酒醒了以后,我想了非常长的时间,袁园老师定义的这个所谓玩家,意味着什么?AI影像刚刚兴起的时候,玩家心态是非常正常也非常普遍的。这个心态的背后,是好奇心、娱乐心,和得瑟心:“太好玩儿了”“太可笑了”,和“你看我多牛X啊”。作为创作者都明白,这些心态一定会从作品中透露出来,是藏不住的。所以袁园老师所问的“是不是一个专业选手”,背后意味着严肃创作,而严肃创作必须快速越过玩家心态。

《新美国人》完成以后,有很多正面评论在此略过,我想说说两种比较集中的负面评论:第一,既然是用AI,这有什么难的呢?第二,为什么要用这么多张照片,其实几张不就可以了?看到这样的评论,其实心里还是会小小得意一下:要不你来试试看。

实际上,所有摄影师在进行摄影创作的时候,面临的第一个问题都是一样的,就是拍什么。有了AI作为辅助之后,或者作为合作者之后,我面临的第一个问题,就是生成什么。两者的本质其实是一样的,我们知道AI影像是通过提示词完成的。如果我把这个提示词写成:“请模仿《美国人》的风格,生成一组照片”,在我看来没有任何意义。

做《新美国人》这件事儿,在我看来需要基于几个理解:一是对弗兰克摄影集《美国人》的理解;二是对当代美国的理解;三是对影像的个人理解;四是对AI在现有发展阶段的理解。而且这些理解在我看来,不能停留在弗兰克那个时代。在《美国人》之后,世界已经进步了六七十年,观念也进步了六七十年。如果我们让时光倒流七十年,复原弗兰克那个时代的场景,在我看来也没有什么意义。

但是AI让这件事另有意义。让我们想想看,如果一百年后回看现在所处的2020年代初始阶段,会发现有这些重大事件发生,比如新冠,俄乌战争,巴以冲突,还有AI进入奇点。那么在一百年后,这些重大事件的排序会是什么?在我看来,AI 进入奇点才是这一历史阶段第一意义深远的事件。任何大时代都将一去不返,事过之后做得再好,只能算情景再现。与时代进程同步完成创作,没有比这更严肃的了。

我想通过这些说明,做《新美国人》这样一部AI摄影集,它的意义坐标在什么位置。

AI:选择徕卡Monochrom相机和特定镜头进行拍摄,这个决定如何体现你对作品主题和致敬的选择?

我看的摄影集不算多,至少在我目力所及范围内,和《美国人》同等分量的摄影集,在弗兰克之后是并不多见的。为什么会是这样,这有什么难的呢?我们不妨分析一下弗兰克当年创作《美国人》的前提条件。

第一,弗兰克不仅仅是一个优秀的摄影师,他同时是一个优秀的图片编辑。我们知道摄影师和图片编辑是完全不同的行业,他们的视角几乎是完全不相同的,甚至在一定程度上,两者之间还存在互斥。所以,集摄影师视角和编辑观念于一身,这样的人其实并不多见。这也是《美国人》的成功关键之一。

第二,摄影师需要长期待在美国,这样才能对美国有深入的理解,同时最好还是一个外国移民,这样才能有一个旁观者的冷静视角。

第三,我们知道《美国人》的创作时间跨度,大概是两到三年。完成同等体量的一部摄影集,需要至少预留一年以上的创作档期。

第四是资金方面。弗兰克创作《美国人》,得到了古根海姆基金会的支持。完全凭个人财力,用爱发电去完成这样一件事儿,在现实中是很难的。

第五,最好还得有一部徕卡相机。弗兰克当年用徕卡完成了整个《美国人》创作,他是徕卡控,他的作品有非常微妙的徕卡特征。用别的相机拍摄当然可以,但既然是致敬,靠的不就是那点儿微妙么。

这是一个很粗陋的分析,简单地说,创作类似《美国人》这样一部摄影集,前提条件不光是有能力有想法,还得有钱有闲。

换一个角度来说,即使是弗兰克,我觉得肯定也是有局限的。首先是他的个人局限。任何人都有个人局限,拍摄题材无论怎么全面,归根到底仍然是个人视角。其次是客观局限,弗兰克也好,任何人也好,都会遇到想拍拍不到的遗憾。即使是弗兰克,当年也会有想去去不了,想拍不让拍,或者某个场景正好发生在背后,端起相机时事件已经发生完毕……等等情况。

但是AI创作的本质,就是让上面所说的这些局限都不存在了。我到现在为止从来没有去过美国,也从来没有用过徕卡,如果想创作一部《新美国人》摄影集,只有在AI时代才有可能。

我觉得也正是因为我还没有去过美国,也没有用过徕卡,才让这件事儿变得更有意思了。

AI:与1956年弗兰克的《美国人》相比,你如何传承并演化了主题和视角?AI在这一过程中的确切作用是什么?

分享会配图

这个问题有点儿抽象,我先用这张Chat GPT页面截图开始回答。

创作摄影集有几个关键步骤,第一是策划,第二是创作,第三是制作。这几个关键步骤都是我和AI合作完成的。合作的基础是我和AI的想法要同步,然后做的事儿才可能是对的。

在项目正式开始之前,我用AI做了大量测试和练习;项目开始之后,在每个阶段开始前,都要和AI进行讨论,只有形成共识并确认后,才能进到下一步。我用几个比较典型的截图来说明这个问题。

分享会配图

这里用了一个典型AI提问技巧,让AI假设自己是弗兰克,时空穿越到当代美国,拍一部叫《新美国人》的摄影集。也就是让AI想象,如果是弗兰克本人,他会如何拍摄。我觉得AI回答得挺好的。实际上,我问了多次类似问题,这轮回答相对更符合我的想法和需求。基于这个回答,我才能开始下一个问题。

分享会配图

这轮问答让AI再次进行角色转换,从弗兰克切换成AI自己,不依赖任何实体工具完成任务。这个问题的目的,是探测AI对自身能力的理解判断,确认AI能不能充分且准确地运用自己的无边法力。

《新美国人》的设定是2020年代的美国,这里有几个非常重要的点。

首先是摄影集的标志有哪些?我们知道《美国人》中有几个典型标志,在书里不断循环出现。比如说国旗,比如说汽车。在弗兰克那个年代,这就是美国的标志,那么在当下,美国的标志是什么?当然,国旗仍然是非常重要的标志,但还会有弗兰克时代没有的一些新标志,比如手机。

那么我们继续分析,《美国人》和《新美国人》的主题和背景有哪些异同呢?从《美国人》开始,有一些恒定的主题,比如穷人和富人,白人和黑人,在之后的同类摄影集里几乎都会出现。到《新美国人》的时候,贫富问题和种族问题仍然存在,但和当年相比已经有了变化。比如种族问题,在弗兰克的那个年代,主要是白人、黑人之间存在的问题。但当代美国的种族问题,除了“黑命贵”,还有穆斯林问题,拉美裔问题、亚裔问题。除了种族问题,还有“彩虹”问题,枪支问题,毒品问题,甚至还有新冠问题等等。所以从这个意义上说,《新美国人》的主题背景,其实比弗兰克年代更加宽泛。

分享会配图

这是AI想象的《新美国人》场景,实际上是在《新美国人》创作预备期,对AI的试探。但如果完全依赖AI想象,是创作不出《新美国人》的。

分享会配图

这轮对话,是基于AI的一个错误。它在上一轮回答中说,弗兰克会把多张照片组合在一个页面上。我们知道弗兰克显然不会这么干,一页一幅图是他的典型标志。所以我会纠正AI,直到AI接受并相应修正。

分享会配图

当然AI并不是言听计从,这也是让我欣慰的一点,让我不至于陷入信息茧房,反思是不是自己错了。例如这段关于器材的争论,AI说的有道理,只是没理解我的小心思罢了。

AI:摄影集中的场景设置涉及路线、日程、气候、节日等因素,这些因素如何在最终作品中体现出来?

其实在完成这个项目的过程中,我和AI有过无数拉锯式的讨论和争论,只是从完成品中看不出而已。

分享会配图

这张截图显然发生在上个关于拍摄器材的争论之后,此时AI已经接受了我对使用徕卡的特别要求,同时给出了拍摄时间和拍摄路线。

分享会配图

这张从知乎转帖的图,显示了弗兰克当年的拍摄路线。显然,AI设定的拍摄路线,比弗兰克走过的地方要多得多。换句话说,如果弗兰克也走AI设定的路线,古根海姆基金会给的经费估计不够。

分享会配图

这是AI给出的另一个拍摄计划,但我没有采纳这个计划。

其实,无论是拍摄器材,还是拍摄日程和拍摄路线,都不可能在摄影集里直观体现。我们知道冰山理论,《新美国人》这部摄影集只是冰山露出的一角,大量内容其实都在水面之下。但这些水面之下的内容,是这个项目的底层支持。

AI:你与ChatGPT、New Bing、Claude以及Bard等工具讨论拍摄清单的过程中,如何分配任务和利用这些工具的优势来完成工作?如何确保清单符合拍摄主题?

在完成拍摄清单阶段,实际上我用到了四个工具:ChatGPT、New Bing、Claude和Bard。这四个都是主流GPT工具,理论上用其中任何一个就可以完成任务,但是我为什么会用到四个呢?因为在实际过程中,我发现,每一个工具都无法独立完成我所要求的拍摄清单。我们知道,新必应背后搭载了ChatGPT-4,已经非常先进了,而且完全免费。但用多了就明白,它的问题是不能干大活儿,作为测试和练习,没有任何问题,但一旦要进入正式创作,就会发现它的能力其实非常有限,而且越来越显现出讨好型人格,也就是,它给出的答案,更倾向于猜你喜欢的那个,而不是最好的那个。

所以我主要用的是原生版本的ChatGPT-4,它是完成拍摄清单的主力工具。那么为什么还会用到Claude呢?Claude是ChatGPT的早期开发团队另起炉灶,和ChatGPT对标的产品,它的强项是处理长文件,号称可以一次处理10万个token,也就是几万字的文字量。我给AI设定的任务目标是完成100个场景的拍摄清单,如果每个场景100字,那也有上万字的体量。但实际情况是,我还是过于乐观了,ChatGPT-4和Claude都无法一次完成任务,在处理三五十个场景后,就会出现重复、混乱,甚至所谓幻觉,Claude只是比ChatGPT-4强些有限。而Bard在当时的独家优势是图像识别,我用它分析《美国人》原作的影像特征。

所以,最终的拍摄清单,是在四个工具间反复横跳,分期分批合成的。

去年6月,我和读库的小伙伴们做了一次关于如何应用ChatGPT的内部交流,就以《新美国人》为例。那时候,这部摄影集还没有正式完成一张照片,还在整理和补充拍摄清单阶段。但我心里基本上有数,这个项目能成了。

分享会配图

这张截图来自那次分享的内容,干货还是挺多的,运用了如何与ChatGPT合作的一些关键技巧。例如把一个总任务分解成子任务,分步骤执行。实际上我把产生100条提示词这个目标分解成了14个子任务,每个步骤先讨论并确认,确认以后再进行下一步。如果我发现有分歧,就停下来继续讨论,直到意见统一。否则,就会越往后越走样,以至于最后得到的却不是当初想要的。

您或许留意到,截图的指令是1.0版,其实最终执行的是6.0版,经过了多次所谓迭代升级,每轮都在优化和除Bug。我在本科时辅修计算机,编过程序,写ChatGPT指令有点让我重回当年编程的感觉,只是由机器代码变成自然语言。

为什么分享1.0版而不是最终版本,不是因为保守,也不是因为保密,而是1.0版反而更具有借鉴意义,可以用它举一反三。

分享会配图

AI最终完成了大约两百个场景,转换为提示词后,加起来不过几千字,但在实际操作中,当时任何一个主流GPT工具,包括Claude号称可以处理10万个token,完成三四十个场景都是极限,然后就会出错。这张截图显示,在第十五轮对话时,AI就忘了之前干过的事,重复场景开始出现。我问它为什么,它说我也不知道。

分享会配图

这张截图更加离谱。勉强完成了60个场景,它开始罢工了。

分享会配图

它甚至还会敷衍我,说这件事太复杂了,我得需要一段时间来完成。我问它需要多少时间,它说得需要几天。对于一个即时对话的GPT,几天后我去哪找它呢?它竟然说,可以把答案用email发给我。然后我还真把email给它了,但是结果当然是:没收到。

分享会配图

显然,面对我的纠缠不休,它已经不耐烦了:“请问你还有其他问题吗?”

分享会配图

其实场景40才是AI想象的常态。拍摄清单产生的过程,就是不断剔除糖水大甜片的过程。如果说AI想象的场景也有思维定式,那么纯洁美好就是它的定式。这没什么不对,但不符合我的要求。

分享会配图

可AI是我的合作者,我得靠它干活,所以得争取说服它。可我又在一开始就要求它不要依顺我的意见,要保持独立思考。所以有时讨论就成了争论,争论不成就得强迫,它不同意也得同意。所以,我完全是自作自受。

分享会配图

让ChatGPT完成任务的另一个技巧是在几个关键节点,让它进行自我评估。它对自己完成的初步拍摄清单进行自我评估后,认为缺点是“忧郁情绪过重”。

分享会配图

于是我们又争论了一下。好在这次它坦然接受了我的意见。

从项目正式动手到完成拍摄清单,一个半月就这么过去了。

AI:你说ChatGPT和Midjourney似乎一致地产生了“太甜了”的图片,又强调生成图片过程中没有使用Photoshop,同时没有进行“喂图”。你如何对待和挑选从Midjourney生成的图片?

如果把《新美国人》看作一个小小的系统工程,那么用提示词生成影像,也就是所谓文生图,只是这个系统工程的一个局部,甚至不是唯一关键。我在这个步骤,实际上用了两个工具,一个是Midjourney,还有一个是Dall·E。和前面ChatGPT其实是指四个工具一样,这里Midjourney也只是泛指。那时Dall·E还在2代,生成的图片存在各种显而易见的问题,但用于测试和练习是没问题的。我最主要看中的,是它完全免费。

分享会配图

这张图看起来有点眼熟。是的,它模仿了刘香成老师那张著名照片。我觉得它的完成度还是挺高的。我把这张图发在我的朋友圈里,但它当然不会出现在正式创作中。那段时间,我的朋友圈发了很多AI生成的图片,其实都是在为《新美国人》作直接或间接的准备。不用的图才会发朋友圈,这并不意味着它不好,相反正是因为好才发,只是它对这个项目不合用。我想说的是,尽管AI模仿一种风格的能力越来越强大,未来当然会更强大,但模仿没有任何意义,这才是这张图的潜台词。

用提示词生成照片,一共两周左右时间就完成了。我大致上算了一下,最终大概生成了3000张左右的备选照片,我最终选择了91张用在《新美国人》摄影集里。按照成片比来说,它的成功率是很高的,效率相对来说也是很高的,3000张素材就完成了一部摄影集。如果我没有记错,弗兰克老师当年拍摄《美国人》,他应该是拍了28000张照片,最终选择了83张。

用行话来说,摄影集里的这些图都是生图,没有经过PS。也没有经过喂图,也就是以图生图。我没有把想要生成的图,包括弗兰克老师的原作喂给Midjourney,然后让Midjourney参考然后生成。就像刚才所说,以图生图的本质是模仿,对于这个项目来说没有意义。

但我和Midjourney的合作,需要解决的问题之一,和ChatGPT是相似的,就是仍然“太甜了”,避过了初一,还得避过十五。为了保证最终结果不走样,需要时时刻刻去介入控制,有时还需要有意剔除一些所谓完美的照片。

分享会配图

比如这一张,我觉得它美到无可挑剔,所以就把它剔掉了。

分享会配图

这张我很喜欢,但也剔掉了。因为我觉得它的气息太动人了,是我的调调儿,但不是弗兰克的。弗兰克的镜头会更加冷静。

分享会配图

我也剔掉了这张。理由是它符合一张经典作品的各种标准,但是抱歉,《美国人》中的任何一张照片单独抽出来,都很难用经典二字评价。这也是我之前所说,如果弗兰克参加摄影比赛,也很难说能否获奖。

AI:你在《艺术评论》杂志发表的论文《沿着亨利·卢斯之路:影像史诗的编辑模型》中,提到了图片编辑模型在纪实影像史诗中的作用。在创作《新美国人》时,这个编辑模型如何指导你做出关于“要哪张不要哪张”、第一张和最后一张图片的选择?

这个问题实际上是关于图片编辑和图书编辑的。我曾想过是否编辑工作也由我和AI合作完成,但直到现在,AI还替代不了这部分工作,换句话说,我也不情愿把编辑的乐趣交给AI。所以编辑工作完全是我自己完成的。

AI生成了《新美国人》的所有照片之后,要哪张不要哪张,哪张是第一张,哪张作为最后一张,哪张在前哪张在后,哪两张应该前后相连,实际上都得益于我的编辑经验。我的职业是做书,做书之前是做杂志,我积累了二十多年的编辑经验,当然要把这经验用于《新美国人》。

医生很难对自己动手术。作者和编辑,摄影师和图片编辑,永远是冤家。《新美国人》是我和AI共同完成的,理论上,我是这部摄影集的1/2作者,1/2摄影师。这部摄影集的编辑工作,相当于自己对1/2的自己动刀,这种体验是非常独特的。

五年前,中国美术学院的牟森教授邀请我到他的媒介展演系完成一个长期纪实摄影实践项目,叫作“列岛·影像志”。从此每年十月,我会带着几十个学生,到东南沿海的某个岛屿,或者沿海小镇,完成20天左右的创作,从策划到拍摄。从制作到布展,指导学生全流程完成项目。通过“列岛·影像志”,我梳理出一套图片编辑模型,既适用于拍摄一个城镇,也适用于拍摄一个国家。

图片编辑模型的有关论文发表在2022年的《艺术评论》杂志,名叫《影像史诗的编辑模型解析》。我把论文的内容提要附录在此:

摄影师和图片编辑分属不同的专业领域,很少有人两者皆通且两者皆精,但任何一部摄影史诗都必须由双方协作才能得以完成。摄影史诗作为鸿篇巨制,有自成一体的结构和节奏,其复杂性使拍摄者极易迷失其中,甚至拍摄内容越庞杂、图片数量越庞大,主体形象反而可能越模糊。以上双重现实,导致许多雄心勃勃的摄影项目以失败告终。本文借助目录体和标签法,对多部经典纪实摄影集进行量化分析,梳理出一套纪实影像编辑模型。这一模型具有较高的实用性,可用于为一座城市乃至一个国家造像,是摄影师和图片编辑的通用工具。

这里提到的经典摄影集,包括尤金·史密斯的《匹兹堡计划》,沃克·埃文斯的《美国影像》,刘香成的《上海》,还有弗兰克的《美国人》。

分享会配图

把弗兰克的《美国人》中的每张照片,按类别贴上标签。

贴标签的好处是,从具体内容中抽象出来,能够更清晰地看到内容结构。

分享会配图

然后只需统计标签就可以了。比如在《美国人》摄影集里,街头场景有22个,还有7个场景发生在交通工具上,当然包括汽车上。弗兰克拍摄最多的是平民百姓,但不拍伤残人士;他的照片中有很多国旗之类标志物,但几乎没有动物。这些量化分析出来的拍摄倾向,也影响了《新美国人》的内容设定。

分享会配图

这套编辑模型,是我做《新美国人》的底气。

AI:在序言中,你为《新美国人》创造了一个虚拟作者:埃文·詹姆斯·卡特,并为他编织了一个相当详细的背景故事。这种虚拟作者的设定对于摄影集有怎样的影响?

一般顺序是先完成正文再请人写序,《新美国人》不是这样。这篇序是在确定图片清单之后、生成图片之前完成的。也就是说,AI写序的时候,任何图片都还没有生成,它依据自己想象的场景,预先“看到”了画面,又依据这些画面,写出了对应的序。

《美国人》的序是凯鲁亚克写的,我也希望能有一个和凯鲁亚克相对等的虚拟作者。AI生成的这个虚拟作者叫埃文·詹姆斯·卡特。

分享会配图

根据AI虚构的维基资料,卡特于1969年1月13日出生,是一位美国小说家、诗人、学者和文化领袖。他被广泛认为是21世纪最有影响力和创新力的作家之一。卡特的第三部作品《我与世界之间》(2015)赢得了国家图书奖非小说类奖,被《纽约时报》《华盛顿邮报》和《卫报》评为年度最佳书籍,并被美国前总统奥巴马推荐为2016年必读的10本书之一。卡特发表了两次广受关注和讨论的TED演讲:《如何写关于种族的文章》(2010),以及《我们需要多元化的书籍》(2014)。

是不是挺煞有介事的。这份维基资料当然不会出现在维基页面上,也不会出现在《新美国人》摄影集里。它也属于冰山在水面之下的那部分,但它是水面之上的逻辑基础。

《新美国人》在正式创作阶段,全程是在英文语境下完成的,当然也包括序的原生版本是英文。我请AI把其中一段译成中文,大致是这样:“《新美国人》是一部关于多样性和复杂性的摄影集。它涵盖了美国各地、各种背景、各种信仰、各种身份的人们,展示了他们的喜怒哀乐,成败与得失,希望与绝望。这些人物在书中,既有相似,也有差异;既有冲突,也有和谐;既有困境,也有奋斗。他们是美国的一部分,也是美国的全部。”

我们知道凯鲁亚克当年写《美国人》的序,写得是比较飘的。卡特写《新美国人》的序,我给它设定了比较稳的文风。实际上我得到了两个版本,一个比较飘,一个比较稳。我请中国艺术研究院的谷泉老师看,他建议用后面这个版本,和我的想法一致。

关于卡特,我还埋了一个彩蛋。卡特是1969年1月13号出生的,这是我的出生日期。

AI:《新美国人》的设计是由你自己完成的。在设计PDF版本时,你如何保持版式的一致性和视觉呈现的连贯性?

我本以为AI设定的问题是“《新美国人》是由谁设计的”,可它就是不问,直接默认是我设计的。确实,这部摄影集是我自己设计的。我说过我的职业是做书的,我对装帧设计有专业理解和专业经验。一本书从策划开始,一直到最终印制,我都有自己的把握。

作为致敬,《新美国人》的装帧设计,沿用了《美国人》五十周年纪念版的风格。整体编排主要依靠视觉逻辑,这也和弗兰克当年制作《美国人》的编辑思路一致。

《新美国人》至今还没有任何实体书,甚至也没有任何样书,它目前的完成形态就是PDF版本。这是PDF版本的几个样张。

分享会配图
分享会配图
分享会配图

封面、扉页以及向弗兰克致敬。

分享会配图

詹姆斯·卡特写的序。

分享会配图
分享会配图

摄影集的第一张和最后一张图片。

分享会配图

版权说明。

AI:摄影集中的元素来自大数据,如何确保处理方式既表现多样性又保持真实性?

下面的两个问题是关于摄影集的一些解释。《新美国人》在本质上仍然是一部纪实摄影集,这涉及对纪实摄影的理解。摄影和真实是两个概念,纪实和真实也是两个概念,这是《新美国人》创作和今天分享会的默认前提,不再展开讨论,否则需要进入另一个话题。

不同于弗兰克用相机记录他眼中所见,这部摄影集的所有影像和文本都是通过AI工具虚构的,所有人和物体均非真实存在。但这并不意味着这是一部虚构作品,相反,构成这本摄影集的每一个元素,包括影像和文本,都来自大数据,它们经过采样、过滤和重组,具有任何个体所不具备的普遍代表性。

就像我在《读库》那篇文章中说明的,书中的场景从未存在过,但在另一种意义上,它们一定存在。换句话说,这是广义的真实。

AI:你选择保留AI生成图像的细节缺陷,认为这是AI进化中的特征。这一决定对观者如何理解和感知作品有何影响?

我前面提到,这部摄影集的所有图片都是原生图,没有经过后期修饰,只根据印刷制作要求进行规范性技术处理。也就是说,它的缺陷都被我有意保留下来了。

这些缺陷包括哪些?我也举几个例子来说明。

分享会配图

比如这张封面图片,它的空间关系在现实中是不存在的。

分享会配图

图中人物存在AI生成图片典型的手指问题。

国旗是《美国人》和《新美国人》的共同意象,在摄影集里反复出现。其实,每张图片中的国旗都不准确。

但这有什么关系呢?手指问题只是AI生成影像的阶段性BUG,一旦进化修复就永远不会再犯相同错误。借用医学术语,这属于AI生成影像的“一过性”特征,有些病生就生了,之后一定会康复,而且没啥后遗症。

AI生成人物的六指错误,也只在AI进化初期才会出现,反而成了标志特征,以后可能想要也没了。

AI:《新美国人》是否考虑推出纸质版?此外,你是否已经开始着手或者思考了下一个创作计划?如果是的话,你能分享这个计划的初步想法或者方向吗?

从完成《新美国人》到现在,其实已经又过了几个月的时间,现在再来看AI影像,已经开始有退潮的迹象。Midjourney首页推荐的影像,已经让我们有审美疲劳,很难再带来炸裂式的惊喜。我自己已经有两三个月,没用Midjourney正式干点儿什么。

我本来还心有不甘,想拿《新美国人》参加荷赛,可荷赛也临时修改了规则,认为“人工智能生成的图像不是摄影”,不再接受AI作品参赛。除了荷赛,我也找不到什么比IPA含金量更高的国际摄影赛证明AI作品的价值了。

但可能这才是常态。我是一个非职业摄影师,我没有必要非怎样不可,令胡歌老师鼓励我把《新美国人》实体纸质版做出来。这事我当然想过,而且对我来说不难,但我想等一个机缘。《新美国人》是在全英文语境下完成的,我希望它的第一个纸质版,应该是全英文版,同时应该是印数非常少的限量版,仅供真正理解它的价值的少数人收藏。

这是《新美国人》以后的方向。另外在我看来,《新美国人》也适合做展览,甚至可以转成NFT。

AI问我在《新美国人》之外,有没有其它创作计划,我可以坦白说没有。Midjourney已经是进化到了V6版本了,生成的画质更好,我用V6版本生成一个更高画质的《新美国人》2.0版行不行?当然行。或者,我已经做过《新美国人》了,再做一个《新中国人》行不行?也行。但这都不是我的志趣所在。《新美国人》已经完成了,也已经定型了,其他的事情都不会为《新美国人》再加分,它的价值和使命都已经确定。这也是作为一个非职业摄影师的好处,我没想好就可以不干。

我想借此感谢几位亦师亦友的朋友和师长。一位是中国艺术研究院的谷泉老师,谷泉老师从艺术史的角度,帮我梳理了《新美国人》这件事的意义。另一位是中国美术学院的牟森老师,从构建影像史诗模型到制造《新美国人》,牟森老师都是我的引路人。还要感谢的是哲学家赵汀阳老师和《三联生活周刊》舒可文老师,这对神仙伴侣是我的偶像,在《新美国人》还在最初设想阶段,他们指导我分析这个想法在理论和逻辑上是否成立。可以说没有这几位师友的帮助,就不会有《新美国人》。

AI:《THE NEW AMERICANS》超越了传统影像界限,成为对AI和罗伯特·弗兰克的致敬。这种超越是如何体现在作品中的?

这是AI的最后一个问题。因为《美国人》是83张照片,就有人问《新美国人》为什么是91张。这个问题非常难以回答,就像一首诗是无法解释的。在我看来,弗兰克当年用83张照片,是这时候他觉得正好,这个数量不是预先确定的。简单地说,《新美国人》也一样,我觉得正好的时候,数一数图片数量是91。83和91,数量相近,但也意味着它并不是一一对应的关系。

我认为模仿和重现不是致敬。我想通过一些图片比对来作说明。

分享会配图
分享会配图

两部摄影集的封面。

分享会配图
分享会配图

两部摄影集的第一张图。

分享会配图
分享会配图

两部摄影集的最后一张图。弗兰克拍摄了陪伴自己旅途的妻儿,我选择了AI想象并生成的这样一张。

以上几张图的对比是比较直观的,书里更多的是不那么直观的呼应关系。

分享会配图
分享会配图
分享会配图
分享会配图
分享会配图
分享会配图

弗兰克当年拍了南卡罗来纳州的一间乡村理发店,向沃克·埃文斯致敬。我和AI设定了同样地点,生成了另一家理发店的场景。

分享会配图

这张照片的场景位于路易斯安那州的新奥尔良,AI认为弗兰克曾在这家酒吧拍摄过。那么我用这张照片,向当年的弗兰克举杯致意。

我不想做过多的比对和解释,否则就剥夺了读者自己发现和解读的乐趣。

通过这些照片,我想进一步说明我所理解的致敬到底是什么。如果我没有记错,苏珊·桑塔格当年评论过罗伯特·弗兰克的那些照片,她说那些模糊的形象、歪斜的水平线、不讲究的构图、随意的裁切,其实都是弗兰克故意的。

弗兰克创作《美国人》的时代,是美国《生活》杂志和玛格南图片社的时代,是布列松和斯泰肯的时代。在那个时代背景下,一个创作者如何完成属于自己的主题。是需要跳出朋友圈和舒适区的。所谓致敬,应该是致敬弗兰克的精神,用全新方式去观看世界,同时也观看自己。

这次分享,我没有谈所谓AI创作的心得体会和经验技巧,在我看来那不重要。换句话说,我想说的不是AI有多厉害,而是人类有多重要。

借此机会,我更希望对不使用AI创作的朋友也有一点参考价值。置身于AI时代,人类创作可供凭借的已经不是知识,也不是智慧,而是思想。这才是既向弗兰克又向AI来致敬的精神本质。

我的分享就到这里,谢谢大家。