Ben Affleck 自称会写 Python、懂 CNN 与 GPU,还借名气私下参观 Google 和 OpenAI 视频模型
RT @firesidealpha:本·阿弗莱克(Ben Affleck)透露他会写 Python、了解卷积神经网络、大量接触过 GPU,并利用自己的名人身份获得私下参观 Google 和 OpenAI 视频模型的机会
“我从小就有点迷计算机。后来,当电影从模拟胶片转向数字时,我对这一块更感兴趣了。很多年来,视觉特效的工作流程里就包含机器学习,所以我能写点相当烂的 Python 脚本之类的东西。
“卷积神经网络是 transformer 能力的前身,而 transformer 能同时进行多得多的计算。你会做的是查看所谓的张量(tensor)。那就是把视觉图像用数字表达出来,比如批号、帧号,以及每一帧里每个像素的红、绿、蓝数值。就这么简单。那个数字组合就叫张量。
“你会用卷积神经网络来识别一些模式,从而实现所谓的边缘检测或特征提取——也就是把模式识别得足够清楚,知道‘这里是窗台边缘’,这样我们就能更容易地把绿幕画面抠出来,换成别的东西。
“这些我很早就熟悉了,因为在 Artists Equity 之前,我有一家小型视觉特效公司。我也大量用过 GPU。做视觉特效的人跟我说:‘嘿,你应该去看看。有几家——Google 和另一家叫 OpenAI 的公司——在用 transformer 做视频方面做很有意思的事。’
“我发现我其实可以直接打电话过去说:‘嘿,我是本·阿弗莱克。我能来看看你们在做什么吗?’有时候他们真的答应了,这让我很惊讶。”
“我从小就有点迷计算机。后来,当电影从模拟胶片转向数字时,我对这一块更感兴趣了。很多年来,视觉特效的工作流程里就包含机器学习,所以我能写点相当烂的 Python 脚本之类的东西。
“卷积神经网络是 transformer 能力的前身,而 transformer 能同时进行多得多的计算。你会做的是查看所谓的张量(tensor)。那就是把视觉图像用数字表达出来,比如批号、帧号,以及每一帧里每个像素的红、绿、蓝数值。就这么简单。那个数字组合就叫张量。
“你会用卷积神经网络来识别一些模式,从而实现所谓的边缘检测或特征提取——也就是把模式识别得足够清楚,知道‘这里是窗台边缘’,这样我们就能更容易地把绿幕画面抠出来,换成别的东西。
“这些我很早就熟悉了,因为在 Artists Equity 之前,我有一家小型视觉特效公司。我也大量用过 GPU。做视觉特效的人跟我说:‘嘿,你应该去看看。有几家——Google 和另一家叫 OpenAI 的公司——在用 transformer 做视频方面做很有意思的事。’
“我发现我其实可以直接打电话过去说:‘嘿,我是本·阿弗莱克。我能来看看你们在做什么吗?’有时候他们真的答应了,这让我很惊讶。”