新课程:构建AI agent生成图像和视频,学习评估技巧
新课程:构建能够生成图像和视频的AI agent——一个尚未充分探索的前沿领域。性能的关键在于让agent评估自身输出,并通过迭代提升质量。本课程与@googlecloudtech合作开发,由Katie Nguyen和Wafae Bakkali讲授。
你将学习三种评估技巧,并将它们结合到agent中:图像-文本相似度评分以检查输出是否匹配提示,一个LLM评判器根据自定义标准(如品牌一致性)进行评分,以及将提示分解为可验证的是/否问题(如“主体是否在画面中?”和“摄像机运动是否匹配?”)的结构化评分规则。
你将获得的技能:
- 学习图像和视频提示工程
- 构建一个将品牌指南转化为UI模型图的图像agent
- 构建一个规划多场景解说视频并同步音频动画化参考帧的视频agent
加入我们,构建能创建图像和视频的agent!
https://t.co/bjuSjIxcIG
你将学习三种评估技巧,并将它们结合到agent中:图像-文本相似度评分以检查输出是否匹配提示,一个LLM评判器根据自定义标准(如品牌一致性)进行评分,以及将提示分解为可验证的是/否问题(如“主体是否在画面中?”和“摄像机运动是否匹配?”)的结构化评分规则。
你将获得的技能:
- 学习图像和视频提示工程
- 构建一个将品牌指南转化为UI模型图的图像agent
- 构建一个规划多场景解说视频并同步音频动画化参考帧的视频agent
加入我们,构建能创建图像和视频的agent!
https://t.co/bjuSjIxcIG