模块 6:多模态 AI
这个模块解释文本、图像、音频、视频如何进入 AI 系统。学习者需要理解多模态的价值,也要知道它在评估、版权和产品体验上的麻烦。
学习目标
学完本模块后,学习者应该能够:
- 解释多模态模型是什么。
- 区分图像理解、图像生成和图像编辑。
- 理解 OCR、视觉问答、视频摘要等常见能力。
- 判断什么时候真的需要多模态。
- 识别多模态应用的评估和版权风险。
单元列表
模块作业
多模态产品的价值与风险判断
把本模块的学习目标变成一次可提交、可评分的真实任务。
查看作业 →这个模块解释文本、图像、音频、视频如何进入 AI 系统。学习者需要理解多模态的价值,也要知道它在评估、版权和产品体验上的麻烦。
学完本模块后,学习者应该能够:
把本模块的学习目标变成一次可提交、可评分的真实任务。
查看作业 →