LLMStart|持续课程 · 不追玄学
4 个单元
阶段四 · 拓展与责任 4 个单元

模块 6:多模态 AI

这个模块解释文本、图像、音频、视频如何进入 AI 系统。学习者需要理解多模态的价值,也要知道它在评估、版权和产品体验上的麻烦。

已学 0 / 4 节0%

学习目标

学完本模块后,学习者应该能够:

  • 解释多模态模型是什么。
  • 区分图像理解、图像生成和图像编辑。
  • 理解 OCR、视觉问答、视频摘要等常见能力。
  • 判断什么时候真的需要多模态。
  • 识别多模态应用的评估和版权风险。

单元列表

模块作业

多模态产品的价值与风险判断

把本模块的学习目标变成一次可提交、可评分的真实任务。

查看作业 →