如何获取当前视频画面,交给 AI 分析以辅助学习?
在线教育、知识付费等场景中,学员观看课程时,可能希望对当前画面中的公式、图表、课件或操作步骤进一步提问。例如:“这道题应该怎么理解?”“请总结这一页的知识点。”
可通过点播播放器的截图能力获取当前视频画面,由业务系统将图片提交给支持图片理解的大模型,再把分析结果展示给学员,实现围绕课程画面的辅助讲解。
一、适用于哪些学习场景?
- 课件解读:截取当前课件,辅助提取重点、解释概念或整理知识点。
- 题目讲解:截取视频中的题目、公式或解题过程,结合学员的问题进行分析。
- 图表分析:截取课程中的图表或示意图,辅助理解其中的信息和关系。
- 软件操作学习:截取当前演示画面,围绕菜单、参数或操作步骤提出问题。
以下为业务应用场景示意:学员可在观看课程时截取当前画面,发起提问或获取辅助讲解。图中的智能讲解、截屏提问、智能笔记等 AI 功能由业务方结合播放器截图能力与大模型服务自行接入,具体界面及效果以业务实现为准。
二、如何实现?
以 uni-app 教育 App 为例,可在课程播放页增加“提问 AI”或“分析当前画面”入口,由开发人员接入以下流程。接入前,请确认所用播放器或插件版本支持直接获取截图图片数据,具体调用方式以对应版本的接口说明为准;如现有文档仅说明保存到相册,请联系技术支持确认适用版本与接入方式。
- 获取当前画面:学员点击入口后,业务侧调用播放器截图接口,获取当前视频帧的图片内容。
- 上传图片:将取得的图片上传到业务服务器或图片存储服务,获得可供大模型访问的图片链接。
- 提交分析请求:业务服务器将图片和学员的问题一起提交给支持图片理解的大模型。例如:“请根据这张课件,解释图中公式的含义。”
- 展示分析结果:将大模型返回的解释或总结展示在学习页面中,供学员参考和继续提问。
建议同时记录视频 ID 和截图对应的播放时间,方便学员回到原课程位置复习。
三、为什么需要直接获取图片内容?
该场景需要将截图交给后续业务流程处理,因此应使用能够返回图片数据的截图能力。
如果截图功能仅将图片保存到手机相册,业务系统仍需另外读取或选择图片,才能继续上传和分析。直接获取图片内容,可将截图、上传和 AI 分析串联在同一次操作中。
四、截图会包含播放器按钮和进度条吗?
该场景应获取视频当前帧画面,不包含播放器的播放、暂停按钮或进度条等操作控件,便于大模型聚焦课程内容。接入时应确认所用截图接口的输出符合这一要求。
它与手机系统截屏不同:系统截屏通常会同时截取页面上的聊天区、导航栏和其他界面元素。
五、播放器会自动完成 AI 分析吗?
不会。播放器截图能力负责获取视频画面;图片上传、大模型调用、提问入口及结果展示,需要由业务系统自行接入。
大模型应支持图片输入,并能够访问提交的图片。若图片链接有访问限制或有效期,需要确保模型在分析时可以读取。
六、使用时需要注意什么?
- 单张图片只包含当前画面。 如果问题依赖讲师前后的语音讲解或操作过程,建议补充相关文字背景,避免仅凭一张图得出不完整的结论。
- 截图能力受播放环境及内容保护规则限制。 对于 DRM 等受保护内容,应以对应 SDK 的实际支持范围为准;截图失败时,业务侧需提示学员并处理错误。
- AI 分析用于辅助学习。 对公式、题目和专业知识的解释,应结合原课程内容核对。
- 确认课程内容的使用范围。 将课程截图提交给第三方大模型前,应确认具备相应授权。



