首页技能排行GLM 视觉视频问答

GLM 视觉视频问答

· 累计使用人次 6

基本信息

名称(name)GLM 视觉视频问答
简介(displayDescription)
基于智谱GLM-5.3-Flash视觉大模型的视频理解与问答(video RAG)。当用户提到视频、录像、mp4、监控、游戏录像、影片、动画,并想提问、查找、定位、总结或理解其内容,或问"什么时候发生的"、"某一秒在干什么"、要时间戳定位、片段回放时,使用本skill。支持剧情理解、事件时间线、OCR字幕/HUD识别;回答带 [MM:SS] 时间戳引用,并生成可播放片段与关键帧展示给用户。无音频分析能力。(GLM 版本;DeepSeek 版为 deepseek-v4-flash-vision-video-rag)
分类(categories)个人创业开发工具内容创作
累计使用人次6
版本(version)1.0.0

每日记录

本条目按天记录的使用人次。共 1 天 —— 满 2 天后会显示日增。
日期累计使用人次日增
2026-09-23 6

同类排行

返回 技能排行 查看完整榜单与分类筛选。