集成
Codex 与 AI 编码智能体:用文字稿 API 读取视频
Codex 等 AI 编码智能体如何把 YouTube 文字稿 API 当作工具:把演讲和演示变成可引用的上下文。
Toucora 团队 · 2026-09-30 · 5 分钟阅读
视频作为智能体的上下文
Codex 及类似智能体擅长对可检索文本推理。文字稿 API 给它们一个干净的视频文本视图,于是录制的演示成为和文档一样的信息源——可搜索、可引用、带时间戳。
作为工具暴露
把文字稿端点包装为带两个参数的函数或 MCP 工具:视频 ID 和可选语言。返回结构化片段,让智能体能引用某个时刻。准确描述成本与限制,避免它在循环中调用。
实用模式
先检索再推理:获取文字稿、分块,让智能体在其中搜索,而非全部加载。按视频 ID 缓存,避免重复提问消耗额度。记录 request id,并把类型化错误作为智能体能解释的工具结果返回。
常见问题
Codex 能直接调用 API 吗?
可以,通过函数工具或包装文字稿端点的 MCP 服务器。
如何控制成本?
按视频 ID 缓存、限制文字稿大小,并在工具 schema 中说明限制。
时间戳会保留吗?
会。结构化输出保留每个片段的开始与时长,因此智能体能引用准确时刻。
继续阅读
用视频试用 API
创建免费开发者密钥,一分钟内获取你的第一份文字稿。
获取 API 密钥 →