Toucora API
🌐 语言

集成

Codex 与 AI 编码智能体:用文字稿 API 读取视频

Codex 等 AI 编码智能体如何把 YouTube 文字稿 API 当作工具:把演讲和演示变成可引用的上下文。

Toucora 团队 · 2026-09-30 · 5 分钟阅读

视频作为智能体的上下文

Codex 及类似智能体擅长对可检索文本推理。文字稿 API 给它们一个干净的视频文本视图,于是录制的演示成为和文档一样的信息源——可搜索、可引用、带时间戳。

作为工具暴露

把文字稿端点包装为带两个参数的函数或 MCP 工具:视频 ID 和可选语言。返回结构化片段,让智能体能引用某个时刻。准确描述成本与限制,避免它在循环中调用。

实用模式

先检索再推理:获取文字稿、分块,让智能体在其中搜索,而非全部加载。按视频 ID 缓存,避免重复提问消耗额度。记录 request id,并把类型化错误作为智能体能解释的工具结果返回。

常见问题

Codex 能直接调用 API 吗?

可以,通过函数工具或包装文字稿端点的 MCP 服务器。

如何控制成本?

按视频 ID 缓存、限制文字稿大小,并在工具 schema 中说明限制。

时间戳会保留吗?

会。结构化输出保留每个片段的开始与时长,因此智能体能引用准确时刻。

继续阅读

指南 什么是 YouTube 文字稿 API(以及何时需要它)? 6 分钟阅读 Python Python 中的 YouTube 文字稿 API:5 分钟快速上手 7 分钟阅读 集成 给 Claude Code 一个 YouTube 文字稿 MCP 服务器 6 分钟阅读

用视频试用 API

创建免费开发者密钥,一分钟内获取你的第一份文字稿。

获取 API 密钥 →