以编程方式使用文档

Supadata

本页面介绍如何使用 Supadata LangChain生态系统。它允许您从YouTube、TikTok和其他平台加载数据。

安装和设置

要使用Supadata,您需要安装独立的集成包。

pip install supadata-langchain

文档加载器

Supadata集成允许您将各种视频平台的内容作为LangChain文档加载。它支持获取字幕和元数据。

from supadata_langchain import SupadataLoader

os.environ["SUPADATA_API_KEY"] = "YOUR_API_KEY"

loader = SupadataLoader()

# Fetch Transcript
docs = loader.load(
    {
        "url": "[https://www.youtube.com/watch?v=dQw4w9WgXcQ](https://www.youtube.com/watch?v=dQw4w9WgXcQ)",
        "operation": "transcript",
        "lang": "en",
        "text": True,
        "mode": "auto",
    }
)

print(docs[0].page_content)
print(docs[0].metadata)

元数据

您还可以获取视频结构化元数据。

# Fetch Metadata
docs = loader.load(
    {
        "url": "https://www.youtube.com/watch?v=dQw4w9WgXcQ",
        "operation": "metadata",
    }
)

print(docs[0].page_content)

资源

有关详细的使用示例和API文档,请参阅 官方GitHub仓库.