完整的口述文本
AllyHub 会拉取视频的字幕轨道,返回说过的每一行——不是摘录,不是精选引语,而是完整内容,作为可供你处理的连续文本。
获取视频实际说出的原话——带标点、带时间戳,可直接引用,适用于单个视频或整个历史内容库。
自动字幕文件从最严格意义上说就是转录文本,但在实际中无法使用——没有标点,断成半行。AllyHub 会将其还原为可读的连贯文本,并完整保留时间码;可一次性处理整个频道,因此结果从头到尾都可搜索,而且无需 YouTube API 或代码即可完成。
AllyHub 会拉取视频的字幕轨道,返回说过的每一行——不是摘录,不是精选引语,而是完整内容,作为可供你处理的连续文本。
每个段落都保留其来源时间码,因此你摘取的引语可以追溯回原始视频中的精确秒数。
自动字幕以没有标点且词语重复的片段形式出现。AllyHub 会恢复句子和段落,因此得到的是连贯文本,而不是一整面字幕提示。
将其指向一个频道或播放列表,它就会逐项处理列表,为每个上传视频返回一份转录文本——无论是三个视频还是三年的上传内容,都是同样的工作。
可获取视频发布的所有字幕轨道,或要求以另一种语言提供转录文本——当源语言是你读不懂的语言时很有用。
可获取为 TXT、Doc 或电子表格,每行及其时间码各占一行——提出请求时说明要哪种,即可完全跳过复制粘贴。
从视频链接到可引用、带时间戳的文本——三步完成 YouTube 转录文本提取。
粘贴视频、播放列表或频道,并说明你想要原始逐行文本、清理后的连贯文本,还是两者并排呈现。
它会拉取字幕轨道并返回文本、逐行时间码、字幕语言以及是否为自动生成,另外还有视频标题、频道和上传日期。
将其导出,放入你的笔记或 CMS,交给摘要工具,或保留设置,以便下次上传只需一行。
大多数提取器只是把字幕文件倒出来就算完成。AllyHub 输出的内容已经可以直接粘贴。
.jpeg&w=1920&q=75)
.jpeg&w=1920&q=75)
AllyHub 读取视频发布的字幕轨道;它不会聆听音频。因此,自动生成的轨道会带上 YouTube 识别器听错的任何名称和数字——引用前值得扫一眼,而且当轨道是创作者自己上传的字幕时,知道这一区别也很重要。
.jpeg&w=1920&q=75)
编辑、研究人员、内容团队和本地化人员,他们需要的是原话本身,而不是对原话的转述。
你在寻找值得剪成短视频的那四十秒,却在两小时直播里来回拖动进度条。改为阅读文本,标记出彩时刻,然后直接从这些标记处截取片段。
如果没人能指出出处,演讲中的引语经不起编辑。获取带时间码的文本,引用到秒,让事实核查员一键定位到那句话,而不是去看完整录像。
数小时的精彩讲解被锁在没人观看的视频里。将历史内容库转换为文本,你可以将其改写为文章、帮助中心页面,或搜索引擎真正能索引的知识库。
翻译视频要从一份你没有的源文件开始。提取创作者发布的内容,获取带时间码的干净文本,交给译者作为工作基础,而不是一个链接。
关于字幕、格式以及大规模处理时会发生什么的快速解答。
YouTube 转录提取器接收一个视频,并返回其中所说内容的文本。AllyHub 读取已发布的字幕轨道,恢复标点和段落,保留时间码,并可在单次运行中处理整个播放列表或频道。
是的——在免费方案中,单个视频的转录文本不收费。全频道运行、翻译输出和批量文件导出属于付费方案。
那就没有可读取的内容。提取的是上传者提供的任何轨道——包括大多数视频都有的 YouTube 自动生成轨道——因此关闭字幕的片段会返回空结果,而不是靠猜测,并且 AllyHub 会列出它跳过的项目。
TXT 用于纯阅读,Doc 用于编辑,或电子表格,其中每一行都位于自己的行中,旁边是它的时间码。批量处理时,可按每个视频一个文件返回,也可全部合并,取决于你的要求。
可以——文本提取出来后,可在同一次运行中要求生成学习笔记、主题大纲或重点引语,它会基于转录文本工作,而不是从头开始。如果你只想要精简阅读版,且不在意具体措辞,YouTube Video Summarizer 是更短的路径。
大多数提取器原样返回字幕文件,并把第十个视频和第一个视频完全一样对待。AllyHub 会清理文本、保留时间码、无人值守地处理整个频道,并记住你的格式——因此每次运行都会更快。