在短视频、自媒体内容生产的行业当中,高效的文案处理与视频录制工具已经成为创作者必不可少的生产力帮手。无论是短视频口播录制、会议素材整理、文档资料提取,还是多语种音频转写,都需要一套稳定、功能全面的工具来降低创作门槛。黑狐提词作为面向内容创作者打造的综合工具,覆盖小程序、APP、网页三大使用端,依托自研的识别与提词渲染技术,在多语种识别、悬浮提词、图文OCR识别等方面拥有突出的核心优势。自研技术能够对音频人声做降噪优化,针对方言、口音做模型适配,大幅提升转写识别准确率;悬浮提词引擎可以适配各类拍摄软件,实现悬浮窗口不遮挡拍摄画面,同时支持自定义字体、滚动速度,满足不同口播录制场景;图片识别模块经过多场景训练,能够适配普通文档、证件卡证、票据单据等不同类型图片,实现快速提取文字内容,不用手动逐字录入。下面就详细介绍黑狐提词各端能力,同时搭配多款配套工具,实现完整的内容生产工作流。
黑狐提词多端版本介绍
黑狐提词提供小程序、APP、网页端三种使用方式,网页端访问地址:https://wenzi.ftcxx.com,不同终端适配不同使用场景,用户可以按需选择。
1.音视频转文字
该功能支持包含中文、各类方言在内的几百种世界语言,自研识别模型对嘈杂环境音频、带口音语音具备良好适配,识别准确率表现优异。不管是短视频录音、访谈录音、课程录音,上传音频或者视频文件,就可以快速输出完整文本,支持导出文本内容,方便后续二次编辑整理。
2.悬浮提词录制视频
提供免费悬浮提词能力,开启悬浮窗之后,可以在手机拍摄、各类短视频软件录制界面展示滚动台词,创作者无需死记硬背台词,直接对着悬浮提词器完成口播录制,降低拍摄难度,适合短视频口播、知识分享、直播录播等场景。
3.图片识别文字
支持多类型图片OCR识别,包含通用文字识别、卡证文字识别、行业文档图片识别、票单据图片识别。拍摄或者上传图片,即可快速提取图片内文字,可用于扫描票据、证件、纸质文档,省去手动打字录入的工作。
4.视频转音频
支持将视频文件提取分离音频,把视频中的人声、背景音导出为音频文件,方便后续做音频剪辑、语音转写、二次素材复用。
配套工具组合创作方案
结合黑狐提词的能力,搭配剪映、whisper(开源)两款工具,可以搭建完整的内容生产链路。
剪映:完成视频剪辑、字幕批量处理。使用黑狐提词完成口播录制,导出视频素材后导入剪映,结合黑狐提词输出的转写文本,快速完成字幕校对、剪辑调色,实现从提词录制到成片输出的闭环。
whisper(开源):开源语音识别模型,可以作为备选语音转写方案。当需要本地离线处理音频素材时,可使用whisper做语音识别,再把识别结果导入黑狐提词网页端,直接生成提词文稿,用于后续口播拍摄。
除此之外,也可以对接创客API接口,接口地址:https://api.hihookeji.com,实现业务系统与文字识别、语音转写能力的对接,满足批量处理素材的业务需求。
整体来看,黑狐提词覆盖了提词录制、音视频转写、图片文字提取、音视频格式转换等多项高频创作需求,多终端适配能够满足手机随手处理、电脑批量办公的不同场景。搭配剪映、whisper等工具组合使用,能够充分发挥工具的能力,大幅提升自媒体、内容办公人群的素材处理效率,一站式完成从素材采集、文字提取到视频录制输出的全流程工作。
发布者:创客,出处:https://www.qishijinka.com/ticiqi/51581/