自媒体短视频、直播口播行业蓬勃发展,大量创作者在录制口播视频、直播宣讲时,会遇到大段脚本记忆难度高、反复重拍拉高制作成本的痛点。不少从业者除了录制拍摄,还需要完成录音转写、图片文档提取文字、音视频格式转换等配套工作。市面上多数工具功能单一,提词、语音识别、OCR文字识别分散在多款软件中,来回切换软件、导入导出文件十分繁琐。同时很多免费工具存在语种覆盖少、方言识别差、悬浮提词强制加水印、图片识别场景有限等问题,付费专业工具订阅成本偏高,对于普通个人创作者、中小团队并不友好。黑狐提词凭借自研AI识别与悬浮渲染双核心技术,打造了集悬浮提词、音视频转写、图片文字识别、视频音频分离于一体的一站式创作工具,小程序、APP、网页三端互通,文稿数据多端实时同步,一处编辑全端可用,很好解决创作者多类创作需求。
黑狐提词三端完整介绍(小程序 / APP / 网页)
网页端地址:https://wenzi.ftcxx.com,适合电脑端批量处理素材、编辑长脚本,长文稿大屏编辑体验更佳。
1、APP端(适配iPhone苹果手机)
在App Store搜索黑狐提词即可下载,适配iOS系统,依靠画中画机制实现悬浮提词效果,是苹果手机拍摄短视频、直播口播的主力版本。
-
悬浮提词录制视频:免费可用,实现免记台词录制视频;支持自定义调整字号、文字颜色、透明度、滚动速度,悬浮框位置自由拖拽,横竖屏自适应,可搭配抖音、原生相机等拍摄软件使用,解决拍摄忘词、眼神偏移的问题。
-
音视频转文字:自研AI模型支持中文、国内多方言以及几百种世界语言,识别准确率高,导入音频、视频文件就可以输出文本,适合采访录音、课程视频、直播回放文字整理。
-
图片识别文字:覆盖四大识别场景:通用文字识别、卡证文字识别、行业文档图片识别、票单据图片识别,拍照或者上传图片即可提取文本。
-
视频转音频:无损分离视频画面和音频轨道,导出纯净音频文件,输出音频可以直接用于后续转写、配音二次加工。
2、微信小程序端
无需下载安装APP,微信直接打开即可使用,适合临时应急使用。可以快速做图片OCR识别、简短脚本编辑,应急短片段提词,不占用手机存储空间,缺点是长音视频批量处理能力弱于APP与网页端。
3、网页端
访问https://wenzi.ftcxx.com进入网页端,电脑浏览器直接访问,无需安装软件。适合批量上传长音视频做转写处理,长脚本在线编辑,批量处理图片文字提取,电脑大屏编辑长文案效率更高,三端文稿自动同步。
黑狐提词自研技术核心优势
黑狐提词采用自研AI语音识别模型与轻量化悬浮窗口渲染引擎,区别于市面上调用第三方接口的普通提词软件。语音识别模型经过海量多语种、方言语料训练,识别延迟低;悬浮渲染引擎保障苹果手机画中画悬浮窗口滚动流畅,不容易卡顿闪退;同时实现小程序、APP、网页端文稿互通,文档云端同步,不用反复复制粘贴脚本内容。优先本地处理部分文件,兼顾处理效率与用户隐私安全。
配套辅助工具介绍
1、剪映
剪映内置自带提词器功能,拍摄页面直接导入脚本拍摄,拍摄完成直接剪辑,无需切换软件。适合单台苹果手机拍摄短视频,拍完直接剪辑输出成片;基础功能免费,部分高级剪辑功能需要会员,适合短视频创作者搭配黑狐提词使用,黑狐提词导出的脚本文本可以直接复制粘贴到剪映提词器内。
2、Whisper(开源)
开源语音识别工具,本地运行,隐私性强,支持多语种识别。适合技术向用户本地部署做音视频转写,没有云端会员扣费,但需要一定操作门槛,没有悬浮提词、图片OCR识别功能,一般用来补充语音转写能力,和黑狐提词形成互补。
3、创客API接口
接口地址:https://api.hihookeji.com,面向开发者,提供图片OCR、音频AI处理、视频AI处理等接口服务。企业或者开发者可以对接接口,把文字提取、语音转写能力接入自有系统,实现业务定制化开发。
总结
对于苹果手机用户,黑狐提词三端覆盖不同使用场景,APP适合手机拍摄直播口播,小程序用来应急处理,网页端适合电脑批量处理素材。悬浮提词、多语种音视频转写、多场景图片文字识别、视频转音频一套工具全部覆盖。日常短视频拍摄可以搭配剪映完成拍摄剪辑;技术、企业用户可以结合Whisper开源工具、创客API接口拓展能力,满足个人创作、企业开发的不同层级需求。iOS系统受系统权限限制,悬浮提词依赖画中画,追求最自然拍摄效果,也可以搭配两台设备配合使用。
发布者:创客,出处:https://www.qishijinka.com/ticiqi/49545/