不只是存下一张截图,而是真的把它听完。
有用的内容不总是一个文档,也可能是拍下来的讲义、书页,或保存在截图里的段落。把图片导入 Hearem,提取文字后,就能进入和输入文本相同的收听流程。
从相机或相册开始。
拍摄印刷文字,或选择已经保存在设备上的图片。如果照片仍在 iCloud 中,请先下载到本地再导入。
提取并朗读文字,不是描述图片。
这里的图片转语音,指识别并朗读可见文字,不代表识图描述、理解图表或辨认图片里的物体。
检查名字、数字与阅读顺序。
生成前检查提取结果。清晰、端正、光照均匀的文字更适合作为输入;复杂分栏、手写内容或模糊照片可能需要人工修正。
找到合适的声音,再离开屏幕。
选择受支持的 AI 音色进行自然朗读,或使用已安装的 Apple 系统语音作为基础本地备选。生成的音频可以后台播放,并保存收听进度。
如何把图片变成语音
文字识别与语音生成分开进行,方便你先把内容检查清楚。
拍摄或选择文字图片
使用相机,或选择已下载到 iPhone 本地的截图和照片。
通过 OCR 提取文字
让 Hearem 识别可见文字。OCR 默认在设备端完成。
检查并整理
检查阅读顺序和重要信息,修正识别错误,必要时整理格式。
选择声音并开始听
使用支持该语言的音色生成语音,然后从锁屏继续播放。
本地 OCR,不代表后续所有处理都在本地。
Hearem 默认使用设备端 OCR。选择云端 AI 音色时,生成语音所需的文字会发送给对应服务商。已安装的 Apple 语音可在受支持的语言中离线生成;AI 编辑及其他在线功能有各自的联网要求。
- OCR 先提取文字,再进入语音生成。
- 云端 AI 朗读需要发送文字进行处理。
- 已安装的 Apple 语音是基础离线备选。
- 导入敏感材料前,请阅读隐私政策。
图片转语音常见问题
能朗读截图里的文字吗?
可以。导入截图后,通过 OCR 提取可见文字,检查结果,再在 App 中生成语音。
可以拍下纸质书页来听吗?
可以。尽量拍得清晰、端正,避免反光,生成前检查识别结果和阅读顺序。
会描述图片中发生了什么吗?
不会承诺这项能力。本流程提取并朗读可见文字,不是图片描述、物体识别或图表解读工具。
图片和文字都不会上传吗?
OCR 默认在设备端完成,但使用云端 AI 音色时,相关文字需要发送给对应提供方。因此完整流程并不一定离线或完全本地。
为什么相册里的图片导入失败?
先检查图片是否已从 iCloud 下载到设备本地。如果已经下载但仍失败,可携带文件格式和方便分享的样例联系支持。
OCR 和朗读用的是同一种额度吗?
文字识别与后续语音生成是不同操作,各有相应额度。Apple 系统语音是基础本地选项,其他音色及处理能力有对应的方案或额度要求。
