语音和图像模型只需下载一次,之后就在你自己的设备上运行:转写音频或视频、翻译字幕、去除录音中的噪音、修复旧照片、把画面中的人物模糊处理,或把文本朗读出来。唯一的例外是「会议纪要」里可选的 AI 摘要,它会把转写文本发送到服务器——而且只在你点击那个按钮时才会发生。
在设备本地生成可搜索的录音文稿。
让同一段视频同时面向阿拉伯语和英语观众。
把冗长的录音整理成决策和待办事项。
找回模糊或低分辨率图片中的细节。
让嘈杂的录音听起来更清楚。
分享照片前遮住人物和隐私信息。
长文不用看,听就行。