跳转到内容

附件、文字识别与语音

从输入框添加、拖入文件,或粘贴图片。每条消息最多八个文件、合计 20 MiB;文本/代码单个 256 KiB,PNG/JPEG 单个 5 MiB,文档与音视频单个 10 MiB。原文件保存在对应频道,并通过 SHA-256 核对。

文件 可以执行的操作
UTF-8 文本、代码 当前任务分段读取
DOCX、XLSX、PPTX、ODT、ODS、ODP 本地提取文字
PDF 本地提取文字;加密文件可临时输入密码
PNG、JPEG 本地识别英文和简体中文
MP3、WAV、M4A、MP4、WebM 明确选择后,通过已配置的 OpenAI 转写

打开“附件操作”,在需要内容的任务发送前先提取或转写。派生文字与原文件校验值绑定。处理有时间、内存和输出上限,截断会明确标记。不会执行宏、任意嵌入文件或文档代码。扫描 PDF 不会自动做 OCR,可先将页面导出为 PNG/JPEG 再识别。

上传中可选择“取消上传”,停止尚未完成的文件;已经成功的文件保留在草稿中。部分文件失败时,可只重试失败的文件,成功的文件不用重复上传。取消语音上传后保留试听内容,可以重试或丢弃。

点击麦克风并授予系统权限,录音后点击结束。单段最多五分钟、10 MiB,可以试听后“添加到草稿”,也可丢弃。离开频道会停止麦克风。录音不会自动把音频发送给模型;需要转文字时,明确选择附件的转写操作,所选媒体会发送给你已启用的 OpenAI 提供方。

“下载原文件”取得未修改的来源文件,桌面端使用系统保存窗口。输入框添加菜单中的“频道文件”可查看可用附件和回收站。移入回收站后不供新任务引用,已有任务仍保留访问。恢复后可以重新使用。清理只考虑移入回收站至少七天的文件,消息或任务仍引用的文件会保留。