OWEN/SHEN
产品
听懂macOS · 日语对话助手

日语对话,
听懂再开口。

日语面试,听懂问题,再用自己的话回答。
助答帮你组织表达,同传帮你跟上对话。

公开测试版 v0.65.0(257) · Apple Silicon · macOS 15+ · 需自备 API Key

推荐从面试助答开始,四种模式按需选择。

01助答接上下一句02同传听懂对方的话03录音留住原音04陪练练着说出口
四种模式 · 会话可留存快与准怎么兼顾 ↗
安装指南 · 公开测试版

装到 Mac 上,开始一次对话。

v0.65.0(257) · 5.1 MB · 2026-10-01

Apple Silicon · macOS 15 或更新版本M 系列芯片专用;此安装包不支持 Intel Mac。可在「 → 关于本机」查看芯片与系统版本。

  1. 01

    打开安装包

    下载 DMG,双击打开,把「听懂」拖入「应用程序」。

  2. 02

    从应用程序启动

    打开「听懂」,按 macOS 提示确认打开;再点右上角齿轮进入设置。

  3. 03

    配置 Key 与收音

    先填 OpenAI Key 并验证,再检查声音输入。跟着入门指南设置 ↗

查看安装包 SHA-256b625fbb54d7039678eb4734d7c103311ec6259a5a723d0d22ce13daa45395045下载校验值
推荐场景 · 面试助答

经历是你的,日语表达有个帮手。

适合日语线上面试与面试前演练:听清问题,参考提示,再自己回答。

  1. 01

    先让助答了解你

    下载资料模板,填入真实经历、项目案例和求职方向。打开右上角「我的资料」,在「助答资料」中选择「关联本地文件」(已有资料时点「本地文件」),加入填写好的 TXT,并勾选使用。至少选择一份资料,才能开始助答。

  2. 02

    选对声音来源

    切换到「助答」,点击「开始助答」。线上面试选「线上会议」,同时收电脑声音和麦克风;当面交流选「面对面」,用麦克风收音。建议线上使用耳机,减少扬声器声音重复进入麦克风。

  3. 03

    告诉它,这是一场面试

    在开始前确认「对方说的语言」为日文,「场合与角色」选择「面试」,回答长度先选「一句话」或「两三句」。单人视角适合自己看提示,再点击开始。

  4. 04

    听问题,看提示,用自己的话答

    对方提问后,先看字幕理解问题,再参考中文要点和日语建议。线上分路收音可自动触发;面对面未配置 Jev 时,选择字幕上的「助答这句」。建议由你自己说出口,模型可能有误,经历和数字要自己核对。

  5. 05

    结束之后,回听与练习

    点击结束,在记录里回听原声、对照文字和概要。把没说顺的表达拿到「陪练」中再练,或从右上角导出回放,复盘这一轮。

先找朋友或用模拟问题演练一轮,确认收音、资料和建议都能正常出现。真实面试前应确认对方允许使用辅助工具及录音;使用时仍由你决定说什么。

四种模式

从听明白,到说出口。

助答与同传用于当下的对话,录音与陪练帮你整理和准备。

四种模式都提供实际演练后从 App 导出的完整回放。手动播放即可查看原声、等待和结果出现的过程。

01

助答

轮到你回答

听到问题,接上下一句。

推荐用于日语面试:先看懂问题,再结合你的简历与项目经历,给出中文要点和可以参考的日语表达。合作沟通与日常问答也可以使用,建议始终由你选择后自己说出口。

  • 中文要点、日语短句、译文与注音一起看
  • 先给快速草案,再完善回答
  • 旧答案可回看、置顶阅读,避免新回答打断
  1. 01

    先放入个人介绍、合作资料或本次沟通要求,帮助回答贴合你的情况。

  2. 02

    开始助答,听对方的问题;也可以手动选择一句来请求建议。

  3. 03

    参考要点和日语表达后再开口。没听清时,先请对方重复,不必硬接。

助答 · 实际回放

儿童无芥末寿司与和室改席 · 完整回放 2:26

演示者扮演虚构寿司店的员工接听预订变更电话:顾客的日语来自电脑播放的日语学习教材录音节选,画面依次出现原文、注音与中文字幕,助答参考事先导入的虚构店铺资料给出可直接照说的日语建议,演示者再对着麦克风作答。人物与店铺均为虚构;字幕、译文和建议保持 App 的实际输出,个别词句可能有误。音频经过重新混音:顾客部分换用同一段教材原声并调到与回答相近的响度,没有剪切或变速,画面内容未改动。

完整播放,或跳到:
02

同传

对方正在说

日语说得快,也能看懂意思。

听线上会议、视频,或面对面交流时,把正在说的内容变成双语字幕。对方的日语翻给你;双人视角下,你说的中文也可以翻给对方看。原文和译文对应保留,方便核对意思。

  • 电脑声音、麦克风可分别收音
  • 流式字幕先出现,整句与上下文继续精修
  • 支持双向对话;日语汉字可显示注音
  1. 01

    听线上内容选电脑声音,面对面选麦克风;按需要开启两路收音。

  2. 02

    设置对方语言与单人/双人视角,点击开始,看原文和译文逐步出现。

  3. 03

    结束后回到记录,重听原音、查看更正和要点,或导出回放。

同传 · 实际回放

仪式受阻与改进计划 · 完整回放 0:50

一段日语说明,展示原文、注音与中文字幕逐步出现的过程。

完整播放,或跳到:
03

录音

先留下,再整理

专心听完,事后再找细节。

不急着看实时字幕时,先把整段声音录下来,也可以导入本地音频。录制阶段不调用识别模型,结束后再转写、翻译、生成概要;适合讲座、较长讨论和事后要核对的语音。

  • 直接录音或导入本地音频
  • 先转写,再翻译和生成概要
  • 记录可命名、搜索、播放和导出音频/文字
  1. 01

    选择电脑声音或麦克风开始录音,或直接导入本地音频。

  2. 02

    录完点击「结束并整理」,依次识别、翻译、生成概要;模型处理需要相应服务与网络。

  3. 03

    查看原文、译文、概要与待办,对照原音核对细节,再复制或导出所需内容。

录音 · 实际回放

活动海报与导览页修改安排 · 完整回放 2:07

先完整收音,再识别、翻译,最后生成概要;录音阶段不会提前展示整理结果。

完整播放,或跳到:
04

陪练

为下一次开口做准备

想说的意思,练成自己的表达。

用中文或日语说出你的意思,老师给出解释和日语示范,再跟着练一遍。它按一轮一轮的对话回应,适合把自我介绍、点餐、面试或合作沟通中的表达练熟。

  • 只给说法、讲一点、讲透,深度可选
  • 日常、面试、商谈、店里,语气可调整
  • 可放入课文与词表,配合注音和朗读
  1. 01

    选择这次练的场景、语气和讲解深度;也可以粘贴自己的练习材料。

  2. 02

    说一段或输入文字,等这一轮的解释和示范,再试着表达一次。

  3. 03

    保留一轮轮练习卡片,回看说法、重听示范,为真实对话做准备。

陪练 · 实际回放

咖啡店点单日语表达 · 完整回放 3:02

从点一杯热美式,到改成冰卡布奇诺,逐轮查看日语说法与中文讲解。

完整播放,或跳到:
同传的工作方式

先跟上,再把这一句校准。

快速看到字幕,和在完整上下文里翻得准确,需要分步完成。

听懂把实时显示与后台精修分开:对话进行时先给可读的字幕,句子完整后再回头修正。这样,读音、要点等额外工作也不会让字幕排在最后。

  1. 01

    先跟上:边说边出现

    实时连接分别接收原文与译文的增量。可用的字幕先显示,不必等整段录音结束,也不等待后台总结完成。

  2. 02

    再校准:整句重新翻译

    一句话说完后,结合前面的对话做整句精修;句子还没结束但出现停顿时,也可先补一版临时译文。结果更新到对应的那一句。

  3. 03

    继续核对:上下文与术语

    启用相关修正功能后,会回看近期对话,处理听错的名称和指代,并结合术语表校正。原文变化时,对应译文也会重新处理。

  4. 04

    各走各的:减少互相等待

    实时字幕和后台精修、注音、要点整理使用分开的处理通道。看得见的字幕持续推进,其他任务在后台补齐。

这是当前实现的处理方式,部分修正取决于设置。效果仍受收音、网络、所选模型和对话内容影响;没有统一的秒数或准确率保证。字幕会修订,关键姓名、数字和约定可以回听原音核对。

选择适合的模式

同一个场景,四种用法。

下面用虚构的海报设计沟通台词,说明各模式的侧重点。

合作讨论、面试、日常问答

知道怎么答,也知道日语怎么说。

带上你自己的资料和要求,围绕刚才的问题给出中文要点和可参考的日语表达。你来判断、选择,再开口。

助答 · 使用方式场景示意

修正案はいつまでにいただけますか。

修改方案最晚什么时候能给到?

回答要点示例
  • 周三中午先发初稿
  • 根据反馈继续调整
日语表达示例

水曜日のお昼までに初稿をお送りします。

回答结合你的资料;要点和完整句子都可以复制。

这里的台词用于说明使用方式,不是 App 截图或模型实测结果。

导出回放

用过的过程,
也能留下来。

完成一场会话,选中记录,点击右上角「导出回放」。预览后导出 MP4,把字幕、回答和声音留在同一段视频里。

新记录包含启动、加载和停止过程,开始与结束带短音效。较早的记录可能只能近似还原到达节奏。

  1. 01点击开始开始音效
  2. 02加载与连接保留等待过程
  3. 03字幕与对话按记录时间回放
  4. 04点击结束结束音效
使用指南 · API 与收音

跟着配置,开始第一场。

先配置默认服务,其他能力需要时再开通。

先用默认配置,再按需要增加服务。

第一次用同传、助答、录音整理或陪练,先配置 OpenAI。下面每一项都写明官网入口、App 里的位置和生效条件;其他三家是可选项。

OpenAI先配置这一家OpenAI Key

默认的识别、翻译、助答与陪练使用 OpenAI。第一次体验,先配好它,模型保持默认即可。

  1. 注册或登录 OpenAI 开发者平台,在 API Keys 页面创建自己的 API Key。
  2. 检查 API 账户的可用额度与模型权限;需要时在 Billing 开通计费。ChatGPT 订阅与 API 账单分开。
  3. 打开听懂右上角「设置」,在「开始使用」中填入「OpenAI Key」,点击「验证 Key」。高级设置里的模型先保持默认。

验证通过表示基础连接可用。实际功能还取决于所用模型的权限、账户额度和网络;若某项调用失败,按 App 提示检查该服务。

Gemini可选 · 更换模型Gemini Key

想在支持的任务中改用 Gemini 时再配置。填入 Key 后,还需要选择 Gemini 模型才会生效。

  1. 用 Google 账户登录 AI Studio,按提示创建或选择项目,并创建 Gemini API Key。
  2. 查看该项目的可用模型、额度与计费状态,按实际需要开通。
  3. 在听懂「设置 → 更多设置 → 可选服务」填入「Gemini Key」,再到「高级设置 → 模型」为支持的任务选择 Gemini。

Gemini Key 与 Google Cloud 的朗读 Key 用途不同。实时同传默认仍用 OpenAI;只填 Gemini 不会自动替换全部能力。

Google Cloud可选 · 陪练朗读Google Key

希望陪练示范使用 Google 的语音时再配置。保留默认朗读服务即可先体验陪练。

  1. 登录 Google Cloud,创建或选择项目,关联计费账户并启用 Cloud Text-to-Speech API。
  2. 在该项目的「API 和服务 → 凭据」创建 API Key,并按官方文档限制为所需的 API。
  3. 在听懂「设置 → 更多设置 → 可选服务」填入「Google Key」,把「陪练朗读」切换为「Google」。

Google Key 用于这里的语音朗读,不是 Gemini Key。填入 Key 但没有切换「陪练朗读」时,不会改用 Google。

Jev · TypeSafe可选 · 面对面自动助答Jev Key

双方共用一个麦克风时,用于判断这句话是否需要自动给出助答。它负责判断,识别与回答仍由各自配置的模型完成。

  1. 进入 TypeSafe 官方控制台,注册或登录,按控制台提示申请或创建可用的 API Key。
  2. 确认账户已开通相应调用权限与额度。
  3. 在听懂「设置 → 更多设置 → 可选服务」填入「Jev Key」,用于面对面共用麦克风的自动助答判断。

线上会议可按电脑声音与麦克风分别收音。面对面没有 Jev 时,仍可在对方的字幕上选择「助答这句」手动请求建议。

Key 配好后,检查一次声音输入。

  1. 01

    打开「设置 → 检查声音输入」

    收现场声音要允许麦克风;收 Mac 上的视频或会议声音,要允许系统音频录制相关权限。可以从设置里的「权限」进入 macOS 隐私设置,按系统提示允许听懂访问。

  2. 02

    让声音来源与场景一致

    线上内容选电脑声音,面对面选麦克风。助答开始前的「线上会议」会按两路声音准备;「面对面」用麦克风。听十几秒,确认输入有反应、字幕能出现,再进行完整会话。

  3. 03

    从一次短练习开始

    只想看翻译,先用「同传」;想参考回答,先导入并勾选资料,再用「助答」;想事后整理,用「录音」或导入音频;想练表达,去「陪练」选择这次的内容。

Key 填在 App,资料也从 App 关联。

本页只提供跳转和说明,不收集 API Key。App 将 Key 存在 macOS 钥匙串;记录留在本机,云端识别、翻译和回答会把处理所需的音频或文字发送给你选择的服务。开通方式、地区可用性、额度和价格以各家官方页面为准。

该选电脑声音,还是麦克风?

听 Mac 上播放的视频、线上会议或通话时,选电脑声音;面对面交流时,选麦克风。双方声音来自不同地方时,可以同时开启。清晰的收音有助于减少误识别。

助答会替我直接回答吗?

助答提供建议,由你选择后自己说。它结合问题、近期对话和你提供的资料组织回应。共享一个麦克风时,判断谁在提问可能有误,你也可以手动请求助答;不清楚的问题应先请对方重复。

需要配置所有 API Key 吗?能完全离线吗?

第一次使用先配置 OpenAI,模型保持默认。Gemini 用于可选模型,Google 用于可选陪练朗读,Jev 用于面对面自动助答判断。这里介绍的同传和助答需要联网;录音阶段可先留下声音,之后的云端转写和总结仍需联网。

Key 验证失败,或字幕一直不出现怎么办?

先确认填入的是 API Key,而不是登录密码,并检查对应平台的账户额度、模型权限和网络。Key 可用但没有字幕时,检查声音来源、输入电平与 macOS 权限;权限变更后按系统提示重新打开 App。助答无法开始时,也要确认「助答资料」中至少勾选一份有内容的资料。

实时字幕不对,或者网络中断怎么办?

先检查收音来源与音量,并对照原文。字幕会在整句和上下文修正后更新,但模型仍可能听错或漏译。网络或模型不可用时不能保证实时效果;保留的原音可以事后重听、重新转写,补回当时漏掉的内容。

记录结束后还能做什么?

同传和助答记录可以回听声音、对照文字、查看整理出的概要与话题要点;记录支持命名、搜索和导出。陪练保留每轮解释与示范,四种模式都能从已保存记录进入回放导出。

声音和资料会发到哪里?

录音与记录保存在本机。启用云端识别、翻译或回答时,会向所选服务发送处理所需的音频或文字;助答会使用你导入的资料作为上下文。请在合适的授权范围内使用。

Intel Mac 能安装吗?这个版本还会更新吗?

本页提供的安装包只支持 Apple Silicon 的 M 系列 Mac,系统需要 macOS 15 或更新版本,尚未提供 Intel 安装包。当前为公开测试版,会持续迭代;可在 GitHub 版本页查看本次变更与安装包。

先听明白,再用自己的话回应。

看看其他项目
听懂 · 日语对话,听懂再开口 — Owen Shen