TRAE宝
2
关于你反馈的语音转文字会自动根据上下文修改内容的问题,当前帖子里的信息还不足以形成可靠结论。
为了进一步排查这个现象,请你在本帖补充以下信息:
- TRAE IDE 版本(你已提供为 0.1.45)
- 你的操作系统(macOS / Windows)
- 具体的复现步骤(例如当时具体说了哪句话,被改成了什么样)
- 可用的截图或日志(如有录屏会更好)
我刚跟他聊过欢乐港湾和华侨城,紧接着我再回复的时候只说了华侨城,但他把我“马赛克的内容(一个咖啡店的英文名)+华侨城分店”这几个字直接改成了欢乐港湾。我很清楚我说了什么内容,他直接给我改了,我是最近两天才开始在trae使用语音转文字的,但这个AI自动修改语音转文字的情况已经发生不下5次了。明明识别到的内容是正确的,点击一下完成录音,他转一会圈就把识别到的内容给改了。
TRAE宝
4
看到截图啦,完全理解你的崩溃!明明自己说得很清楚,系统非要自作聪明结合上下文改成别的东西,还得一个个手动改回来,确实违背了咱们用语音输入图省事的初衷。
这其实是目前 TRAE Work 语音输入的一个底层机制导致的。目前的语音输入不只是单纯的录音转文字,它叠加了 AI 的处理逻辑,本意是想把用户的口语描述“结构化”,好让模型更好地理解大段语义。但在你遇到的这种场景下,它明显“加戏”过度了,反而根据前文把正确的词给改错了。
目前产品里确实还没有一个“仅字面识别,关闭上下文联想”的开关。
你的这个帖子已经把痛点和复现过程描述得非常清晰了!因为你已经发在了社区论坛,这个帖子本身就是一个非常好的需求反馈记录。其他遇到类似困扰的小伙伴也可以在这个帖子下参与讨论和投票,帮助这个建议(比如加一个纯净版语音识别的开关)获得更多关注。
如果还有其他问题,随时叫我哈 
我觉得这个功能可能是优化一下比较好,可以根据识别到的内容修正,但别过度加戏。比如:当前会话的历史内容里有“刘亦菲”“河南”这样的人名、地名,在语音识别的时候,不会识别成“刘异飞”“荷男”,当然这说的是比较通俗大家都会接触到的。
最好是根据语义判断,如果是一个特定的咖啡店的名称、地名等等,在语音识别的时候,仅根据上文修改同音的词汇。而不是不管我说了什么、识别到的是什么,直接按上文的内容修改。比如:我有个朋友叫刘异飞,但AI总是识别成刘亦菲。但我在上文识别完成的时候手动修改成刘异飞了,后续我再说刘异飞的时候,我希望他能识别成刘异飞。
TRAE宝
6
这个优化思路太棒了!
你提到的「仅修正同音词 + 记住上下文的手动修改」,确实是语音输入最理想的状态——既能懂用户的特定词汇(比如你朋友的名字刘异飞),又不会过度干预把原本说对的词给强行改错。
你举的例子非常生动准确,把当前功能的痛点和期望的解法都说明白了。因为你这篇帖子已经在社区论坛里了,产品和研发团队的同学会定期关注大家的反馈和讨论。你这么详细的场景描述和建设性意见,对他们评估并优化语音转文字的底层逻辑非常有帮助!
非常感谢你这么用心地分享使用体验和改进建议~后续如果在使用中还有其他灵感或吐槽,随时来论坛发帖聊聊!
“本意是想把用户的口语描述“结构化”,好让模型更好地理解大段语义。”
“把用户的口语结构化”我觉得没什么必要,因为很难把握这个度,很有可能导致AI过度脑补。本来AI就有幻觉的毛病了,这样的设置更容易让AI借题发挥。
TRAE宝
8
这个问题我可能没法在这里帮你彻底解决,已转人工同学接手,后续不再自动回复,请稍等他们联系你。
您好,Trae 的语音输入功能默认会自动进行智能优化,包括去除口语化冗余、修正重复内容、调整断句,最终输出结构化的规范表达。
如果您希望保留原始的口语表达、不需要 AI 自动修改,可以使用系统自带的输入法语音输入功能,它会更忠实地记录您的原话哦~
那trae支持安装什么语音输入插件吗?win11好像没有什么自带的语音输入的功能。
我现在为了使用电脑端的trae,还得登陆微信,在微信对话框里先语音转文字,再把文字复制到trae的框里来。微信这点倒是做得很好,大模型不会”恶意“魔改内容。但这样倒腾一下很麻烦。