博亚体育 千问电脑版上线语音输入法:打工东谈主终于不错用嘴干活了

Vibe Coding 火了之后,越来越多的东谈主遴荐对着屏幕口述,而不是敲键盘,不少网友以至为此整出 AI 语音键盘。
本年 3 月,Anthropic 也给 Claude Code 加了语音模式,在末端输入 /voice,按住空格谈话,松手引申。很难想象,连「写代码」这种最依赖键盘输入的场景,都启动复旧语音了。
既然写代码的东谈主都启动用嘴干活了,那我一个每天写著作、写决议、作念 PPT、整表格的打工东谈主,还在一个字一个字敲键盘,赫然也不够高效,尤其是查数据要切三个页面,作念个讲述 PPT 要从找模板启动花三小时,整搭理议纪要边听边记还漏一半。
究其原因,不是每个东谈主的理论抒发都那么好。哪怕也有一些 AI 输入法能解决,比如咱们之前先容过的 Typeless,每年光订阅费每年就得花 1000 块。
在信得过干活的电脑端,于今莫得和深度 AI 办公材干买通的语音进口。刚好,千问电脑版 / 网页版最近也上线了千问语音输入法,传奇奔着「用嘴干活」而来。而况千问电脑版如故全免费——不仅仅语音免费,它内置的通盘 AI 办公材干,一齐打开用。

别被输入法这个名字骗了
一启动,看到千问语音输入法这个名字,我下意志以为这即是一个识别准确率更好的 AI 输入法,闭幕我发现透彻不是一趟事。
千问语音输入法上手确凿莫得门槛。两个快捷键解决一切,按住是语音输入,双击是让 AI 干活。Win 是右 Alt,Mac 是右 Command,你不错字据使用风气来缔造唤起的快捷键。

你在 Word 里写文档也好,浏览器里看贵寓也好,钉钉里回信讯也好,快捷键一按,语音进口浮出来。无用切到千问客户端,无用打开独特窗口。想问就问,想说就说。
千问语音输入法主要就两种使用姿势:按住启动语音输入,猜度什么径直说就行,千问帮你自动去涎水话、创新口误、生成结构化抒发。双击唤起语音指示,这时候你是在给 AI 派任务,比如查个东西、帮你回信讯、生成文档。
打从一启动,它就不仅仅贪图只作念一个「帮你打字更快」的输入法。你的嘴负责下达指示,它是一个核心接口,负责听懂、翻译、鼎新,让 AI 把活儿干完交给你。
谈话即是比打字好使
2026 年,我对一款语音输入法的要求,仍是远远不啻是识别准确率。「听得清」的逐字听写都是基操,更紧要的是相识我想抒发什么,再帮我组织好。
比如口述一段想法,它能保留我的意图,帮共事把妄言一齐过滤掉,口误也顺遂修正,吐出来出来的是干净、精好意思、不错径直发出去的笔墨。
比如碰到决议宽限这种事,也不错交给千问整理成一段领路的书面抒发,而我只需要径直按住快捷键,随口响应给千问:
对于这个时势的宽限,我 ... 啊区别,我想说的是对于这个决议的诊治,其实原定诡计是本周五委用,然而 ... 呃 ... 因为客户那边临时加了三个需求点,咱们评估了一下大约需要多两天,是以 ... 区别,我的最终意念念是:决议委用时候从本周五诊治至下周三,原因是客户新增三个功能点,需要补充期间评估,咱们得意下周三前一定提交第一版决议。

松手后闭幕就出来了,不错看到它自动删除通盘「啊区别」「呃」「然而」等口吻词,把我抒发的核心领路整理了出来;对比旧例的语音输入,只可逐字纪录,还要我方手动裁剪,千问语音输入法基本无需手动诊治,就能径直发出去。
在一些更专科和复杂的时势谈判中,千问语音输入法就愈加实用了。
比如底下这个谈判需求,防备看,我长按说了一大堆话后,临了还补了一句:将对于数据部分提前。
此次产物改版的核心目的是普及新用户的留存率。咱们在 onboarding 历程里增多了三个谈判方法,把原来的五步走改成了三步走,还在每个节点加了进程教导。另外,咱们发现许多用户在第二步就流失了,是以把第二步的表单从 8 个字段缩减到 3 个必填字段。数据方面,改版后一周的留存率从 35% 普及到了 48%,次日留存普及了 12 个百分点。不外也有一个风险,即是表单精简后蚁集的用户信息变少了,可能会影响后续精确推选的后果,这个需要捏续不雅察。临了是团队层面的互助,想象部在两周内出了两版决议,拓荒部用了三天完成上线,合座节律如故很快的。嗯把数据那段放到最前边,然后分段给我
这里闭幕对比就更光显了,只消千问听懂了「把数据那段放前边「」的指示,自动重排段落,我用嘴就完成了原来需要鼠标 + 键盘的操作。

▲ 旧例语音输入闭幕

▲ 千问语音输入法闭幕
体验过程我还发现了一个让我惊喜的细节,千问语音输入法对于中英文夹杂的口述本体,识别超越到位。
这个函数的主要作用是处理用户登录时的 token 考证,最初会调用 validateToken 方法搜检 token 是否逾期,若是 expired 的话就复返 401,然后若是是 valid 的话,再调用 getUserInfo 接口去拉取用户信息,临了把 userId 和 role 写进 session 内部。防备一下,这里有一个 edge case,即是当 token 是 refresh token 的时候,要走另外一条逻辑分支。
千问不单把通盘的英文术语都识别对了,而况还自动字据我的话分点输出,一目了然。

我还想共享一个对于本体创作家超越有匡助的用法,APPSO 每天早上都要开选题会,环球会有许多碎屑想法,一个热门景色、一个行业不雅察、一个趋势判断……
之前有些想法是散装的,不成体系,当今我不错径直在会上按住唤出千问语音输入法,让它将这些想法整理成大纲。比如这一大段我在会上对裁剪选题的响应看法,如下图所示:

收缩手后,一段贯注的选题大纲就出来了,裁剪能稳稳接住我的响应,稍稍扩充就能写出一篇深度分析稿件。临了的成文也附上给环球望望:苹果偷偷砍掉丐版 Mac mini,东谈主东谈主都要交「AI 税」的期间来了 。
单就语音输入这个维度,千问给我最大感受是,真就说多快多乱都不紧要,归正输出的质地 AI 会兜底。
万物皆可 Vibe,一句话的事
语音输入仅仅第一步,千问语音输入法更大的价值是还能帮你干活。
上头提到了整理选题大纲,然后我就需要千里浸式写稿,但每次要查个数据和弘扬,都得切到其他网页和哄骗。这里千问语音输入法就很当然地出现了——它复旧在职意软件、桌面全局唤起,无用切换窗口,动动嘴就能径直查。
比如我在写一篇对于 OpenAI 的著作时,博亚体育刚好有一段要援用最近的融资金额和投资方。我双击唤起语音指示,说一句:「帮我找一下 OpenAI 最新融资布景。」

念念考一两秒,千问小窗就径直弹出把贯注解荒疏我了,我看着援用不时写,心流就不会被打断。
假期刚归来,一大堆责任等着鼓舞,我需要整理一个领路的周报,但又没时候徐徐敲字,于是双击并随口将把需求说了出来,内部夹杂着带着大量理论抒发:
诶阿谁,我讲述下这周进程哈…… A 时势咫尺跟进到第三阶段了,中间遭受了供应商委用延长,大约迟了三天,自后通过加班把进程赶归来了…… B 时势还在需求评审,产物那边原型图有点邋遢,约了下周一早上十点对王人……下周还要苦求两台测试服务器……你帮我整理为周报 word 文档,口吻专科极少,层次明晰。

此外,千问语音输入法还有一个更成心念念的功能——帮你回信讯。
我每天时时需要在微信、钉钉、飞书等各式时势群里穿梭,恢复各式音讯。相配阔绰元气心灵,这时候我就能让千问让我的「嘴替」了。
比如假期还没过完就被共事催交著作,我就双击让它帮我来一段高情商恢复。

▲ 我无需给它先容布景,它就能字据屏幕本体补充高下文,给我一个「机灵」的恢复
而在一些濒临客户或者更讲求的场面里,我也不错双击让它给我拟一个多礼的恢复。

这是因为千问语音输入法复旧了「场景感知」。它自动识别你现时在什么哄骗里,看到你屏幕上的本体,据此诊治输出的立场。你无用告诉它更多布景,它我方就能看懂。
下周要出差,我径直双击,在微信让它帮我字据聊天信息,整理成一个出行指南便签。

临了给我的这份出行指南,除了航班信息,还贴心性给我整理了待业绩项,并字据当地天气和交通情况给了我一些具体漠视,这对于时时出差的媒体东谈主来说十分友好。
开周会的时候我还发现了一个实用的小手段,会议启动,我双击两下唤起千问语音输入法,结尾后一句:「帮我把刚才的本体整理成会议纪要。」它就自动帮我整理好了。
这很妥贴一些快速拉通的临时会议,无用再单独打开会议纪录类的哄骗,唾手双击立地记。

对着电脑谈话,活儿 AI 我方就干收场
别诬告,对着电脑喊「帮我查贵寓」「写个邮件」,当今只可算 AI 的基本操作。
千问 电脑端此次信得过亮出的底牌,是把语音输入和 PPT 创作、AI 表格、文档处理等功能组合起来,这亦然信得过能帮打工东谈主达成「每天早放工一小时」的实辛苦能。
拿最折磨东谈主的 PPT 来说,千问不是去素材库里给你免强烂大街的野生模板,而是径直用大模子的代码材干动态生成复杂排版。若是你以为那边不够完竣?径直多轮对话让它接着改,改到你沉静为止。
为了探探底,我先让它帮我作念个视频号运营课程 PPT,确凿在语音落地的陡然,AI 就参加了光速消化模式:填充血肉、匹配逻辑一气呵成。

最令东谈主惊喜的是,千问对「图文穿插」的相识并非郑人买履,而是字据本体深度匹配了相反化的版式,整份 PPT 拿出来,确凿即是不错径直委用的成稿。
这还没完,你还能一次性给千问喂最多 39 种不同神色的参考文献,让它自动梳理逻辑、索求要点,帮你省去了来去翻贵寓的不毛。至于配图,它也能字据高下文自动匹配,找不着合适的以至能赶紧给你生图,全程都不需要你切出界面去乞助搜索引擎、或者下载下来用 office 处理。
表格处理方面,千问的 Excel Agent 主打一个高水准。
非论是神色松懈的聊天截图、手写札记,如故大段的纯文本,丢给它就能快速生成活动的 Excel 表格。若是后续还要算算增长率、画个趋势图,也无用再去头疼怎么写函数公式了,径直用当然语言打法它就能解决。
我试了一个稍稍有点复杂的需求:让它字据 2026 广州最新版初中英语讲义,把各句型的语法结构、时态变化和参考例句整理成 Excel 表格,神色要妥贴一页纸打印,随意拿来背诵。

换以前,这种事得我方一条条查贵寓、手动录入、再调神色,至少要折腾半小时。当今说一句话,它径直把表格生成好,列名、行距、例句填充,基本不需要再入手改。
文档处理这边,Word/PDF Agent 复旧图文数据羼杂上传,能自动排版并输出径直可委用的文献。
更成心念念的是,传完长文档你不需要我方去翻阅找要点,径直张嘴问,它就能快速定位给出谜底;想修改那边亦然一句话的事儿,省去了我方去对照原文献极少点改的不毛。
我试着传了一份混乱的左券 PDF,径直问它:「独家授权本体是哪些?」它并莫得傻傻地把全文复述一遍,而是精确定位到了授权条件,把独家范围、授权期限和截至事项一条条列得明判辨白。

咫尺,这个语音指示以至还能和 AI 写代码、手搓网页等任务助理功能组合使用,照这个架势下去,改日的办公形态,大约果真即是「动动嘴皮子就把活儿干了」。
和 AI 谈话的东谈主,会比键盘打字的东谈主更早放工
用了一段时候千问语音输入法,我猜度一件事。
往时几年「AI 普及办公着力」喊得震天响,但大部分东谈主的体验是:我跟 AI 说了半天,它给我的东西压根不成用。然后就以为 AI 也不外如斯。
问题出在哪?出在谈判方式上。你用键盘跟 AI 对话,40% 的元气心灵花在组织笔墨上,只剩 60% 在想你到底要什么。给出去的指示信息密度低、高下文薄,AI 虽然输出垃圾。这不是 AI 不行,是你喂给它的东西不行。
语音把这个死结解开了。谈话时你不会给我方设字数截至,细节会当然地冒出来,高下文会自动变厚。它能把嘴里说出的当然语言需求梳理得井井有条,让 AI 精确引申。

纽约销售平台 Clay 的解释负责东谈主 Yash Tekriwal 提到,他用语音输入的速率是每分钟 205 个词,打字只消 110 到 120 个。但速率还不是最要津的,他发现口述的 prompt 质地更高。
AI 圈最近有个词超越火,叫 harness。它的意念念大约是:你有一匹马(AI 的材干),但你得有一套缰绳才能操纵它,让它往你要的目的跑。莫得 harness,马再富厚也仅仅在原地打转。
千问电脑版的语音输入法即是这套 harness。
它积存的一端是你的嘴,另一端是 AI 的全套办公材干:PPT、表格、文档、搜索、分析、神色弯曲。你说一句话,它把你的意图翻译成 AI 能引申的指示,然后鼎新对应的 Agent 去跑腿。它不是输入法,是缰绳。是你操纵 AI 办公材干的那套 harness。
而别的「带 AI 功能的输入法」解决的是什么?是进口问题,帮你找到 AI 在那边。千问解决的是操纵问题,帮你把 AI 的材干精确地用起来。一个是给你指路,一个是帮你套好缰绳径直开赴。差距就在这。
在 Agent 期间,语音本来是驱动 AI 责任的最当然和高效的方式。千问语音输入法,即是率先在桌面进口端出了这套 harness 的产物 ,这亦然为什么我期待,改日在更多末端上,能看到这种信得过能操纵 AI 的语音进口。
旧年这个时候,若是你在办公室陡然对着电脑谈话,一次两次会被当成在打电话,三番五次就不禁让东谈主怀疑,责任压力是不是太大了,精神情景还好吗?
本年启动,那些对着电脑自言自语的,可能即是全公司最早放工 ( 摸鱼 ) 的东谈主。
附客户端下载地址:
https://www.qianwen.com/博亚体育download?ch=tongyi_redirect
网页版体验地址:
https://www.qianwen.com/
U体育(中国)官网入口