开云体育

开云体育

开云kaiyun中国官网入口 千问电脑版上线语音输入法:打工东说念主终于不错用嘴干活了

发布日期:2026-05-09 03:12 来源:未知 作者:admin 浏览次数:

Vibe Coding 火了之后,越来越多的东说念主给与对着屏幕口述,而不是敲键盘,不少网友以致为此整出 AI 语音键盘。

本年 3 月,Anthropic 也给 Claude Code 加了语音模式,在结尾输入 /voice,按住空格语言,死心彭胀。很难想象,连「写代码」这种最依赖键盘输入的场景,都运行解救语音了。

既然写代码的东说念主都运行用嘴干活了,那我一个每天写著述、写决策、作念 PPT、整表格的打工东说念主,还在一个字一个字敲键盘,昭彰也不够高效,尤其是查数据要切三个页面,作念个讲述 PPT 要从找模板运行花三小时,整答理议纪要边听边记还漏一半。

究其原因,不是每个东说念主的理论抒发都那么好。哪怕也有一些 AI 输入法能解决,比如咱们之前先容过的 Typeless,每年光订阅费每年就得花 1000 块。

在确凿干活的电脑端,于今莫得和深度 AI 办公智商买通的语音进口。刚好,千问电脑版 / 网页版最近也上线了千问语音输入法,外传奔着「用嘴干活」而来。何况千问电脑版如故全免费——不仅仅语音免费,它内置的统统 AI 办公智商,一都掀开用。

别被输入法这个名字骗了

一运行,看到千问语音输入法这个名字,我下意志以为这即是一个识别准确率更好的 AI 输入法,拆伙我发现全都不是一趟事。

千问语音输入法上手险些莫得门槛。两个快捷键解决一切,按住是语音输入,双击是让 AI 干活。Win 是右 Alt,Mac 是右 Command,你不错证实使用习气来缔造唤起的快捷键。

你在 Word 里写文档也好,浏览器里看贵府也好,钉钉里回信信也好,快捷键一按,语音进口浮出来。无用切到千问客户端,无用打开寥落窗口。想问就问,想说就说。

千问语音输入法主要就两种使用姿势:按住运行语音输入,猜测什么班师说就行,千问帮你自动去涎水话、改革口误、生成结构化抒发。双击唤起语音指示,这时候你是在给 AI 派任务,比如查个东西、帮你回信信、生成文档。

打从一运行,它就不仅仅缱绻只作念一个「帮你打字更快」的输入法。你的嘴负责下达指示,它是一个核心接口,负责听懂、翻译、调治,让   AI   把活儿干完交给你。

语言即是比打字好使

2026 年,我对一款语音输入法的要求,依然远远不啻是识别准确率。「听得清」的逐字听写都是基操,更枢纽的是流露我想抒发什么,再帮我组织好。

比如口述一段方针,它能保留我的意图,帮共事把谣言一都过滤掉,口误也顺遂修正,吐出来出来的是干净、精采、不错班师发出去的笔墨。

比如碰到决策延期这种事,也不错交给千问整理成一段澄莹的书面抒发,而我只需要班师按住快捷键,随口响应给千问:

对于这个风物的延期,我 ... 啊诀别,我想说的是对于这个决策的调整,其实原定操办是本周五委派,可是 ... 呃 ... 因为客户那边临时加了三个需求点,咱们评估了一下未必需要多两天,是以 ... 诀别,我的最终敬爱是:决策委派时候从本周五调整至下周三,原因是客户新增三个功能点,需要补充手艺评估,咱们原意下周三前一定提交第一版决策。

死心后拆伙就出来了,不错看到它自动删除统统「啊诀别」「呃」「可是」等口吻词,把我抒发的核心澄莹整理了出来;对比旧例的语音输入,只可逐字记载,还要我方手动剪辑,千问语音输入法基本无需手动调整,就能班师发出去。

在一些更专科和复杂的风物同样中,千问语音输入法就愈加实用了。

比如底下这个同样需求,驻防看,我长按说了一大堆话后,临了还补了一句:将对于数据部分提前。

此次居品改版的核心机划是进步新用户的留存率。咱们在 onboarding 过程里加多了三个阿谀法子,把原来的五步走改成了三步走,还在每个节点加了进程教导。另外,咱们发现许多用户在第二步就流失了,是以把第二步的表单从 8 个字段缩减到 3 个必填字段。数据方面,改版后一周的留存率从 35% 进步到了 48%,次日留存进步了 12 个百分点。不外也有一个风险,即是表单精简后收罗的用户信息变少了,可能会影响后续精确保举的恶果,这个需要捏续不雅察。临了是团队层面的和解,假想部在两周内出了两版决策,斥地部用了三天完成上线,举座节律如故很快的。嗯把数据那段放到最前边,然后分段给我

这里拆伙对比就更显然了,唯一千问听懂了「把数据那段放前边「」的指示,自动重排段落,我用嘴就完成了正本需要鼠标 + 键盘的操作。

▲   旧例语音输入拆伙

▲   千问语音输入法拆伙

体验过程我还发现了一个让我惊喜的细节,千问语音输入法对于中英文夹杂的口述实验,识别卓越到位。

这个函数的主要作用是处理用户登录时的 token 考据,领先会调用 validateToken 当作搜检 token 是否过时,要是 expired 的话就复返 401,然后要是是 valid 的话,再调用 getUserInfo 接口去拉取用户信息,临了把 userId 和 role 写进 session 内部。驻防一下,这里有一个 edge case,即是当 token 是 refresh token 的时候,要走另外一条逻辑分支。

千问不单把统统的英文术语都识别对了,何况还自动证实我的话分点输出,一目了然。

我还想共享一个对于实验创作家卓越有匡助的用法,APPSO 每天早上都要开选题会,民众会有许多碎屑方针,一个热门局面、一个行业不雅察、一个趋势判断……

之前有些方针是散装的,不成体系,当今我不错班师在会上按住唤出千问语音输入法,让它将这些方针整理成大纲。比如这一大段我在会上对剪辑选题的响应主意,如下图所示:

责怪手后,一段详确的选题大纲就出来了,剪辑能稳稳接住我的响应,略略彭胀就能写出一篇深度分析稿件。临了的成文也附上给民众望望:苹果暗暗砍掉丐版 Mac mini,东说念主东说念主都要交「AI 税」的时期来了 。

单就语音输入这个维度,千问给我最大感受是,真就说多快多乱都不枢纽,归正输出的质料 AI 会兜底。

万物皆可 Vibe,一句话的事

语音输入仅仅第一步,千问语音输入法更大的价值是还能帮你干活。

上头提到了整理选题大纲,然后我就需要千里浸式写稿,但每次要查个数据和陈说,都得切到其他网页和旁边。这里千问语音输入法就很当然地出现了——它解救在职意软件、桌面全局唤起,无用切换窗口,动动嘴就能班师查。

比如我在写一篇对于 OpenAI 的著述时,开云官网入口刚好有一段要援用最近的融资金额和投资方。我双击唤起语音指示,说一句:「帮我找一下 OpenAI 最新融资布景。」

念念考一两秒,千问小窗就班师弹出把详确解发放我了,我看着援用无间写,心流就不会被打断。

假期刚追忆,一大堆职责等着鼓舞,我需要整理一个澄莹的周报,但又没时候迟缓敲字,于是双击并随口将把需求说了出来,内部夹杂着带着大量理论抒发:

诶阿谁,我讲述下这周进程哈…… A 风物面前跟进到第三阶段了,中间遭受了供应商委派蔓延,未必迟了三天,其后通过加班把进程赶追忆了…… B 风物还在需求评审,居品那边原型图有点迂缓,约了下周一早上十点对都……下周还要苦求两台测试服务器……你帮我整理为周报 word 文档,口吻专科少许,档次明晰。

此外,千问语音输入法还有一个更有敬爱的功能——帮你回信信。

我每天时常需要在微信、钉钉、飞书等多样风物群里穿梭,回答多样音信。颠倒阔绰元气心灵,这时候我就能让千问让我的「嘴替」了。

比如假期还没过完就被共事催交著述,我就双击让它帮我来一段高情商回答。

▲   我无需给它先容布景,它就能证实屏幕实验补充高下文,给我一个「灵敏」的回答

而在一些靠近客户或者更正经的场合里,我也不错双击让它给我拟一个多礼的回答。

这是因为千问语音输入法解救了「场景感知」。它自动识别你刻下在什么旁边里,看到你屏幕上的实验,据此调整输出的作风。你无用告诉它更多布景,它我方就能看懂。

下周要出差,我班师双击,在微信让它帮我证实聊天信息,整理成一个出行指南便签。

临了给我的这份出行指南,除了航班信息,还贴心性给我整理了待劳动项,并证实当地天气和交通情况给了我一些具体冷落,这对于时常出差的媒体东说念主来说十分友好。

开周会的时候我还发现了一个实用的小手段,会议运行,我双击两下唤起千问语音输入法,拆伙后一句:「帮我把刚才的实验整理成会议纪要。」它就自动帮我整理好了。

这很相宜一些快速拉通的临时会议,无用再单独打开会议记载类的旁边,顺手双击立时记。

对着电脑语言,活儿 AI 我方就干完结

别歪曲,对着电脑喊「帮我查贵府」「写个邮件」,当今只可算 AI 的基本操作。

千问 电脑端此次确凿亮出的底牌,是把语音输入和 PPT 创作、AI 表格、文档处理等功能组合起来,这亦然确凿能帮打工东说念主竣事「每天早放工一小时」的实勤恳能。

拿最折磨东说念主的 PPT 来说,千问不是去素材库里给你勉强烂大街的野生模板,而是班师用大模子的代码智商动态生成复杂排版。要是你以为那边不够圆善?班师多轮对话让它接着改,改到你安靖为止。

为了探探底,我先让它帮我作念个视频号运营课程 PPT,险些在语音落地的倏地,AI 就干预了光速消化模式:填充血肉、匹配逻辑一气呵成。

最令东说念主惊喜的是,千问对「图文穿插」的流露并非上行下效,而是证实实验深度匹配了相反化的版式,整份 PPT 拿出来,险些即是不错班师委派的成稿。

这还没完,你还能一次性给千问喂最多 39 种不同体式的参考文献,让它自动梳理逻辑、索要要点,帮你省去了走动翻贵府的空匮。至于配图,它也能证实高下文自动匹配,找不着合适的以致能就地给你生图,全程都不需要你切出界面去乞助搜索引擎、或者下载下来用 office 处理。

表格处理方面,千问的 Excel Agent 主打一个高水准。

岂论是体式糟蹋的聊天截图、手写札记,如故大段的纯文本,丢给它就能快速生成范例的 Excel 表格。要是后续还要算算增长率、画个趋势图,也无用再去头疼奈何写函数公式了,班师用当然语言嘱咐它就能解决。

我试了一个略略有点复杂的需求:让它证实 2026 广州最新版初中英语课本,把各句型的语法结构、时态变化和参考例句整理成 Excel 表格,体式要相宜一页纸打印,便捷拿来背诵。

换以前,这种事得我方一条条查贵府、手动录入、再调体式,至少要折腾半小时。当今说一句话,它班师把表格生成好,列名、行距、例句填充,基本不需要再启程点改。

文档处理这边,Word/PDF Agent 解救图文数据羼杂上传,能自动排版并输出班师可委派的文献。

更有敬爱的是,传完长文档你不需要我方去翻阅找要点,班师张嘴问,它就能快速定位给出谜底;想修改那边亦然一句话的事儿,省去了我方去对照原文献少许点改的空匮。

我试着传了一份杂沓词语的条约 PDF,班师问它:「独家授权实验是哪些?」它并莫得傻傻地把全文复述一遍,而是精确定位到了授权条目,把独家领域、授权期限和截至事项一条条列得明领会白。

面前,这个语音指示以致还能和 AI 写代码、手搓网页等任务助理功能组合使用,照这个架势下去,改日的办公形态,未必简直即是「动动嘴皮子就把活儿干了」。

和 AI 语言的东说念主,会比键盘打字的东说念主更早放工

用了一段时候千问语音输入法,我猜测一件事。

曩昔几年「AI 进步办公服从」喊得震天响,但大部分东说念主的体验是:我跟 AI 说了半天,它给我的东西根底弗成用。然后就以为 AI 也不外如斯。

问题出在哪?出在同样姿色上。你用键盘跟 AI 对话,40% 的元气心灵花在组织笔墨上,只剩 60% 在想你到底要什么。给出去的指示信息密度低、高下文薄,AI 虽然输出垃圾。这不是 AI 不行,是你喂给它的东西不行。

语音把这个死结解开了。语言时你不会给我方设字数截至,细节会当然地冒出来,高下文会自动变厚。它能把嘴里说出的当然语言需求梳理得井井有条,让   AI   精确彭胀。

纽约销售平台 Clay 的评释注解负责东说念主 Yash Tekriwal 提到,他用语音输入的速率是每分钟 205 个词,打字唯一 110 到 120 个。但速率还不是最要津的,他发现口述的 prompt 质料更高。

AI 圈最近有个词卓越火,叫 harness。它的敬爱未必是:你有一匹马(AI 的智商),但你得有一套缰绳智力支配它,让它往你要的标的跑。莫得 harness,马再雄厚也仅仅在原地打转。

千问电脑版的语音输入法即是这套 harness。

它贯穿的一端是你的嘴,另一端是 AI 的全套办公智商:PPT、表格、文档、搜索、分析、体式转念。你说一句话,它把你的意图翻译成 AI 能彭胀的指示,然后调治对应的 Agent 去跑腿。它不是输入法,是缰绳。是你支配 AI 办公智商的那套 harness。

而别的「带 AI 功能的输入法」解决的是什么?是进口问题,帮你找到 AI 在那边。千问解决的是支配问题,帮你把 AI 的智商精确地用起来。一个是给你指路,一个是帮你套好缰绳班师启程。差距就在这。

在 Agent 时期,语音本来是驱动   AI   职责的最当然和高效的姿色。千问语音输入法,即是率先在桌面进口端出了这套 harness 的居品 ,这亦然为什么我期待,改日在更多结尾上,能看到这种确凿能支配 AI 的语音进口。

客岁这个时候,要是你在办公室倏地对着电脑语言,一次两次会被当成在打电话,三番五次就不禁让东说念主怀疑,职责压力是不是太大了,精神景况还好吗?

本年运行,那些对着电脑自言自语的,可能即是全公司最早放工 ( 摸鱼 ) 的东说念主。

附客户端下载地址:

https://www.qianwen.com/开云kaiyun中国官网入口download?ch=tongyi_redirect

网页版体验地址:

https://www.qianwen.com/

滚球app中国官网下载入口