Les jeunes du futur n’auront peut-être pas vraiment besoin d’apprendre à dactylographier.

📅 2026-09-04

Résumé :

Ces derniers jours, tout le monde a dû être ennuyé par la nouvelle fonction de test des niveaux de gris de WeChat. Premièrement, en mode de saisie vocale, la bordure de « appuyer et maintenir pour parler » devient soudainement épaisse et noire, de peur que vous ne puissiez pas la voir. Ensuite, en mode de saisie de texte, la zone de saisie vous rappelle :

Vous pouvez appuyer et maintenir enfoncé pour convertir le texte.


Qu'est-ce que cela signifie ?

Dans le passé, "Appuyez et maintenez pour parler" vous obligeait à passer en mode vocal avant de pouvoir l'utiliser. Ce que vous avez lâché prise était la voix originale, et ce qui a été entendu de l'autre côté était votre foutue charmante voix de bulle (à moins que vous n'ayez activement choisi de la convertir en texte).


Mais maintenant, il vous suffit de maintenir la zone de saisie enfoncée pour parler, et la voix se transformera directement en texte, et elle sera envoyée lorsque vous lâcherez prise.


À première vue, cela semble très pratique. Vous pouvez l'envoyer directement après l'avoir dit. Cependant, la première réaction de nombreux internautes est de se plaindre, et il est trop facile de déclencher accidentellement la mort sociale.


Mais le mauvais critique ne s'en plaint pas aujourd'hui.

Avez-vous remarqué qu'il y a trop d'endroits pour la saisie vocale dans cette application ?

Vous devez savoir qu'il y a quelque temps, WeChat a simplement placé un bouton de microphone (+1) sur le côté droit de la zone de saisie, et vous pouvez convertir la parole en texte en un seul clic. De plus, cette fois, appuyez et maintenez la zone de saisie (+1), appuyez et maintenez pour parler en mode vocal (+1), ainsi que la touche vocale de la méthode de saisie (+1) et la propre dictée du système (+1).

Maintenant, lorsque vous ouvrez WeChat, 5 portails vocaux dans la moitié inférieure de l'écran attendent que vous parliez.


Guigui, tu as vraiment envie d'écouter le caisson de basse de Mr. Bad Review ?

Ce serait bien si cette situation n'apparaissait que dans WeChat sur le téléphone mobile. Le problème est que de nombreuses applications fonctionnent ainsi désormais, du téléphone mobile à l’ordinateur.

Par exemple, la version de bureau Mac de WeChat avait auparavant la même invite, vous demandant d'appuyer et de maintenir Fn pour saisir du texte vocalement.


Dans la zone de saisie du bureau Feishu, il y a également une ligne « Maintenez Fn enfoncée pour parler » pour convertir la parole en texte.


Frères, vous ne savez vraiment pas à quel point Fn est important sur Mac, n'est-ce pas ? Toutes les touches haute fréquence de la méthode de saisie et de la zone fonctionnelle sont-elles occupées par votre voix ?

Ne vous inquiétez pas, c'est ici que nous allons.

Dans le document Feishu, si vous ouvrez une grille dans un tableau, vous constaterez qu'il y a également un texte de synthèse vocale dans le coin supérieur droit.


Disons-le de cette façon, si vous ouvrez une grande application d'usine maintenant, vous verrez un tas de microphones vous faire signe : Oncle, viens à moi...


Soyons raisonnables et faisons une saisie vocale, personne n'a d'objection, les choix multiples sont toujours une bonne chose.

Mais la posture actuelle va évidemment plus loin que « vous donner plus d'options » :

Certains utilisent du texte pour vous le rappeler, certains placent l'entrée à l'endroit le plus visible, et certains font simplement en sorte que le bouton soit très grand.

Il semblerait que les grands constructeurs se soient mis d'accord pour donner la priorité à la voix, de peur que l'on ne parle pas dans l'application.

En voyant cela, vous devez être curieux de savoir pourquoi, quelle est la magie de cette saisie vocale ?

Au début, le mauvais critique pensait que c'était assez simple, facile à utiliser et bon marché.

L'efficacité de saisie est élevée par rapport au Pinyin et le coût n'est pas élevé.

Selon le prix indiqué sur le site officiel de Volcano Engine, la reconnaissance vocale en streaming de Doubao coûte moins de 1 yuan par heure. Même si un gros utilisateur envoie 10 minutes de discours chaque jour, cela ne coûte que 60 yuans par an. Il s'agit toujours du prix de détail, et il sera seulement moins cher pour les grands fabricants d'utiliser leurs propres modèles.


Mais le problème est :

La saisie vocale n'est pas nouvelle du tout. Siri est capable de prendre des dictées il y a plus de dix ans et la recherche vocale sur Amap est disponible depuis de nombreuses années. Pourquoi la priorité vocale est-elle si élevée maintenant ?

Plus tard, j'y ai réfléchi et j'ai réalisé que la clé réside peut-être dans la méthode de saisie.

J'ai déjà écrit sur les méthodes de saisie des principaux fabricants, en disant que la méthode de saisie est comme un agent de sécurité gardant la porte de toutes les applications. Il connaît d'abord tous vos besoins, puis l'application.

Par exemple, si vous posez une question dans l'application Doubao, la méthode de saisie WeChat peut vous avoir renvoyé la réponse avant que vous ne cliquiez sur envoyer.


De même, si vous envoyez un message dans WeChat et que vous tapez en utilisant la méthode de saisie Beanbao, WeChat ne veut certainement pas voir cette scène.

Il y a de nombreuses années, la méthode de saisie Sogou dépassait celle de Baidu.

Les utilisateurs sont tous sur Baidu et les mots candidats qui apparaissent lors de la saisie sont directement dirigés vers Sogou pour la recherche.


Les applications doivent donc réfléchir : existe-t-il un moyen pour les utilisateurs d'interagir directement avec moi et de contourner la sécurité de la méthode de saisie ?

Parole en texte.

En effet, cette technologie existait il y a de nombreuses années, mais à cette époque, le coût était élevé et la précision faible.

Avec le développement de modèles vocaux à grande échelle au cours des deux dernières années, sa précision et sa vitesse de réponse sont devenues presque parfaites.

On peut dire que la synthèse voix-texte prise en charge par l'IA donne à l'application la possibilité de travailler seule pour la première fois sans craindre d'être interceptée par la méthode de saisie.


Mais ce n'est que de la "défense". Regardons un peu plus loin : les grands constructeurs sont effectivement à l’offensive, s’emparant par avance de l’entrée de la prochaine génération d’interactions.

Aujourd'hui, si vous maintenez enfoncé pour parler, l'application vous aidera à convertir vos mots en mots ; demain, si vous appuyez et maintenez pour parler, l'application réservera-t-elle directement un vol pour vous ?

Il existe déjà des applications natives d'IA qui peuvent le faire, mais des applications comme WeChat et Feishu veulent également aller dans cette direction, elles forment donc d'abord les utilisateurs à parler, puis à avoir des conversations directes avec les agents pour répondre à leurs besoins.

Dans la prochaine génération d'applications, vous devez ouvrir la bouche et parler → L'IA fera le travail directement.

Mais ce processus doit être progressif.

Les principales applications doivent désormais faire de leur mieux pour guider et cultiver l'habitude des utilisateurs de parler dans leurs propres applications, puis intégrer progressivement diverses fonctions de résumé et de recherche de l'IA dans les commandes vocales.

C'est pourquoi tout le monde favorise la reconnaissance vocale.


Mais ce n’est pas la fin.

Ce phénomène va également s'étendre à la plupart des applications du marché à l'avenir.

Parce qu'à l'ère de l'incrémentation, tout le monde est en compétition avec celui qui peut courir plus vite, tandis qu'à l'ère du stock, tout le monde est en compétition avec celui qui peut mordre plus fort. Lorsque le gâteau ne grossit plus, chaque famille ne peut récupérer que ce qu'il y a dans son propre bol.

Dans cette situation, toute fonction qui peut être combinée avec l'IA et rendre les utilisateurs dépendants, tant que la première entreprise le fait, la deuxième entreprise suivra. Parce que les utilisateurs sont dépendants, la demande du marché va changer, et si vous ne le faites pas, vous serez privé d’utilisateurs.

Ne me croyez pas, critiquez-vous simplement. Je suis un exemple vivant d’une formation réussie dans une grande entreprise.

Quand j'ai vu ces entrées vocales pour la première fois, je me suis dit : je tape depuis plus de dix ans et la vitesse de ma main n'est pas lente, alors pourquoi devrais-je parler à mon téléphone ?

Après l'avoir essayé plusieurs fois, j'ai trouvé que la reconnaissance est vraiment rapide et précise, et que toute ambiguïté peut être automatiquement corrigée.

Il y a quelques mois, je tapais toujours par défaut et j'utilisais simplement la voix parce que j'étais trop paresseux pour le faire...

Et maintenant ?

Je ne tape jamais quand je peux ouvrir la bouche. Même lorsque je suis assis au bureau en train d'écrire un manuscrit, j'ai envie de dicter. Mes doigts ne me font plus mal et ma vitesse de saisie est plus rapide. Au contraire, lorsque je reviens occasionnellement à la méthode de saisie, je me demande pourquoi c'est si pénible.


Bien sûr, ma dépendance à l’IA va bien au-delà.

Maintenant que je vois un long article, je n’ai pas la patience de le lire du début à la fin, je laisse donc à l’IA le soin de résumer les points clés. Si je souhaite vérifier des actualités ou des vidéos sur Twitter, @Grok laissera tomber ; Lorsque je recherche habituellement des informations, je lis simplement le résumé de l'IA, et si c'est difficile, je laisse différents agents s'en occuper pour moi.


Je n'ai pas vraiment prêté attention à ces fonctions lorsqu'elles sont apparues pour la première fois, mais après les avoir expérimentées plusieurs fois, je ne pouvais plus vivre sans elles sans même m'en rendre compte.

Lorsque vous et moi comptons tous les deux sur l'IA comme celle-ci, la demande du marché est subtilement réécrite.

Tout le monde ne pourra pas utiliser une application sans voix IA et sans résumé IA. Afin de s’adapter au marché, les développeurs d’applications devront naturellement emboîter le pas pour proposer ces fonctionnalités.

Peut-être que bientôt la méthode de saisie ne sera plus une nécessité.

Lorsque nous avons commencé à parler de ce sujet, l'équipe éditoriale plaisantait encore :

Si la saisie vocale continue ainsi, les jeunes du futur ne seront peut-être même pas capables de taper du pinyin.

Cela peut paraître un peu effrayant au début, mais le jour venu, cela n'aura pas d'importance si vous ne savez pas taper le pinyin ? Chaque génération a ses propres compétences. La génération précédente pensait que nous ne pouvions pas réparer les ampoules ou taper à cinq temps, mais nous vivions quand même une assez bonne vie.

La méthode de saisie n'a jamais été un objectif, c'est simplement un moyen de connecter les personnes et les machines. Lorsqu’un jour une nouvelle route deviendra plus pratique, personne ne manquera l’ancienne route.

La roue des temps avance, et il y a toujours des compétences qui disparaîtront lentement avec l'évolution du fonctionnement de la société.

Tags associés

Articles similaires

Commentaires

0/500
Captcha (click to refresh)
Aucun commentaire