Bêta publique de QwenWork : comment Qwen3.8-Max transforme les invites en travail déployable

Alibaba a ouvert la bêta publique de QwenWork, connu en chinois sous le nom de 千问办公, le 3 août 2026. Le produit est positionné comme une plateforme d'agent IA tout-en-un pour le travail, destinée aux particuliers et aux

发布于 2026年8月6日generalGEO 评分: 014 次阅读
L'image présente la bannière promotionnelle de la bêta publique de QwenWork. Le fond est sombre, avec le logo QwenWork à gauche et le texte « QwenWork Public Beta » en grands caractères à droite. Au centre, le texte « Qwen3.8-Max Turns Prompts Into Deployable Work » apparaît en violet. En bas à gauche se trouve un encadré « Prompt », suivi à droite des icônes « + », « Workflow », « API », « Report », tandis que l'encadré de droite indique « Deployable Work » ainsi que App, Workflow, API, Report. Cette image correspond au contenu du document décrivant la bêta publique de QwenWork, qui transforme les invites en travail déployable.

QwenWork Version bêta publique : comment Qwen3.8-Max transforme des consignes en travaux exploitables

Introduction

Alibaba a ouvert la version bêta publique de QwenWork, connu en chinois sous le nom de 千问办公, le 3 août 2026.

Le produit est positionné comme une plateforme tout-en-un d'agent IA pour le travail, destinée aux particuliers et aux entreprises. Il combine les capacités des précédents produits agents d'Alibaba, Qoderwork, Mulerun et Wukong, puis les connecte au modèle nouvellement publié Qwen3.8-Max.

L'important n'est pas simplement que QwenWork puisse écrire du texte ou répondre à des questions. Sa promesse centrale est qu'une seule requête peut produire quelque chose que les gens peuvent immédiatement utiliser : une page web fonctionnelle, un document, une feuille de calcul, une présentation, un ensemble d'images, une vidéo, un flux de travail planifié ou une tâche accomplie via des systèmes métier connectés.

QwenWork est actuellement disponible en Chine via une interface web et un client de bureau. Alibaba l'intègre également à DingTalk, tandis qu'une application mobile autonome et une édition internationale sont prévues pour plus tard.

Ce guide suit la séquence pratique originale : d'abord, ce que QwenWork peut créer ; ensuite, comment il s'intègre dans les flux de travail des entreprises ; comment fonctionnent les compétences organisationnelles réutilisables ; ce que Qwen3.8-Max apporte en dessous ; et enfin, ce que les utilisateurs devraient savoir avant d'essayer la version bêta publique.

QwenWork est conçu pour livrer, pas seulement générer

De nombreux outils d'IA s'arrêtent au brouillon.

Ils rédigent du contenu, suggèrent du code, génèrent une image ou esquissent un rapport. L'utilisateur doit encore déplacer le résultat dans un autre outil, construire l'interface, configurer l'hébergement, connecter une base de données, assembler le document final et vérifier que tout fonctionne.

QwenWork tente d'absorber davantage de ce travail inachevé dans l'agent lui-même.

Alibaba décrit la plateforme comme prenant en charge :

  • La création de contenu
  • L'analyse de données
  • La recherche professionnelle
  • Le traitement de fichiers
  • La génération de présentations
  • La création de documents
  • Le montage vidéo
  • Le développement de pages web interactives
  • L'automatisation de navigateur
  • Les tâches planifiées
  • Les connexions aux systèmes métier
  • Les compétences réutilisables et les kits d'experts

Son flux de travail de développement web est particulièrement central au positionnement du produit.

Un utilisateur peut décrire l'application souhaitée en langage naturel. QwenWork peut ensuite créer une expérience basée sur HTML, fournir une adresse hébergée, connecter le stockage de données si nécessaire et vérifier le résultat par une interaction dans le navigateur.

L'objectif est de réduire l'écart entre « l'IA a généré quelque chose » et « le travail est prêt à être ouvert, partagé ou utilisé ».

Test 1 : transformer une longue interview en carte de signaux interactive

Le premier test de l'article source utilisait une interview récente de Sam Altman du podcast Invest Like the Best.

La demande n'était pas simplement de résumer la vidéo. QwenWork devait transformer l'intégralité de l'interview en une « carte de signaux » explorable et vérifiable dans laquelle les lecteurs pouvaient naviguer parmi les affirmations, les preuves, les citations et les horodatages.

Après avoir reçu la vidéo, l'agent aurait :

  1. Extrait la piste audio.
  2. Installé un modèle de transcription.
  3. Téléchargé les bibliothèques CUDA requises.
  4. Exécuté la transcription sur un GPU NVIDIA local.
  5. Analysé la transcription.
  6. Conçu et construit une page web.
  7. Démarré le service.
  8. Ouvert le résultat dans un navigateur pour validation.

Cette image montre l'interface de QwenWork traitant un fichier vidéo. En haut, une invite indique la création d'un produit de navigation vidéo longue durée basé sur la vidéo complète téléchargée. En bas, les informations vidéo sont affichées, telles que la durée, la résolution, la source, etc., ainsi qu'une liste de 13 étapes terminées, notamment la vérification de l'existence du fichier vidéo, l'extraction et la transcription de l'audio, et 7 étapes accomplies, comme l'installation de l'outil de transcription whisper. En bas, l'état « Traitement en cours... » affiche l'exécution d'une commande. Cette image est étroitement liée au contexte et présente visuellement les étapes et l'état du traitement du fichier vidéo par QwenWork.

L'expérience achevée a divisé l'interview en 15 chapitres.

Chaque chapitre présentait d'abord la conclusion principale, suivie des preuves à l'appui. La sélection d'un chapitre, d'une citation ou d'une affirmation déplaçait le lecteur vidéo vers l'horodatage correspondant.

Cette image montre le résultat de QwenWork convertissant la vidéo d'interview de Sam Altman en un « graphe de signaux » interactif. À gauche, l'image vidéo montre deux personnes discutant dans une bibliothèque, avec une chronologie et des boutons de contrôle de lecture en dessous. À droite, le contenu textuel affiche le titre « L'intelligence pourrait devenir moins chère, ce qui manque vraiment, c'est la capacité de la livrer au monde », avec des commentaires connexes et un bouton « Développer le texte complet ». Ce graphe divise l'interview en 15 chapitres, chaque chapitre présentant d'abord la conclusion principale, puis les preuves à l'appui ; la sélection d'un chapitre, d'une citation ou d'une déclaration permet de passer à l'horodatage correspondant. C'est un exemple de produit d'information interactif généré par QwenWork.

La sortie comprenait également :

  • Un index consultable des personnes, déclarations et chiffres
  • Une comparaison des arguments opposés
  • Dix moments forts sélectionnés
  • Une playlist personnelle
  • Des contrôles d'exportation
  • Un mode de briefing de cinq minutes

C'est un exemple utile de la philosophie produit de QwenWork.

Un résumé conventionnel élimine le besoin de regarder la vidéo complète, mais supprime également une grande partie des preuves. L'interface générée a préservé le média d'origine et a facilité son examen.

Le résultat n'était pas simplement un paragraphe d'analyse. C'était un petit produit d'information.

Les utilisateurs doivent toujours vérifier les citations, horodatages et interprétations générés avant de les publier. Une interface soignée peut contenir des erreurs de transcription ou des analyses trop confiantes.

Test 2 : Construction d'une démonstration interactive de moteur turbofan

Le test suivant a augmenté la complexité technique.

QwenWork a été chargé de construire une démonstration Three.js expliquant le fonctionnement d'un moteur turbofan à haut taux de dilution. Selon les informations, la spécification comptait plusieurs milliers de caractères chinois et incluait des exigences de planification, de comportement visuel, d'interaction et de contrôles de livraison.

L'agent a renvoyé environ 1 200 lignes de code.

Le résultat publié affichait un moteur en coupe avec des composants visibles, notamment l'entrée d'air, la soufflante, le compresseur, la chambre de combustion, la turbine, l'arbre central, le conduit de dérivation et le système d'échappement.

Cette image montre la démonstration Three.js créée par QwenWork lors du test 2 pour expliquer le principe de fonctionnement d'un moteur turbofan à haut taux de dilution. L'écran présente un modèle de moteur en coupe révélant sa structure interne, y compris l'entrée d'air, la soufflante, le compresseur, la chambre de combustion, la turbine, l'arbre central, le conduit de dérivation et le système d'échappement. À droite, des informations sur les paramètres sont affichées, telles que la poussée, le taux de poussée, l'efficacité de poussée, etc. Cette image est étroitement liée au contexte et présente visuellement l'effet de la démonstration du moteur turbofan à haut taux de dilution réalisée par QwenWork, illustrant ses capacités dans des tâches techniquement complexes.

Lorsque l'animation était lue, les arbres tournaient à des vitesses différentes. Des particules d'air entraient dans le moteur et se divisaient au niveau de la section de dérivation. La plupart traversaient le flux externe, tandis que l'air restant entrait dans le cœur, passait par la compression et la combustion, puis sortait par la tuyère.

L'interface prenait également en charge une vue éclatée avec des composants étiquetés.

Ce type de sortie est utile pour l'éducation, la vente technique, la formation et l'explication de produits, car l'utilisateur peut interagir avec le concept au lieu de lire un texte statique.

description.

Elle expose également une limite importante : la cohérence visuelle ne garantit pas l’exactitude technique. Un expert du domaine doit vérifier la géométrie, la rotation, les températures, le taux de dilution, le débit d’air, les étiquettes et le texte explicatif avant que la page ne soit utilisée pour une formation technique.

QwenWork peut produire des supports de campagne multimodaux en une seule tâche

La troisième démonstration portait sur un produit fictif de café froid à l’avoine appelé Daywake.

Une campagne de lancement classique impliquerait une équipe stratégie, des rédacteurs, des designers, des gestionnaires de réseaux sociaux et des monteurs vidéo. Le test demandait à QwenWork de produire l’ensemble de la campagne comme une tâche coordonnée.

L’aperçu des livrables comprenait :

  • Un plan de communication de lancement
  • Un article produit
  • Une affiche visuelle principale
  • Trois images pour les réseaux sociaux
  • Une vidéo promotionnelle de 30 secondes
  • Une publicité audio
  • Des textes pour plusieurs canaux sociaux

Image montrant l’aperçu des livrables de QwenWork pour la campagne produit Daywake, comprenant 6 éléments. 01 : plan de communication, environ 1540 mots, avec positionnement, persona, scénarios, rythme de la première semaine et calendrier sur quatre canaux ; 02 : article produit, DOCX + MD, 851 mots, titre de 14 caractères, introduction de moins de 80 caractères, sans termes exagérés ; 03 : visuel principal et images sociales, affiche 4:5 de 1856×2304 + trois images de scène 3:4, chacune avec une légende de ≤20 caractères ; 04 : vidéo promotionnelle, 30,0 secondes, 1080×1920, avec version sous-titrée, version sans sous-titres, script de narration et storyboard DOCX ; 05 : publicité audio, MP3 de 21,5 secondes + transcription DOCX ; 06 : textes sociaux, titres WeChat ×3, Weibo, Xiaohongshu, Moments, titres de vidéos courtes ×3.

Les textes ont été adaptés pour des canaux comme WeChat, Weibo, Xiaohongshu, Moments et les plateformes de vidéos courtes.

C’est important car la génération multimodale est souvent fragmentée. Un utilisateur peut écrire dans un outil, créer des graphiques dans un autre, passer à un troisième système pour la vidéo, puis reformater le message pour chaque plateforme. QwenWork tente de maintenir la stratégie, le langage, l’identité visuelle et les tâches de production au sein d’une seule session d’agent.

Un lancement de produit réel nécessite toujours des vérifications sur les allégations produit, les ingrédients, les marques, les règles des plateformes, la cohérence visuelle, les licences musicales, la qualité de la traduction et les exigences légales.

QwenWork peut réduire le cycle de production. Cela ne transfère pas la responsabilité de l’organisation qui publie le contenu.

Les documents bureautiques font partie du même flux de travail

QwenWork prend également en charge des livrables professionnels tels que des documents Word, des présentations, des feuilles de calcul, des PDF, des fichiers Markdown, des rapports, des visualisations de données et des pages web publiées.

La documentation officielle du produit indique que les utilisateurs de bureau peuvent travailler avec des fichiers locaux approuvés, analyser des PDF, peaufiner des documents Word, extraire des données Excel, générer des présentations, éditer des vidéos et enregistrer les résultats dans un dossier sélectionné.

L’avantage pratique est la continuité. Une tâche de recherche peut commencer par la collecte de sources, se poursuivre par l’analyse, produire une feuille de calcul et une présentation, et se terminer par une page web partageable sans relancer le projet dans plusieurs outils isolés.

QwenWork est également une plateforme d’agents d’entreprise

La différence majeure apparaît lorsque l’agent entre dans une organisation réelle.

La plupart du contexte d’une entreprise ne vit pas dans une fenêtre de chat IA. Il est réparti entre les fils de messagerie instantanée, les calendriers, les documents, les bases de connaissances, les e-mails, les systèmes d’approbation, les bases de données, les outils de reporting, les structures d’équipe et les applications internes.

Un assistant IA général ne voit que les informations saisies manuellement

L'approche entreprise de QwenWork consiste à connecter l'agent aux systèmes de collaboration et aux systèmes métier afin qu'il puisse agir sur le contexte organisationnel plutôt que sur des requêtes isolées.

Le lancement officiel d'Alibaba met en avant l'intégration avec DingTalk. Les utilisateurs peuvent demander à l'agent de créer des documents, de résumer des discussions de groupe, de planifier des événements, d'envoyer des messages et de traiter des e-mails tout en restant dans l'environnement de collaboration.

Le test bêta mentionné dans l'article source comptait 25 capacités de niveau entreprise couvrant des domaines tels que la messagerie instantanée, les approbations, les calendriers, les documents, les bases de connaissances et la messagerie électronique. Ce chiffre doit être compris comme une observation de la période de lancement plutôt que comme une spécification produit permanente, car les intégrations et les droits d'accès peuvent évoluer.

Des discussions de groupe au contexte exécutable

Prenons l'exemple d'une tâche de rapport hebdomadaire.

Un utilisateur pourrait demander à QwenWork de collecter les réunions de la semaine précédente, les éléments de tâche ouverts, la progression des OKR, les décisions des groupes de projet, les retards, les obstacles et les échéances à venir.

L'agent peut transformer ces informations en un document hebdomadaire et l'archiver dans la base de connaissances de l'entreprise.

La différence ne réside pas dans la capacité à rédiger un rapport. De nombreux modèles peuvent le faire.

La différence réside dans la réduction du travail manuel nécessaire pour assembler le contexte avant la rédaction, puis pour réintégrer le résultat dans le système de l'entreprise.

Le même modèle peut être appliqué à :

  • Les synthèses commerciales
  • Les mises à jour de projet
  • Les revues de contrats
  • La préparation de réunions
  • La coordination de recrutement
  • Les rapports financiers
  • L'analyse des retours clients
  • La veille marché
  • Les synthèses de recherche

La valeur pour l'entreprise apparaît lorsque l'agent peut passer de manière fiable des données sources à un résultat validé dans le flux de travail existant de l'entreprise.

Les tâches planifiées transforment l'agent en travailleur récurrent

QwenWork prend en charge les tâches planifiées ponctuelles, à intervalle, horaires, quotidiennes, hebdomadaires et mensuelles.

Un utilisateur peut décrire le planning en langage naturel :

Chaque jour ouvré à 9h00, collecter les dernières discussions sur les agents IA provenant de sources approuvées,
résumer les cinq changements les plus importants, enregistrer le rapport au format Markdown,
et envoyer le résultat au groupe de recherche DingTalk.

La documentation officielle recommande aux utilisateurs d'exécuter manuellement une tâche complexe avant de la convertir en planning. Cela permet de tester au préalable l'invite, les sources de données, le format de sortie et l'utilisation prévue des crédits.

Une exécution planifiée peut utiliser les mêmes capacités qu'une session normale, notamment les compétences, les connecteurs, l'automatisation du navigateur, les outils MCP et l'accès aux fichiers autorisés.

Un détail opérationnel est facile à manquer : les tâches planifiées sur ordinateur de bureau sont exécutées par le client local. Si l'ordinateur est en veille ou éteint à l'heure planifiée, la tâche peut ne pas s'exécuter automatiquement.

Les utilisateurs doivent également surveiller la consommation de crédits, car chaque exécution planifiée crée une tâche distincte et peut invoquer des modèles, des outils, des recherches et un traitement multimodal.

Les compétences organisationnelles transforment l'expérience en processus réutilisable

L'un des concepts d'entreprise les plus importants de QwenWork est la compétence organisationnelle.

Une compétence regroupe une manière réutilisable d'exécuter un travail. Elle peut contenir :

  • Des instructions
  • Des critères de décision
  • Des modèles
  • Des choix d'outils
  • Des connexions de données
  • Des sorties

exigences

  • Étapes de révision
  • Connaissances du domaine

L'article source donne l'exemple d'un associé d'un cabinet d'avocats qui réalise le premier rapport de due diligence en fusion-acquisition de l'organisation grâce à un travail répété avec QwenWork.

Une fois le processus affiné, il peut être enregistré comme compétence organisationnelle et partagé.

Un nouvel assistant peut ensuite invoquer la compétence, sélectionner le chemin d'exécution approprié et produire un rapport en utilisant le processus établi du cabinet plutôt que de partir d'une invite vierge.

La valeur ne réside pas seulement dans une production plus rapide.

L'organisation convertit les connaissances tacites — la manière dont une personne expérimentée aborde réellement la tâche — en une ressource qui peut être inspectée, réutilisée et améliorée.

Les kits d'expert couvrent des rôles et des industries spécifiques

Pendant la période bêta, l'article source a signalé plus de 70 compétences individuelles et plus d'une douzaine de kits d'expert.

Le catalogue visible comprenait des domaines tels que la conception de produits, la recherche en investissement, la gestion des contrats, le travail juridique d'entreprise, la finance et la fiscalité d'entreprise, la prestation de conseil, la gestion de patrimoine, le conseil en services technologiques, l'investissement en actions et les flux de travail de contentieux.

L'image présente les kits d'expert QwenWork destinés à différents rôles/industries. Le marché en compte 0 installé, incluant 11 kits d'expert : conception de produits, recherche en investissement, gestion des contrats, affaires juridiques d'entreprise, finance et fiscalité d'entreprise, prestation de conseil, gestion de patrimoine, conseil en services technologiques, investissement en actions, boîte à outils de contentieux civil chinois et activités de banque d'investissement. Chaque kit comprend un nombre de compétences correspondant, des connexions de données et un numéro de version. Ces kits d'expert sont des boîtes à outils combinant connaissances professionnelles, flux de travail et critères de jugement, en adéquation avec le concept de kits d'expert présenté dans le document, et en illustrant visuellement leur catégorisation et leurs versions.

La documentation officielle de QwenWork décrit les kits d'expert comme des packages combinant connaissances professionnelles, flux de travail et critères de jugement pour un rôle ou une industrie particulière.

Cela diffère d'une bibliothèque de prompts génériques.

Un kit d'expert utile doit encoder non seulement quoi écrire, mais aussi quelles questions poser, quelles preuves collecter, quels risques signaler, quelle structure suivre, quels résultats produire et quelles décisions nécessitent une révision humaine.

Les organisations devraient inspecter et valider ces kits avant de s'y fier pour des travaux juridiques, financiers, de conformité, médicaux ou d'autres tâches conséquentes.

Les connecteurs étendent QwenWork au-delà de sa propre interface

Les connecteurs QwenWork relient l'agent à des outils externes, des comptes, des données et des applications.

L'interface de la période de lancement présentée dans la source incluait des intégrations ou des catégories de connecteurs impliquant les navigateurs, le contrôle d'ordinateur local, les applications macOS, Microsoft 365, DingTalk, Feishu, Slack, LINE, Notion et Linear.

L'image présente l'interface des connecteurs de QwenWork. En haut, le titre « Connecteurs » indique qu'ils permettent de lier des données et applications externes pour améliorer l'efficacité du travail. Un connecteur est installé, incluant navigateur, contrôle d'ordinateur local, applications macOS, Microsoft 365, DingTalk, Feishu, Slack, LINE, Notion, Linear, etc. Chaque connecteur dispose d'une icône « + » à droite pour effectuer des opérations. En bas de l'interface se trouvent les onglets « Connecteurs », « Compétences » et « Agents d'entreprise ». Cette image est étroitement liée au contexte et présente visuellement les types de connecteurs QwenWork et leur état d'installation, illustrant les outils et applications externes auxquels les connecteurs peuvent se relier pour améliorer l'efficacité du travail.

La documentation de bureau actuelle répertorie également la prise en charge des canaux de messagerie pour DingTalk, Feishu, Lark, WeChat, WeCom, Slack et WhatsApp, bien que la disponibilité exacte puisse dépendre de la version, des paramètres organisationnels, de la région et de l'approbation de l'administrateur.

Les connecteurs rendent l'agent plus utile, mais ils augmentent également les risques.

Chaque connexion doit suivre le principe du moindre privilège.

principes :

  1. N’accorder que l’accès aux données nécessaire à la tâche.
  2. Séparer les permissions de lecture des permissions d’écriture.
  3. Exiger une approbation pour les actions importantes.
  4. Journaliser les appels d’outils et les modifications externes.
  5. Examiner le traitement des données par des tiers.
  6. Supprimer les connexions inutilisées.
  7. Tester les comportements d’échec et de restauration.

Un agent capable de rédiger un e-mail est différent d’un agent capable de l’envoyer. La frontière des permissions doit rendre cette distinction explicite.

Qwen3.8-Max est le modèle au cœur de l’expérience phare

QwenWork peut utiliser plusieurs niveaux de modèles, mais Qwen3.8-Max est l’option phare mise en avant au lancement.

Alibaba décrit Qwen3.8-Max comme son modèle Qwen le plus performant à ce jour.

Son architecture publiée comprend :

Spécification Qwen3.8-Max
Paramètres totaux 2,4 billions
Paramètres actifs 95 milliards
Architecture Mélange sparse d’experts avec attention hybride
Fenêtre de contexte Jusqu’à 1 million de jetons
Entrée Texte et informations visuelles
Axe principal Codage, travail, recherche, agents multimodaux et tâches à long terme
Poids ouverts Publication prévue par Alibaba après le lancement de l’API

Alibaba a rapporté que le modèle se classait cinquième dans Text Arena, deuxième dans Vision Arena et quatrième dans Frontend Code Arena au lancement.

Les positions dans les classements sont sensibles au facteur temps. Elles décrivent un instant précis et ne doivent pas être considérées comme des classements permanents des modèles.

Pourquoi 2,4 billions de paramètres ne signifie pas que chaque requête utilise 2,4 billions

Qwen3.8-Max utilise une architecture de mélange sparse d’experts.

Le modèle complet contient 2,4 billions de paramètres, mais Alibaba indique qu’environ 95 milliards sont actifs pour une requête.

Une architecture sparse achemine différentes parties de l’entrée à travers des composants experts sélectionnés plutôt que d’activer l’intégralité du modèle en une fois.

Cette conception vise à combiner une grande capacité totale, un comportement expert spécialisé, un coût d’inférence inférieur à celui d’un modèle dense de taille similaire, et une latence réduite par rapport à l’activation de tous les paramètres.

Le nombre de paramètres à lui seul ne détermine pas la qualité d’un modèle.

L’architecture, les données d’entraînement, l’apprentissage par renforcement, la conception de l’évaluation, l’intégration des outils et les systèmes d’inférence affectent tous les performances réelles.

Le contexte d’un million de jetons prend en charge de grands espaces de travail

Une fenêtre de contexte pouvant atteindre un million de jetons peut contenir bien plus de matériel qu’une session de discussion typique.

Des exemples possibles incluent :

  • Un long rapport sectoriel
  • Une archive de contrats
  • Un vaste ensemble de journaux opérationnels
  • Un référentiel de code conséquent
  • De nombreuses transcriptions de réunions
  • La transcription d’une longue vidéo
  • Une collection de documents de projet

Un contexte long réduit la nécessité de diviser manuellement chaque source en petits fragments.

Il ne garantit pas un rappel parfait.

Les utilisateurs doivent toujours organiser clairement les fichiers sources, identifier les documents faisant autorité, demander des preuves, vérifier les chiffres extraits, séparer les versions actuelles et obsolètes, et vérifier si le modèle a utilisé la bonne source.

Une fenêtre de contexte plus grande rend plus d’informations disponibles. Elle ne rend pas automatiquement chaque conclusion correcte.

La capacité d’agent à long terme est au cœur de Qwen3.8-Max

L’annonce du modèle par Alibaba met l’accent sur des tâches nécessitant des heures ou des jours d’exécution continue.

Dans un

public example, Qwen3.8-Max a travaillé de manière autonome sur le projet oh-my-cli pendant plus de dix jours.

Le modèle a créé une boucle de développement auto-évolutive impliquant la réception des issues, la gestion des états de tâches, la répartition des agents, la génération de code, les vérifications de compilation, les tests unitaires, les tests de bout en bout, les pull requests, le monitoring, la récupération et l'itération basée sur les retours.

Alibaba a rapporté qu'après environ 16 jours d'exploitation autonome, le dépôt avait accumulé 265 commits, 127 pull requests et 151 issues.

Ces résultats sont rapportés par le fournisseur, mais la trace du projet est publiquement disponible sur GitHub, ce qui le rend plus vérifiable qu'une démonstration fermée.

La performance à long terme est pertinente pour QwenWork car les tâches professionnelles impliquent souvent de nombreux appels d'outils et des corrections répétées plutôt qu'une seule réponse.

Test 4 : Construction d'une simulation de commandement d'urgence pour 30 000 personnes

L'article source a testé Qwen3.8-Max sur une application interactive plus complexe : un centre de commandement d'urgence météorologique extrême pour un festival de musique avec 30 000 participants.

Le site simulé contenait six zones.

Au cours d'un scénario virtuel de 60 minutes, les événements comprenaient l'approche de la pluie, des fortes précipitations, une panne de courant, la congestion de la foule, des blessures, des pannes de communication et des décisions de gestion de scène.

L'utilisateur agissait en tant que commandant des opérations et allouait des ressources limitées en matière de sécurité, de médecins, d'ambulances, d'éclairage, d'énergie et de contrôle de la foule.

Aux points de décision, la simulation s'interrompait et demandait à l'utilisateur de choisir une action. Le flux de foule résultant, le nombre de blessés, la courbe de risque et le temps d'évacuation changeaient en fonction de la décision.

Cette image concerne la description du test du scénario de commandement d'urgence NIGHTFALL 30K. Le côté gauche de l'interface affiche les étapes détaillées des opérations de la tâche, couvrant les exigences environnementales du test (comme l'adaptation à Windows, le navigateur Chrome, le port 9559 dépendant de httpx), les 7 opérations principales du test simulé, notamment le déclenchement des boutons, le réglage des paramètres, la détermination des plans, la configuration des ressources, la définition des points, le suivi des progrès, la réinitialisation de l'état, etc. Chaque étape est annotée avec des détails opérationnels spécifiques. Le côté droit de l'interface affiche le contenu du suivi des tâches, comprenant plusieurs tâches en attente et une zone de description des tâches. Cette image correspond au contenu du scénario du centre de commandement d'urgence pour 30 000 personnes dans le document, utilisée pour illustrer le processus d'opération et de suivi de ce test.

À la fin, le système a généré un rapport d'analyse post-action.

Il s'agit d'une démonstration solide de la génération coordonnée d'interfaces, de la gestion d'état, de la logique de simulation et du reporting.

Cela ne doit pas être confondu avec un système de planification d'urgence certifié. Un logiciel d'urgence réel nécessite une validation par des experts du domaine, des tests de fiabilité, une accessibilité, une auditabilité, une intégration des données et une approbation par des professionnels responsables.

La multimodalité native correspond à la manière dont les informations de bureau arrivent réellement

Les entrées professionnelles sont rarement du texte propre.

Une tâche réelle peut impliquer un tableau blanc photographié, un tableau scanné, un PDF, une vidéo, un enregistrement de réunion, une page HTML, une feuille de calcul, un document Markdown ou un dossier de fichiers mixtes.

Qwen3.8-Max est conçu comme un modèle multimodal capable de raisonner sur des informations textuelles et visuelles.

Alibaba décrit également des cas d'utilisation impliquant de longues vidéos, des structures visuelles interactives, la reconstruction d'applications à partir de captures d'écran, la transformation 2D en 3D et le montage vidéo.

Dans QwenWork, cela prend en charge des flux de travail où l'utilisateur peut fournir le matériel d'origine plutôt que de tout convertir d'abord en texte brut.

![Cette image présente l'interface d'opération de QwenWork. L'interface affiche clairement le modèle actuellement utilisé, Qwen3.8-Max, et présente également les quatre niveaux de service de QwenWork, à savoir Économique, Base, Avancé et Qwen3.

8-Max,每个档位都标注了对应的适用场景及不同的乘数,其中Qwen3.8-Max为千问最强模型,乘数为1.1x,高级为性能均衡、擅长复杂任务,乘数1x,基础为高性价比、胜任日常任务,乘数0.25x,经济为经济实惠、适合简单任务,乘数0.1x。界面上方还有输入区域,显示“分析这组数据并给出结论”的提示内容,左侧列有可执行的任务选项。](https://we0-cms.oss-cn-beijing.aliyuncs.com/cms-assets/image/2026/08/20d9d692-9418-4dee-8437-3dc4e2246da5-3e89559d-3279-48b3-9fc0-ec66266ebd14.png)

Le lancement officiel d’Alibaba décrit les niveaux Économique, Basique, Avancé et Flagship. Les noms exacts des modèles, les multiplicateurs de crédits et les droits peuvent changer pendant la version bêta.

Les Trois Problèmes que QwenWork Tente de Résoudre

L’article original organise la valeur d’entreprise du produit autour de trois obstacles pratiques.

1. L’Écart de Livrable

Un brouillon généré n’est pas la même chose qu’un résultat final.

Le déploiement, l’hébergement, la mise en forme, la création de fichiers, l’intégration et les tests sont souvent laissés à l’utilisateur.

QwenWork essaie d’inclure davantage de ce travail de dernière ligne droite.

2. La Fragmentation des Outils

Une seule tâche peut être répartie entre de nombreuses applications.

Chaque transfert crée une perte de contexte, un reformatage, un travail en double, une confusion de versions, des autorisations supplémentaires et davantage d’opportunités d’erreurs.

L’approche tout-en-un de QwenWork tente de réduire ces transitions.

3. Le Manque de Contexte Organisationnel

Un assistant général ne sait pas qui relève de qui, quelle politique est en vigueur, ce que le groupe de projet a décidé, où en est une approbation, quel modèle l’entreprise utilise, ni quelle source de données fait autorité.

Les compétences, les connecteurs, les données d’entreprise, l’intégration de messagerie instantanée et les flux de travail réutilisables sont la réponse de QwenWork à ce problème.

Pourquoi les Projets d’Agents d’Entreprise Échouent Encore

Le produit entre sur un marché présentant un risque d’exécution important.

Gartner a prédit que plus de 40 % des projets d’IA agentique seraient annulés d’ici la fin 2027 en raison de coûts croissants, d’une valeur commerciale peu claire ou de contrôles des risques inadéquats.

Le problème n’est pas que les agents n’ont pas de valeur.

C’est qu’une démonstration convaincante peut masquer le travail nécessaire pour rendre un agent fiable en production.

Les organisations doivent encore définir :

  • La propriété
  • Les autorisations
  • Les limites des données
  • Les critères d’évaluation
  • L’approbation humaine
  • La surveillance
  • Les contrôles des coûts
  • La réponse aux incidents
  • Les pistes d’audit
  • Les procédures de rollback

QwenWork aborde plusieurs aspects techniques du déploiement en entreprise, mais l’organisation reste responsable de la gouvernance et de la conception opérationnelle.

Comment Commencer à Utiliser QwenWork

QwenWork est en bêta publique en Chine.

Étape 1 : Ouvrir le Site Officiel

Allez sur :

https://qwenwork.cn/

Les utilisateurs peuvent accéder à la version web ou télécharger le client de bureau.

Étape 2 : Se Connecter

La documentation officielle prend en charge l’accès via des méthodes telles que DingTalk et la connexion par numéro de mobile, selon le point d’entrée.

Étape 3 : Commencer par une Tâche Délimitée

Les bonnes premières tâches incluent :

  • Résumer un PDF approuvé
  • Créer une présentation à partir d’un bref résumé
  • Analyser une feuille de calcul
  • Construire une simple page web interne
  • Transformer un flux de travail manuel réussi en tâche planifiée

Évitez de commencer avec un accès illimité à des systèmes sensibles.

Étape 4 : Sélectionner le Niveau de Modèle Approprié

Utilisez un niveau à coût réduit pour le travail routinier et une option à plus haute capacité pour des tâches plus longues ou plus complexes.

Le meilleur

Le choix est le modèle qui accomplit la tâche de manière fiable à un coût total acceptable, et non automatiquement le plus grand modèle.

Étape 5 : Examiner le plan d'exécution

Pour les travaux complexes, confirmez :

  • Quels fichiers seront consultés
  • Quels outils seront utilisés
  • Si des logiciels seront installés
  • Si des sites web externes seront ouverts
  • Si des informations seront publiées
  • Si un message ou un e-mail sera envoyé

Étape 6 : Vérifier le livrable

Vérifiez le document final, la page web, le calcul, le visuel et les références sources avant toute diffusion.

Étape 7 : Transformer un travail éprouvé en compétence ou en planification

Après qu'un flux de travail produit un résultat stable, enregistrez-le pour le réutiliser ou automatisez-le selon un calendrier.

Crédits de lancement et avantages membres

La promotion officielle de lancement de QwenWork comprend plusieurs avantages.

En date du 6 août 2026 :

  • Les nouveaux utilisateurs reçoivent 2 000 crédits d'inscription.
  • Les crédits d'inscription sont valables trois mois.
  • Du 3 au 9 août, les récompenses de connexion quotidienne varient de 500 à 2 000 crédits selon le niveau de l'utilisateur.
  • Les utilisateurs payants peuvent effectuer des appels d'inférence textuelle illimités sur le niveau de modèle Economy dans le cadre des règles d'utilisation équitable et des quotas de la plateforme.

« Illimité » ne signifie pas que chaque partie d'un flux de travail d'agent est gratuite.

Les conditions officielles indiquent que d'autres fonctionnalités peuvent toujours consommer des crédits, notamment la compréhension ou la génération multimodale, la génération d'images, la synthèse de requêtes, la synthèse de pages web, la recherche en ligne et d'autres services de chaîne d'agents.

Les utilisateurs doivent consulter l'historique des sessions et les relevés de facturation pour connaître la consommation réelle.

Les promotions, quotas et droits peuvent évoluer après la période bêta.

Limitations de la bêta publique à garder à l'esprit

QwenWork est déjà performant, mais les utilisateurs de la bêta publique doivent s'attendre à des changements.

Les domaines susceptibles d'évoluer comprennent :

  • La disponibilité des modèles
  • Les multiplicateurs de crédits
  • Le catalogue de connecteurs
  • L'accès international
  • La prise en charge mobile
  • Les contrôles d'entreprise
  • Les options de déploiement
  • La qualité des compétences
  • La fiabilité des tâches
  • La tarification
  • La documentation

Une application générée peut également dépendre d'une adresse hébergée temporaire ou d'une infrastructure bêta.

Les travaux importants doivent être exportés, sauvegardés et examinés plutôt que de s'appuyer sur un seul artefact bêta hébergé comme seule copie.

Questions fréquentes

Qu'est-ce que QwenWork ?

QwenWork est la plateforme d'agents IA tout-en-un pour le lieu de travail d'Alibaba, destinée aux particuliers et aux entreprises. Elle peut créer des documents, des présentations, des feuilles de calcul, des ressources multimédias, des sites web, des analyses et des flux de travail automatisés grâce à des demandes en langage naturel.

QwenWork est-il identique à Qwen Chat ?

Non. Un assistant de chat fournit principalement des réponses conversationnelles, tandis que QwenWork est conçu pour effectuer des tâches professionnelles plus longues, utiliser des outils, accéder à des fichiers approuvés, créer des livrables, publier des pages web et se connecter à des systèmes métier.

QwenWork est-il disponible hors de Chine ?

La bêta publique a été lancée en Chine. Alibaba indique qu'une édition internationale est prévue, mais les utilisateurs doivent consulter le site officiel pour connaître la disponibilité régionale actuelle.

QwenWork peut-il créer un site web fonctionnel ?

Oui. Alibaba indique que QwenWork peut créer des pages HTML interactives, fournir des services d'hébergement et de domaine, et connecter une base de données si nécessaire. Les applications générées doivent encore être testées pour la sécurité,

accessibilité, gestion des données et exactitude avant une utilisation en production.

Qu’est-ce que Qwen3.8-Max ?

Qwen3.8-Max est le modèle multimodal phare d’Alibaba, publié en août 2026. Il dispose de 2,4 billions de paramètres au total, en active environ 95 milliards par requête et prend en charge une fenêtre de contexte allant jusqu’à un million de jetons.

QwenWork s’intègre-t-il à DingTalk ?

Oui. Alibaba intègre QwenWork dans DingTalk afin que les utilisateurs puissent travailler avec des documents, des conversations, des agendas, des messages, des e-mails et le contexte organisationnel au sein de la plateforme de collaboration.

QwenWork peut-il exécuter automatiquement des tâches planifiées ?

Oui. Le client de bureau prend en charge les planifications uniques et récurrentes. L’ordinateur doit rester disponible pour les tâches planifiées localement, et chaque exécution peut consommer des crédits selon les modèles et outils utilisés.

Les appels au modèle Économique sont-ils entièrement gratuits pour les utilisateurs payants ?

L’avantage de lancement officiel couvre l’inférence de texte illimitée du niveau LLM Économique dans le cadre d’une utilisation raisonnable. Le traitement multimodal, la recherche, les résumés et d’autres services dans un flux d’agent peuvent toujours consommer des crédits.

Outils associés

  • QwenWork : plateforme d’agent IA professionnelle d’Alibaba pour les flux de travail web, de bureau et d’entreprise.
  • Centre d’aide QwenWork : documentation officielle sur la configuration, les fonctionnalités, les tarifs, la sécurité, les connecteurs, les compétences et l’automatisation.
  • Qwen3.8-Max : modèle multimodal phare d’Alibaba pour le codage, le travail, la recherche et les agents à long horizon.
  • Qwen Code : agent de codage en terminal open source d’Alibaba, optimisé pour les modèles Qwen.
  • DingTalk : plateforme de collaboration d’entreprise d’Alibaba et environnement d’intégration principal pour QwenWork.
  • Alibaba Cloud Model Studio : plateforme d’Alibaba Cloud pour accéder aux modèles Qwen et créer des applications d’IA générative.

Liens connexes

et disponibilité de l'API.

Résumé

QwenWork combine des agents web et desktop, la création multimodale, des livrables Office, le déploiement de sites web, des tâches planifiées, des connecteurs d'entreprise, l'intégration DingTalk, des compétences réutilisables et des kits d'experts spécifiques à chaque rôle en une seule plateforme.

Les tests pratiques originaux montrent le produit transformant un long entretien en carte de preuves interactive, construisant une démonstration de turbosoufflante Three.js, produisant un package complet de lancement de produit et créant une simulation de commandement d'urgence. Ces exemples illustrent l'idée la plus forte de la plateforme : l'agent doit renvoyer un artefact utilisable plutôt que de s'arrêter à un brouillon.

Qwen3.8-Max constitue la couche de modèle phare avec 2,4 billions de paramètres au total, 95 milliards de paramètres actifs, une entrée multimodale, une exécution à long horizon et jusqu'à un million de jetons de contexte.

Le véritable test de QwenWork ne consistera pas à savoir s'il peut produire des démos impressionnantes, mais à savoir si les entreprises peuvent le connecter à des flux de travail réels tout en préservant l'exactitude, les permissions, le contrôle des coûts, la sécurité et la responsabilité humaine.