Tik Tok, une application de médias sociaux largement utilisée avec plus d'un milliard d'actifs mensuels
utilisateurs, nécessite une assurance qualité efficace de l'application pour ses fonctionnalités complexes.
Les tests de fonctionnalités sont cruciaux pour atteindre cet objectif. Cependant, le multi-utilisateur
fonctionnalités interactives dans l'application, comme la diffusion en direct, appels vocaux, etc.,
posent des défis importants aux développeurs, qui doit gérer simultanément les appareils
coordination de la gestion et des interactions avec les utilisateurs. Pour résoudre ce problème, nous introduisons un
nouvelle approche multi-agents, propulsé par les grands modèles de langage (LLM), à
automatiser les tests des fonctionnalités des applications interactives multi-utilisateurs. En détails, nous
créer une batterie de périphériques virtuels qui alloue le nombre nécessaire de périphériques pour
une tâche interactive multi-utilisateur donnée. Pour chaque appareil, nous déployons un LLM basé
agent qui simule un utilisateur, imitant ainsi les interactions des utilisateurs pour
automatiser de manière collaborative le processus de test. Les évaluations sur 24 multi-utilisateur
tâches interactives dans l'application TikTok, démontrer sa capacité à couvrir 75%
de tâches avec 85.9% similarité d'action et offre 87% gain de temps pour
développeurs. En plus, nous avons également intégré notre approche dans le
plateforme de test TikTok dans le monde réel, aider à la détection de 26 multi-utilisateur
bogues interactifs.
Cet article explore les excursions dans le temps et leurs implications.
Télécharger PDF:



