Tether lance VisionPsy-Nano : l'IA à 460M paramètres qui tourne sur votre téléphone
Tether ne se contente plus de révolutionner la finance avec l'USDT. Sa branche recherche en intelligence artificielle, QVAC, vient de libérer VisionPsy-Nano, un modèle de vision-langage de 460 millions de paramètres conçu pour fonctionner directement sur un smartphone, sans serveur cloud. Une première dans la catégorie des modèles compacts, avec des performances qui surpassent tous les concurrents de moins de 500 millions de paramètres. ### En bref - VisionPsy-Nano est un modèle vision-langage (VLM) open source sous licence Apache 2.0, libéré par Tether Data le 29 juillet 2026 - Avec 460 millions de paramètres, il tourne en local sur un téléphone Android ou iPhone, sans connexion internet ni data center - Il obtient le meilleur score normalisé (62.3) de sa catégorie, devant les modèles de Liquid AI (59.6) et HuggingFace SmolVLM2 (52.5) - Une variante Flash conserve 99 % des performances tout en étant jusqu'à 36 fois plus rapide sur iPhone 15 - Disponible sur [HuggingFace](https://huggingface.co/tether), exécutable via llama.cpp et vLLM ## Un modèle d'IA qui tient dans la poche VisionPsy-Nano n'est pas un modèle de laboratoire réservé aux chercheurs équipés de GPU à plusieurs milliers de dollars. Il a été spécifiquement conçu pour le déploiement sur appareils mobiles — smartphones, tablettes, objets connectés — avec des checkpoint GGUF quantifiés prêts à l'emploi. En pratique, une seule ligne de commande suffit pour le faire tourner via llama.cpp. Pour les usages serveur, vLLM assure une inférence haute performance. Cette accessibilité change la donne pour les développeurs africains qui n'ont pas accès à des infrastructures cloud coûteuses. ## Deux variantes pour deux besoins Tether a eu l'intelligence de publier deux versions complémentaires. VisionPsy-Nano-460M est le modèle de référence, optimisé pour la qualité maximale sur l'ensemble des benchmarks standard. VisionPsy-Nano-460M-Flash est taillé pour la vitesse : sur un Galaxy S25 Ultra, il génère sa première réponse 19 à 23 fois plus vite que ses concurrents, tout en conservant 99 % de la qualité du modèle complet. ## Quatre capacités clefs Le modèle excelle dans quatre domaines qui intéressent directement les usages professionnels et éducatifs. La compréhension de documents et l'OCR lui permettent d'extraire du texte depuis des infographies, des rapports financiers ou des diagrammes complexes. La perception visuelle analyse des scènes et des agencements spatiaux avec une avance de 4,6 % sur le deuxième meilleur modèle de sa catégorie. Le raisonnement visuel dépasse ses concurrents de 7,4 %. Enfin, le suivi d'instructions rivalise avec des modèles deux fois plus gros, comme Qwen3.5-0.8B ou InternVL3.5-1B. ## Ce que ça change pour l'Afrique Paolo Ardoino, le CEO de Tether, l'a dit clairement : « La technologie est prête à contrer l'obsession de la centralisation dans les data centers. Prouver qu'on peut atteindre des performances de pointe avec seulement 460 millions de paramètres montre que l'IA locale et efficace est une voie viable. » Pour un développeur à Goma, à Nairobi ou à Dakar, cela signifie pouvoir exécuter un modèle de vision compétitif sur le téléphone qu'il a déjà dans sa poche. Reconnaissance de documents administratifs, traduction d'affiches, lecture de rapports financiers, aide à la navigation pour malvoyants : les applications sont concrètes et ne dépendent plus d'une connexion stable au cloud. Tether a signé la veille, le 28 juillet, un protocole d'accord avec la Bourse de Nairobi pour explorer la tokenisation, la blockchain et l'éducation aux actifs numériques en Afrique. L'ouverture de VisionPsy-Nano s'inscrit dans cette dynamique : fournir des outils ouverts et utilisables sur le continent, sans dépendre d'infrastructures étrangères. > « En mettant ces outils directement entre les mains des développeurs, nous contournons les gardiens centralisés et rendons possible une IA puissante et privée sur les appareils que les gens possèdent déjà. » — Paolo Ardoino, CEO de Tether. VisionPsy-Nano est disponible dès aujourd'hui sur HuggingFace. Si vous voulez apprendre à exécuter ce type de modèle sur votre propre matériel, [l'Academy Kiveclair](https://academy.kiveclair.com) propose des parcours gratuits en intelligence artificielle et en logiciel libre.
Rédaction Kiveclair
30 juil. 2026 • 4 min