Ramp Labs propose une nouvelle solution de partage de mémoire entre agents multiples, réduisant la consommation de tokens maximale de 65%

GateNews

Nouvelles de la Gate News : le 11 avril, la société d’infrastructure IA Ramp Labs a publié ses résultats de recherche « Latent Briefing ». En compressant directement le cache KV des grands modèles, elle permet un partage efficace de la mémoire entre systèmes multi-agents, tout en réduisant fortement la consommation de Tokens sans perte de précision. Dans les architectures multi-agents courantes, l’orchestrateur (Orchestrator) décompose les tâches et appelle de manière répétée le modèle de travail (Worker). À mesure que la chaîne d’inférence s’allonge, la quantité de Tokens augmente de façon exponentielle. L’idée centrale de Latent Briefing consiste à utiliser le mécanisme d’attention pour repérer, dans le contexte, les parties réellement essentielles, puis à supprimer directement les informations redondantes au niveau de la représentation, plutôt que de s’appuyer sur des résumés de LLM lents ou sur des recherches RAG peu stables. Lors des tests sur le banc LongBench v2, la méthode obtient d’excellents résultats : la consommation de Tokens du modèle Worker baisse de 65 %, et pour les documents de longueur moyenne (32k à 100k), le gain médian de Tokens atteint 49 %. Dans l’ensemble, la précision s’améliore d’environ 3 points par rapport à la base de référence, tandis que le surcoût de temps induit par chaque compression ne représente qu’environ 1,7 seconde, soit un gain de vitesse d’environ 20 fois par rapport à l’algorithme original. L’expérience utilise Claude Sonnet 4 comme orchestrateur et Qwen3-14B comme modèle Worker, couvrant des scénarios de documents variés : articles académiques, actes et documents juridiques, romans et rapports gouvernementaux. L’étude montre également que le seuil optimal de compression varie selon la difficulté de la tâche et la longueur du document : les cas difficiles se prêtent à une compression plus agressive pour filtrer le bruit de raisonnement spéculatif, tandis que les documents longs sont mieux servis par une compression légère afin de préserver des informations clés dispersées.

Avertissement : Les informations contenues dans cette page peuvent provenir de tiers et ne représentent pas les points de vue ou les opinions de Gate. Le contenu de cette page est fourni à titre de référence uniquement et ne constitue pas un conseil financier, d'investissement ou juridique. Gate ne garantit pas l'exactitude ou l'exhaustivité des informations et n'est pas responsable des pertes résultant de l'utilisation de ces informations. Les investissements en actifs virtuels comportent des risques élevés et sont soumis à une forte volatilité des prix. Vous pouvez perdre la totalité du capital investi. Veuillez comprendre pleinement les risques pertinents et prendre des décisions prudentes en fonction de votre propre situation financière et de votre tolérance au risque. Pour plus de détails, veuillez consulter l'avertissement.

Articles similaires

Agile Soda lance une plateforme Agentic OCR avec 98 % de précision de classification documentaire

Agile Soda a lancé Agentic OCR, une plateforme d’automatisation documentaire pilotée par l’IA qui élimine le préentraînement et permet un déploiement instantané. Elle offre une grande précision pour la classification et l’extraction, en s’améliorant continuellement grâce aux corrections des utilisateurs, avec des projets d’améliorations futures.

GateNewsIl y a 7m

American Express va acquérir la start-up d’IA Hyper de gestion des dépenses au T2 2026

American Express va acquérir la start-up d’IA Hyper pour améliorer ses outils de gestion des dépenses destinés aux clients professionnels. L’acquisition, prévue pour se finaliser au T2 2026, fait suite à un partenariat qui a lancé en 2024 une carte de récompenses co-brandée.

GateNewsIl y a 1h

La startup cloud de Singapour OrtCloud lève 1,7 M$ lors d’un tour de pré-amorçage mené par Golden Gate Ventures

OrtCloud, une startup singapourienne, a levé 1,7 million de dollars en financement de pré-amorçage pour son infrastructure cloud spécialisée conçue pour les charges de travail liées à l’IA. Avec des clients tels que OpenAI et Samsung, l’entreprise vise à améliorer le développement de produits et à s’étendre en Asie-Pacifique et aux États-Unis.

GateNewsIl y a 1h

Canva lance la plateforme AI 2.0, passant d’un outil de design à un Work OS unifié

Canva AI 2.0 transforme Canva, qui était un outil de conception, en une plateforme complète d’exploitation du travail. Elle utilise l’IA générative pour rationaliser les workflows, permettant aux utilisateurs de créer et de modifier des créations via un langage naturel, d’automatiser des tâches et d’intégrer divers services.

GateNewsIl y a 3h

Sahara AI lance l’agent d’investissement Sorin, prenant en charge les cryptomonnaies, les actions et les marchés de prédiction

Sahara AI a lancé Sorin, un agent d’investissement destiné au trading sur divers actifs tels que les cryptomonnaies et les actions. Il propose du trading autonome, l’automatisation de stratégies quantitatives et une gestion personnalisée des risques à l’ensemble des utilisateurs, après des tests menés auprès de 20 000 participants.

GateNewsIl y a 15h

AlphaNet lève un tour d’amorçage $10M mené par Joffre Capital pour lancer une plateforme de trading quantitatif de niveau institutionnel

Plateforme de trading quantitatif par IA AlphaNet obtient $10 millions de financement d’amorçage, se préparant à un lancement public avec plus de 30 stratégies très performantes. Les plans incluent une Open Platform pour l’intégration des stratégies d’ici 2026, avec l’objectif d’atteindre 100+ stratégies.

GateNewsIl y a 18h
Commentaire
0/400
Aucun commentaire