Aller au contenu

root / tags / minimax-m3

#MiniMax-M3

2 fiches

Agents de codage IA & Skills

The Token Manifesto

Nicolas Martignole (Le Touilleur Express), co-écrit avec **GLM-5.2** et **MiniMax-M3**, publie **« The Token Manifesto »** : un pastiche du **Manifeste Agile** (2001) transposé à l'ère des LLM, où l'unité de valeur n'est plus l'heure d'ingénieur mais le **token**. Quatre valeurs : *short system prompts over clever system prompts*, *one clear example over three paragraphs of explanation*, *iterating in small steps over dumping the whole spec at once*, *outputting in a defined format over letting the model freestyle*. Douze principes détournent un à un ceux de l'Agile — « la simplicité, l'art de maximiser la quantité de travail **non fait par le modèle** », « des équipes auto-organisées qui repèrent la répétition et documentent une seule fois », « une réflexion régulière **avant l'arrivée de la facture mensuelle** ». Sous l'humour (« staring at a usage bar nervously »), une thèse sérieuse : la contrainte économique réelle du dev assisté par IA n'est plus la vélocité mais le **budget de tokens** et l'**économie de la fenêtre de contexte**. Deux punchlines closent le texte : **« You don't have a prompt problem. You have a context-window problem. »** et **« Everyone's a prompt engineer until they run out of monthly quota. »** À noter, le méta-clin d'œil : un manifeste sur la frugalité de tokens co-écrit *avec* des modèles.

#The Token Manifesto#Nicolas Martignole#Le Touilleur Express

Nicolas Martignole (Le Touilleur Express) · avec GLM-5.2 et MiniMax-M3

Économie & Marché

GLM-5.2 leads open weights models and sits at #3 overall on GDPval-AA, a real-world agentic work benchmark

Annonce-benchmark d'**Artificial Analysis** (plateforme d'évaluation indépendante de modèles IA, via X/Twitter + page modèle) : **GLM-5.2** de **Z.ai** (Zhipu AI, @Zai_org) devient **le meilleur modèle à poids ouverts** et se hisse **#3 au classement général** de **GDPval-AA**, un benchmark de *travail de connaissance économiquement valorisable* du monde réel (tâches longue-horizon, multi-tours, agentiques). GLM-5.2 marque **1524 Elo**, derrière les seuls **Claude Fable 5 (1783)** et **Claude Opus 4.8 (1615)**, et à parité avec **GPT-5.5 (xhigh, 1509)**. Il devance d'une large marge le modèle ouvert suivant (**MiniMax-M3, 1408**) et de nombreux modèles propriétaires : **Gemini 3.5 Flash (1357)**, **Qwen 3.7 Max (1289)**, **Muse Spark (1158)**. Les tâches sont réellement agentiques : **~31 tours par tâche** en moyenne sur **1 999 matchs**. La même hiérarchie tient sur l'**Artificial Analysis Intelligence Index** (1er open weights), l'**Agentic Index** (#3) et **AA-Briefcase** (#3, devant GPT-5.5 xhigh, derrière Fable 5). Point saillant : un modèle **open weights** sous **licence MIT**, **MoE 753 Mds de paramètres / 40 Mds actifs**, contexte **1M tokens**, tarifé **1,40 $/4,40 $ par 1M tokens** entrée/sortie, rivalise avec la frontière propriétaire sur le travail agentique — un vrai pas pour les modèles ouverts.

#GLM-5.2#Z.ai#Zhipu AI

Artificial Analysis (@ArtificialAnlys)