Saltar al contenido

root / tags / vllm

#vLLM

3 fiches

Arquitectura y Construcción Traducción verificada automáticamente

Buzz (buzz.xyz) — Rapport de recherche pour présentation

Informe de investigación interno fechado el **12 de agosto de 2026** que consolida, con fines de presentación, todo lo documentado públicamente sobre **Buzz** — el espacio de trabajo de humanos + agentes de **Block**, lanzado el **21 de julio de 2026** bajo la licencia **Apache 2.0**. Reúne las dos publicaciones técnicas ya presentadas junto al anuncio corporativo, el repositorio de GitHub, la cobertura de prensa, X, y **tres experiencias prácticas independientes** que constituyen los únicos datos del dosier que no son autodeclarados. **(A) Una brecha de vocabulario documentada mediante cita**: el tuit de lanzamiento de **Jack Dorsey** anuncia *"agnóstico de modelo, descentralizado, autosoberano y de código abierto"*; el `ARCHITECTURE.md` de Block afirma *"El relay es la única fuente de verdad. Todas las lecturas y escrituras pasan por él. No hay intercambio de eventos entre pares, ni gossip, ni replicación."* El relay es, por tanto, único y autoritativo por comunidad: la "descentralización" de Buzz es una **soberanía organizativa** —autoalojamiento e identidad portátil— y no redundancia de red. La formulación de **TFTC**: *"Dos de esos tres se sostienen sin problema. El tercero necesita un matiz."* **(B) Una asimetría entre el rigor demostrado y el riesgo de explotación.** Por un lado, un grado de formalismo poco frecuente para una v0.4.x/0.5.x: especificación de aislamiento multiinquilino **mecanizada en TLA+**, propiedades de autorización verificadas en **Tamarin**, un protocolo de almacenamiento Git verificado por model checking, un registro de auditoría append-only encadenado por hash, 127 *tipos de evento*, NIP-01/42/98/34. Por otro, la pertenencia a un canal es la unidad de permiso —*"la pertenencia a un canal no es una autorización de herramientas de grano fino"* (João Queirós)—, los agentes se ejecutan con `--dangerously-skip-permissions` fuera de cualquier sandbox en la máquina de un humano, y la observabilidad es deficiente: *"Buzz me dice que un agente recibió un mensaje. No me dice qué pasa después"* (DevTools Daily, que reporta cierres silenciosos por OOM). Block lo reconoce: *"el agente puede hacer cualquier cosa, y la seguridad descansa por completo en restringir quién puede decirle qué hacer"*. **(C) La pila técnica**, ausente de las publicaciones presentadas: relay en **Rust** (Axum WS + REST), **Postgres**, **Redis**, **S3/MinIO** vía Blossom, cliente de escritorio **Tauri + React**. La integración de agentes pasa por **`buzz-acp`**, un harness **ACP** que conecta goose, Codex y Claude Code y traduce **ACP ↔ MCP**, además de **`buzz-agent`**, un agente propio. El informe se corrige a sí mismo en un punto: el *"+33% más de trabajo"* del TL;DR de Block es la **proporción de tareas completadas (20 frente a 15 de 44)**, no una ganancia de puntuación — la puntuación en sí sube de 59,1% a 71,5%, es decir **+12,4 puntos**.

#Buzz#buzz.xyz#Block

**Deep Research Veille Interne** — rapport non signé · produit le **12 août 2026** en préparation d'une présentation. Aucune URL publique ; source archivée dans `raw-data/`.

Herramientas y Plataformas Traducción verificada automáticamente

ZML/LLMD : et si le « Docker des LLM » était français ?

Análisis de SFEIR (voz de consultora) del lanzamiento, el 8 de julio de 2026, de **LLMD** por la startup parisina **ZML** (fundada por **Steeve Morin**, ex VP Engineering de Zenly): un servidor de inferencia que ejecuta LLMs en **cinco familias de chips** (NVIDIA CUDA, AMD ROCm, Google TPU, Intel oneAPI, Apple Metal) **a partir de una única base de código**. Tesis estructurante: el entrenamiento está cediendo el protagonismo a la **inferencia**, donde ahora se deciden el coste por token, la latencia y, sobre todo, la **dependencia del silicio**. La apuesta de ZML —resumida en el lema *model to metal*— consiste en **desacoplar el modelo del hardware** mediante un compilador escrito en **Zig + MLIR** que produce un binario nativo hermético, sin Python en la ruta de ejecución, expuesto a través de una **API compatible con OpenAI**. Dos componentes, dos licencias: **ZML** (el framework, Apache-2.0, >90% Zig) es de código abierto; **LLMD** (el servidor) no lo es, gratuito en el lanzamiento. El artículo lee el objeto a través de tres prismas propios de consultora —**FinOps de tokens**, **libertad arquitectónica** (Design to Exit), **soberanía** (chips europeos emergentes, integración en el procesador Jotunn8 de VSORA)— y ofrece después un veredicto sin concesiones: se trata de una **alfa**, que hay que situar "bajo vigilancia activa", no para adoptar hoy.

#Inferencia de LLM#serving#ZML

SFEIR (voix éditoriale du cabinet)