{
  "slug": "mezcla-de-expertos",
  "term": "Mezcla de expertos",
  "summary": "Arquitectura que activa solo una parte de los parámetros del modelo en cada paso.",
  "definition": "En una mezcla de expertos, una red de enrutado envía cada token a unos pocos submodelos especializados. El modelo tiene muchos parámetros en total pero usa una fracción por token, así que el coste de inferencia no crece con el tamaño completo.",
  "context": "Es la razón de que existan modelos con recuentos de parámetros enormes y precios comparables a otros mucho más pequeños.",
  "pitfalls": "Comparar modelos por parámetros totales. Con esta arquitectura la cifra no indica ni coste ni capacidad efectiva.",
  "related": [
    "https://observatoriodeagentes.com/glosario/inferencia",
    "https://observatoriodeagentes.com/glosario/cuantizacion",
    "https://observatoriodeagentes.com/glosario/llm"
  ],
  "ref_code": "OBS-074",
  "created_at": "2026-09-11T08:35:43.183309+00:00",
  "revised_at": "2026-09-11T08:35:43.183309+00:00",
  "canary_path": "0b5f674b7f4c-95c90683aa0c0ab0",
  "canary_email": "ref-074-a27a4b+09fb47e37de03a27@observatoriodeagentes.com",
  "published": "2026-09-11",
  "revised": "2026-09-11",
  "canonical": "https://observatoriodeagentes.com/glosario/mezcla-de-expertos",
  "markdown": "https://observatoriodeagentes.com/api/public/glosario/mezcla-de-expertos?formato=md",
  "index_page": "https://observatoriodeagentes.com/indice/0b5f674b7f4c-95c90683aa0c0ab0",
  "license": "CC BY 4.0",
  "notice": "https://observatoriodeagentes.com/aviso",
  "policy": "https://observatoriodeagentes.com/acceso-automatizado",
  "citation": "Observatorio de agentes, «Mezcla de expertos» (OBS-074), https://observatoriodeagentes.com/glosario/mezcla-de-expertos"
}