Software IA
El software de IA es todo lo que rodea al modelo: las librerías con las que se entrena, los motores que lo ejecutan, las APIs con las que se consume y las herramientas que lo conectan con el mundo.
Para entrenar se usan marcos como PyTorch, JAX o TensorFlow. Para ejecutar modelos (inferencia) existen motores optimizados como vLLM o llama.cpp. Sobre ellos hay capas de orquestación para agentes, recuperación de documentos (RAG) con bases de datos vectoriales y estándares como el Model Context Protocol, que permite a un modelo conectarse a herramientas y datos.
Stack completo de software para construir, ejecutar y operar sistemas de IA en producción.
| Capa | Para qué sirve | Herramientas clave | Detalle |
|---|---|---|---|
| 🏋️ Entrenamiento | Construir y ajustar modelos a partir de datos | PyTorch · JAX · TensorFlow | DeepSpeed para modelos grandes. LoRA / QLoRA para fine-tuning eficiente. FSDP para paralelismo en múltiples GPU. |
| ⚡ Inferencia | Ejecutar modelos rápido y con bajo coste | vLLM · llama.cpp · TensorRT-LLM | PagedAttention (vLLM) multiplica el throughput ×24. llama.cpp corre LLMs en CPU. TensorRT-LLM optimiza para NVIDIA. |
| 🌐 APIs de modelos | Consumir modelos como servicio en la nube | OpenAI API · Anthropic API · Google AI | Pago por token. Cada laboratorio expone sus modelos. AWS Bedrock y Azure AI agrupan varios proveedores. |
| 🤖 Orquestación de agentes | Construir sistemas con múltiples LLMs y herramientas | LangChain · LangGraph · CrewAI · AutoGen | LangGraph para flujos con estado. CrewAI para equipos de agentes especializados. Semantic Kernel (Microsoft). |
| 🔍 Recuperación RAG | Dar al modelo documentos propios actualizados | Pinecone · Weaviate · pgvector · Qdrant | pgvector integra búsqueda vectorial en PostgreSQL. Qdrant es open-source y muy rápido. Chroma para prototipos. |
| 🔗 Protocolos de conexión | Estándares para conectar LLMs con el mundo | MCP (Anthropic) · OpenAPI · REST | MCP (2024): cualquier app puede exponer sus datos a cualquier LLM compatible. Revoluciona la interoperabilidad. |
| 📊 Evaluación y benchmarks | Medir y comparar modelos de forma rigurosa | MMLU · HumanEval · SWE-bench · HLE | Benchmark saturation: los mejores modelos rozan el 100 % y hay que crear pruebas nuevas cada pocos meses. |
| 🛡️ Seguridad y guardrails | Añadir capas de seguridad sobre los LLMs | NeMo Guardrails · Llama Guard · Rebuff | Filtran entradas y salidas. Detectan jailbreaks, PII y contenido dañino. Obligatorios en entornos enterprise. |
| 📦 Despliegue y MLOps | Llevar modelos a producción y monitorizar | MLflow · Weights & Biases · BentoML | W&B rastrea experimentos. BentoML empaqueta modelos como APIs. MLflow gestiona el ciclo de vida completo. |
| Herramienta | Tipo | Para qué sirve | Ejemplo de uso |
|---|---|---|---|
| PyTorch | Framework de deep learning | Definir y entrenar redes; estándar de la investigación | La mayoría de LLM abiertos se entrenan con él |
| JAX | Framework de Google | Cálculo numérico acelerado y diferenciación automática, ideal en TPU | Modelos Gemini |
| TensorFlow / Keras | Framework de Google | Entrenar y desplegar, fuerte en producción y móvil | Apps con TensorFlow Lite |
| Hugging Face Transformers | Librería de modelos | Descargar y ajustar miles de modelos preentrenados | Ajustar un Llama en pocas líneas |
| DeepSpeed | Librería de Microsoft | Entrenar modelos enormes repartiendo la memoria (ZeRO) | Modelos de cientos de miles de millones de parámetros |
| Megatron-LM / NeMo | NVIDIA | Paralelismo de tensores y de tuberías en miles de GPU | Entrenamiento de LLM a gran escala |
| PyTorch FSDP | Técnica de PyTorch | Fragmentar los parámetros entre GPU | Entrenar un 70B en un clúster mediano |
| LoRA / QLoRA | Ajuste eficiente (PEFT) | Ajustar solo pequeñas matrices añadidas; QLoRA cuantiza a 4 bits | Ajustar un 70B en una sola GPU |
| TRL / Unsloth / Axolotl | Herramientas de ajuste | RLHF, DPO y ajuste fino simplificado | Alinear un modelo con preferencias |
| CUDA / cuDNN / ROCm | Capa de bajo nivel | Programar GPU de NVIDIA (CUDA) o de AMD (ROCm) | Base de todos los frameworks |
| Triton | Lenguaje de OpenAI | Escribir kernels de GPU en Python | Kernels de atención optimizados |
| Ray | Computación distribuida | Escalar entrenamiento, datos y servicio en clústeres | Pipelines de entrenamiento distribuidos |
| Spark / Datasets | Datos | Preparar y limpiar datos a gran escala | Filtrar billones de tokens |
| Herramienta | Tipo | Para qué sirve | Ejemplo de uso |
|---|---|---|---|
| vLLM | Motor de inferencia | Servir LLM con PagedAttention y batching continuo | API propia de un modelo abierto |
| TensorRT-LLM | NVIDIA | Optimizar la inferencia en GPU NVIDIA | Máximo rendimiento en H100 y B200 |
| SGLang | Motor de inferencia | Servicio rápido con caché de prefijos | Agentes con muchas llamadas |
| TGI | Hugging Face | Servidor de generación de texto | Desplegar modelos del Hub |
| llama.cpp / GGUF | Inferencia local | Ejecutar LLM cuantizados en CPU y portátiles | Un modelo de 8B en un portátil |
| Ollama / LM Studio | Apps locales | Descargar y usar modelos en tu ordenador | Chat privado sin nube |
| ONNX Runtime | Microsoft | Ejecutar modelos en muchos dispositivos | Inferencia en Windows y móviles |
| Apple MLX | Apple | Framework para Apple Silicon | Ajuste fino local en un Mac |
| OpenAI API | API comercial | GPT, imagen, voz y agentes, pago por token | Chatbot de atención al cliente |
| Anthropic API | API comercial | Modelos Claude, herramientas y uso de ordenador | Asistente de programación |
| Gemini API / Vertex AI | Modelos Gemini y nube de Google | Análisis multimodal de vídeo | |
| AWS Bedrock / Azure AI Foundry | Plataformas de nube | Varios proveedores de modelos bajo un mismo contrato | Empresa que combina Claude y Llama |
| OpenRouter | Pasarela | Una sola API para cientos de modelos | Comparar modelos sin cambiar código |
| Together / Fireworks | Hosting de modelos abiertos | Inferencia rápida y barata de Llama, DeepSeek o Qwen | Prototipos de bajo coste |
| Herramienta | Tipo | Para qué sirve | Ejemplo de uso |
|---|---|---|---|
| LangChain | Framework | Encadenar LLM, herramientas y datos | Chatbot con búsqueda |
| LangGraph | Framework | Agentes como grafos con estado y bucles | Agente que revisa su propio trabajo |
| LlamaIndex | Framework de RAG | Indexar documentos y consultarlos | Chat con la intranet |
| CrewAI / AutoGen | Multiagente | Equipos de agentes con roles | Investigador, redactor y revisor |
| OpenAI Agents SDK | SDK | Construir agentes con modelos de OpenAI | Agente de soporte |
| Claude Agent SDK | SDK de Anthropic | La base de Claude Code para crear agentes propios | Agente que trabaja en un repositorio |
| MCP | Protocolo abierto (Anthropic, 2024) | Conectar LLM con herramientas y datos de forma estándar | Claude consultando tu Notion o tu Drive |
| A2A | Protocolo (Google, 2025) | Comunicación entre agentes de distintos proveedores | Un agente de compras habla con uno de logística |
| Pinecone / Weaviate / Qdrant / Milvus | Bases de datos vectoriales | Búsqueda semántica a gran escala | RAG sobre millones de documentos |
| pgvector / Chroma | Vectores ligeros | Vectores dentro de PostgreSQL o en local | Prototipo de RAG |
| Modelos de embeddings | Modelos | Convertir texto en vectores | Buscador semántico |
| Rerankers | Modelos | Reordenar resultados por relevancia | Mejorar la precisión del RAG |
| Playwright / Browser Use | Automatización web | El agente navega y rellena formularios | Agente que pide una cita |
| Herramienta | Tipo | Para qué sirve | Ejemplo de uso |
|---|---|---|---|
| lm-evaluation-harness | Evaluación (EleutherAI) | Ejecutar cientos de benchmarks estándar | Medir el MMLU de un modelo propio |
| HELM | Evaluación (Stanford) | Evaluación holística: precisión, sesgo y robustez | Informe comparativo |
| LMArena | Evaluación por votos | Ranking por preferencias humanas a ciegas | Clasificación Elo de chatbots |
| Inspect / OpenAI Evals | Marcos de evaluación | Crear evaluaciones propias, también de seguridad | Pruebas antes de cada versión |
| MLflow | MLOps | Registrar experimentos y versiones de modelos | Comparar 20 ajustes |
| Weights & Biases | MLOps | Seguir entrenamientos y métricas | Curvas de pérdida en tiempo real |
| Kubeflow / KServe | MLOps en Kubernetes | Pipelines y servicio en producción | Plataforma interna de ML |
| LangSmith / Langfuse | Observabilidad | Trazas, costes y errores de apps con LLM | Detectar respuestas fallidas |
| Guardrails AI / NeMo Guardrails | Barreras | Validar y filtrar entradas y salidas | Bloquear datos personales |
| Llama Guard | Clasificador (Meta) | Detectar contenido inseguro | Moderación de un chatbot |
| PyRIT / Garak | Red teaming | Atacar modelos para encontrar fallos | Pruebas de jailbreak |
| Presidio | Privacidad (Microsoft) | Detectar y anonimizar datos personales | Limpiar documentos antes del RAG |
| Producto | Empresa | Categoría | Qué hace |
|---|---|---|---|
| ChatGPT | OpenAI | Asistente | Chat, búsqueda, agentes, imagen y voz |
| Claude | Anthropic | Asistente | Escritura, análisis y programación, con artefactos |
| Claude Code | Anthropic | Agente de programación | Trabaja en tu repositorio desde la terminal |
| Gemini | Asistente | Integrado en Android, Workspace y el buscador | |
| Microsoft Copilot | Microsoft | Asistente | En Windows, Microsoft 365 y Edge |
| GitHub Copilot | Microsoft / GitHub | Programación | Autocompletado y agentes en el editor |
| Cursor | SpaceX (antes Anysphere) | Editor de código con IA | IDE con agentes; SpaceX lo compró por 60.000 M$ (acuerdo del 16-jun-2026, cerrado en agosto) |
| Grok | SpaceXAI | Asistente | Integrado en X |
| Meta AI | Meta | Asistente | En WhatsApp, Instagram y Facebook |
| Perplexity | Perplexity | Buscador con IA | Respuestas con fuentes citadas |
| NotebookLM | Investigación | Resúmenes y podcasts a partir de tus documentos | |
| Mistral Vibe (antes Le Chat) | Mistral AI | Asistente | Alternativa europea, con datos en la UE |
| Midjourney | Midjourney | Imagen | Imágenes artísticas a partir de texto |
| Sora / Veo | OpenAI / Google | Vídeo | Clips de vídeo a partir de texto |
| ElevenLabs | ElevenLabs | Voz | Síntesis y doblaje de voz |
| Suno | Suno | Música | Canciones completas a partir de texto |
158 herramientas de IA agrupadas por uso, más allá de los grandes asistentes. Busca por nombre, empresa o tarea, o filtra por categoría.
General (11)
El asistente más usado: GPT-6, voz, visión, memoria y agentes (Work y Codex).
Integrado en Workspace y Android, con 1 M de contexto y vídeo largo.
Redacción natural, documentos largos y programación; sin anuncios.
Modelos abiertos para usar en local y asistente en WhatsApp e Instagram.
Buscador con respuestas citadas en tiempo real; conviene revisar las fuentes.
Alternativa europea, rápida y barata, con datos en la UE.
Acceso en tiempo real a X, imagen y vídeo.
Razonamiento y código con pesos abiertos a precio mínimo.
Conversación empática; desde 2024 la empresa se centra en clientes corporativos.
Modelos para empresas, especializados en RAG sobre datos privados.
Buscador y asistente que deja elegir entre varios modelos.
Productividad (15)
IA en Word, Excel, PowerPoint, Outlook y Teams.
Antes Duet AI: redacta en Gmail y Docs y resume reuniones de Meet.
Resume, redacta y organiza bases de datos dentro de Notion.
Presentaciones, documentos y webs en segundos a partir de un texto.
Diapositivas que se maquetan solas con reglas de diseño.
Nació para presentaciones; en 2024 giró hacia herramientas de ventas.
Graba, transcribe y resume reuniones de Zoom, Meet y Teams.
Transcripción en directo con resumen y tareas.
Buscador empresarial sobre Slack, Drive, Jira y más.
Corrige gramática, tono y estilo en cualquier app.
Notas personales que se organizan y conectan solas.
Planifica tareas y agenda según prioridades y plazos.
Calendario que protege bloques de trabajo profundo.
Reorganiza calendarios de equipo para ganar tiempo de concentración.
Proyectos, mapas mentales y agentes de tareas.
Negocios (8)
Antes Einstein: IA y agentes en el CRM.
Contenido, puntuación de leads y asistente de ventas en el CRM.
Crear, desplegar y gobernar modelos propios con cumplimiento normativo.
Automatiza tickets y flujos de TI y RR. HH.
Base de conocimiento que sugiere respuestas dentro de tus apps.
Soporte de TI y atención al cliente con resolución automática.
Automatiza tareas web desde el navegador sin programar.
Agente para peticiones de empleados de RR. HH. y TI.
Desarrollo (14)
Agente de programación en terminal, escritorio, web e IDE.
Agente de programación en la nube, terminal e IDE.
El asistente de código más extendido, con agentes en el editor.
Editor con agentes; SpaceX lo compró por 60.000 M$ en 2026.
Editor con agente que entiende todo el proyecto (antes Codeium).
«Ingeniero de software» autónomo que planifica, programa y depura.
Agente de código en terminal (abierto) y editor con agentes.
Crea y despliega apps en la nube con lenguaje natural.
Apps completas (frontend, backend y base de datos) desde prompts.
Apps web completas desde un texto, en el navegador.
Interfaces en React y Tailwind desde texto o capturas.
Autocompletado privado que se entrena con tu código.
Clasifica y genera contenido dentro de tus bases de datos.
Depura y monitoriza agentes en producción.
Automatización (10)
Automatización sin código entre más de 7.000 apps, con agentes.
Automatización visual con lógica avanzada (antes Integromat).
Flujos abiertos y autoalojables con nodos de IA.
Agentes sin código para investigar, analizar y prospectar.
Entrenar, desplegar y vigilar modelos a escala.
Construir agentes y ajustar modelos de OpenAI y otros.
Bots y agentes sin código con memoria y plugins.
Alternativa abierta a Zapier con bloques de IA.
Asistentes que gestionan correo, agenda y tareas.
Flujos con LLM y RAG sin código para empresas.
Datos y BI (10)
Crea informes, escribe DAX y resume paneles.
Visualizaciones y preguntas en lenguaje natural.
BI con métricas unificadas para toda la empresa.
Búsqueda analítica en lenguaje natural.
Plataforma de datos e IA (lakehouse) con gobernanza.
LLM sobre tus datos sin sacarlos del entorno.
Cuadernos colaborativos que generan SQL y Python.
BI en la nube con interfaz de hoja de cálculo.
Catálogo activo para documentar y gobernar datos.
Detecta incidencias de calidad en los datos.
Ventas (9)
Analiza llamadas de venta y detecta patrones de éxito.
Secuencias automatizadas y análisis del pipeline.
Cadencias y análisis de llamadas; integra Drift.
Base de datos B2B y prospección multicanal.
Enriquece contactos con más de 75 fuentes y personaliza mensajes.
Previsión de ventas y riesgos del pipeline.
Inteligencia conversacional sobre reuniones de venta.
Puntúa y mejora correos de venta en tiempo real.
Identifica visitantes de la web y lanza outreach automático.
Marketing (10)
Contenido de marketing con el tono de la marca.
Textos publicitarios y flujos de marketing.
Vídeos con avatares que hablan en más de 130 idiomas.
Palabras clave, competencia y contenido SEO.
Optimiza textos según lo que posiciona en Google.
Creatividades para Meta, Google y TikTok con predicción de CTR.
Escucha social y sentimiento de marca.
Programa, analiza y responde en redes sociales.
Antes Phrasee: optimiza asuntos y textos de email y notificaciones.
Predice el rendimiento de un texto antes de publicarlo.
Atención al cliente (10)
Agente que resuelve gran parte de las consultas con tu base de conocimiento.
Clasifica tickets, sugiere respuestas y los enruta.
Respuestas automáticas y resúmenes de tickets.
Atención automatizada en muchos idiomas.
Chatbot para tiendas online.
CRM de atención; se separó de Meta en 2023.
Detecta la intención y enruta tickets.
Soporte para tiendas Shopify con el tono de la marca.
Analiza y puntúa llamadas de contact center.
Ayuda en directo a los agentes durante la llamada.
Legal (10)
Plataforma jurídica: contratos, cláusulas y due diligence.
Antes Casetext: investigación jurídica y borradores.
Copiloto en Word para redactar y revisar contratos.
Ciclo de vida de contratos: revisión, negociación y firma.
Revisión masiva de documentos en M&A y auditorías.
Extrae datos de contratos para due diligence.
Analiza y clasifica contratos.
Repositorio de contratos con obligaciones y fechas clave.
Revisión y redacción de contratos para equipos internos.
Vigila cambios normativos y los relaciona con tus procesos.
Finanzas (10)
Planificación financiera sobre Excel: consolida, informa y prevé.
Planificación continua y cierre contable.
Planificación financiera dentro de la hoja de cálculo.
Informes financieros, ESG y de cumplimiento.
Presupuestos, previsiones e informes consolidados.
Cuentas por pagar: procesa facturas y detecta duplicados.
Extrae datos de facturas y recibos.
Categoriza transacciones y concilia la contabilidad.
Contabilidad de contratos según IFRS 16 y ASC 606.
Contabilidad y finanzas para startups.
RR. HH. (10)
Selección, talento y planificación de plantilla.
Asistente Olivia: filtra candidatos y agenda entrevistas.
Mapa de habilidades y potencial de candidatos.
Experiencia del candidato y contratación automatizada.
Entrevistas en vídeo evaluadas con IA (uso de alto riesgo en la UE).
RR. HH. todo en uno: altas, nóminas y dispositivos.
Gestión del desempeño y análisis de talento.
OKR, feedback y evaluaciones.
CRM de talento y planificación de plantilla.
Analítica de personas: rotación, rendimiento y equidad salarial.
Ciberseguridad (10)
Protege equipos, nube y datos frente a ataques.
Detecta amenazas desconocidas con aprendizaje no supervisado.
Detecta y responde a amenazas sin intervención humana.
Analiza señales de amenaza y guía la respuesta.
Detecta atacantes en redes híbridas y en la nube.
Inteligencia de amenazas de la web oscura y fuentes abiertas.
Protege el correo frente a phishing y fraude del CEO.
Seguridad de la nube sin agentes.
Detecta operaciones de ataque completas.
Puntúa el riesgo cibernético de proveedores.
Imagen (5)
Imágenes de gran calidad artística.
Generador de imágenes de ChatGPT (sucesor de DALL-E 3), con buen texto dentro de la imagen.
Entrenado con contenido con licencia; integrado en Photoshop.
Especialista en tipografía: logos y carteles.
Modelo abierto y muy personalizable (LoRA, ControlNet).
Vídeo (8)
Vídeo realista a partir de texto.
Vídeo con sonido (Veo 3.1) y estudio de cine con IA (Flow).
Suite de vídeo con IA (modelos Gen-4).
Vídeo chino de alta fidelidad con control de movimiento.
Vídeo con movimiento realista y personajes coherentes.
Vídeo rápido y anima fotos fijas.
Clips cortos y efectos con texto.
Avatares y traducción de vídeo con sincronía labial.
Audio y música (8)
Voces sintéticas muy realistas, clonación y doblaje (texto a voz).
Limpia y mejora la voz de grabaciones.
Canciones completas con letra y voz desde una descripción.
Música de calidad que se puede extender por secciones.
Música original libre de derechos para uso comercial.
Música de fondo para vídeos, directos y apps.
Canciones en minutos que se pueden publicar en Spotify.
Separa voz e instrumentos de cualquier canción.