Hugging Face
El gran hub de los modelos abiertos
Cientos de miles de modelos y datasets, demos en Spaces y librerías de entrenamiento. Es el punto de partida de cualquier trabajo con código abierto.
Inferencia, alojamiento de modelos y acceso por API.
114 herramientas
El gran hub de los modelos abiertos
Cientos de miles de modelos y datasets, demos en Spaces y librerías de entrenamiento. Es el punto de partida de cualquier trabajo con código abierto.
Los creadores de YOLO para detección de objetos
Los populares modelos abiertos YOLO para detección, segmentación y seguimiento, más una plataforma en la nube para entrenar con tus datos.
Etiquetado configurable para entrenar LLM y visión
Constructor de interfaces para etiquetar cualquier tarea, incluida la evaluación de respuestas de modelos, más un equipo de evaluadores.
Almacén multimodal de datos para entrenar IA
Guarda texto, imágenes, vídeo y vectores en una sola tabla y acelera la curación de datos y la ingeniería de variables para entrenar modelos. Formato abierto Lance.
Embeddings, reranking y lectura web para búsqueda
Modelos multilingües de embeddings y reranking y una Reader API que convierte cualquier página en texto limpio para LLM.
Embeddings precisos para búsqueda y RAG
Modelos de embeddings y rerankers, también para código, textos legales y financieros. Forma parte de MongoDB.
Búsqueda vectorial y de texto barata sobre almacenamiento de objetos
Guarda los índices en S3, así que buscar en volúmenes enormes cuesta mucho menos. Lo usan Cursor, Notion y otros.
Los datos y la IA de la empresa en una plataforma
Almacenamiento y procesamiento de datos, entrenamiento de modelos y agentes que trabajan sobre los datos corporativos, más AI/BI para preguntar en lenguaje natural.
Extracción precisa de datos de documentos complejos
La empresa de Andrew Ng: convierte PDF con tablas, gráficos y formularios en datos estructurados para RAG y automatización.
La plataforma de IA corporativa de Google Cloud (antes Vertex AI)
Gemini, Claude y modelos abiertos en una sola nube, más herramientas para crear, escalar y gobernar agentes con protección de datos.
El motor para ejecutar LLM en hardware común
La base abierta de Ollama, LM Studio y muchos más: ejecuta modelos cuantizados en CPU, Mac y tarjetas gráficas.
Servidor rápido para ejecutar modelos en producción
Motor de inferencia abierto de alto rendimiento: levantas una API compatible con OpenAI para modelos abiertos en tus GPU.
Base de datos vectorial en la nube basada en Milvus
La versión gestionada del Milvus abierto para buscar entre miles de millones de vectores en RAG, recomendaciones y búsqueda de imágenes.
Modelos abiertos en la red de Cloudflare
Llamas a modelos de texto, imagen y voz desde Workers, cerca del usuario, con una cuota diaria gratuita.
Búsqueda en documentos lista para apps de IA
Subes archivos y el servicio los procesa, indexa y busca en ellos, incluidas imágenes y tablas. Tiene modelos de embeddings abiertos.
Modelos Claude, Llama y otros en AWS
Acceso unificado a modelos de distintas empresas dentro de la infraestructura de AWS, con bases de conocimiento, agentes y filtros de seguridad.
La plataforma de Microsoft para modelos y agentes (antes Azure AI Foundry)
Modelos de OpenAI y miles más en Azure, constructor de agentes, evaluación y monitorización en el entorno corporativo de Microsoft.
Capa de datos para IA física y robótica
Gestiona, selecciona y etiqueta petabytes de datos —de sensores y vídeo a texto— para equipos que entrenan robots, vehículos autónomos y modelos multimodales.
Datos expertos y evaluación para laboratorios de IA
Crea datasets con expertos y etiquetado programático para ajustar y probar modelos en áreas especializadas.
La plataforma de IA de IBM centrada en control y cumplimiento
Modelos Granite y de terceros, herramientas para agentes y control estricto de riesgos y requisitos regulatorios para grandes empresas.
Visión artificial del etiquetado al despliegue
Etiquetas fotos, entrenas un modelo de detección de objetos y lo despliegas en cámara, servidor o móvil sin saber mucho de ML.
Plataforma para ejecutar modelos y visión artificial
Una de las plataformas de IA más antiguas: inferencia de cualquier modelo en GPU propias o en la nube, moderación y reconocimiento de imágenes.
Plataforma corporativa de agentes de IA fiables
Crea agentes sobre los datos de la empresa con reglas de seguridad y control de la fiabilidad de las respuestas para lanzarlos a clientes con confianza.
Instala programas de IA en tu ordenador con un clic
Un navegador-lanzador que descarga y configura ComfyUI, generadores de vídeo, clonadores de voz y otros proyectos abiertos.
Laboratorio francés con modelos abiertos y rápidos
API de modelos Mistral para texto, código y reconocimiento de documentos, con muchos pesos abiertos. Permite despliegue propio para empresas.
Modelos optimizados por NVIDIA para ejecutar donde quieras
Catálogo de modelos en contenedores listos: los pruebas con una API gratuita y luego los despliegas en tus GPU.
API rápida de modelos abiertos chinos y globales
DeepSeek, Qwen, GLM, Kimi y otros modelos con una API única, rápida y barata.
API de modelos y GPU en la nube para desarrolladores
Modelos abiertos de texto, imagen y vídeo por API, además de alquiler de GPU y sandboxes para agentes.
Entrena y ejecuta modelos en tu ordenador
App de escritorio abierta y sin código: ajustas y ejecutas modelos abiertos en local. Detrás hay una librería rápida de fine-tuning.
API barata para modelos abiertos
Cientos de modelos abiertos de texto, imagen y voz con una API compatible con OpenAI y pago por tokens.
GPU e inferencia de modelos abiertos a buen precio
Alquiler de tarjetas gráficas por horas y API de modelos abiertos populares a bajo coste. Para experimentos y startups.
Marketplace de alquiler de tarjetas gráficas
Alquilas GPU a centros de datos y propietarios particulares mucho más barato que en las grandes nubes, para entrenar y ejecutar modelos.
Datos de aprendizaje por refuerzo para laboratorios de IA
Prepara entornos, evaluaciones y datos expertos para RL y ajuste de modelos de frontera; trabaja con la mayoría de los grandes laboratorios de EE. UU.
Datos para entrenar los modelos más grandes
Prepara datos etiquetados y evaluaciones para laboratorios de IA, gobiernos y empresas, y publica rankings de modelos.
Protección de apps de IA contra prompt injection
Revisa en tiempo real las peticiones y respuestas del modelo y bloquea ataques, fugas de datos y contenido dañino.
La API de los modelos Grok de xAI
Acceso a los modelos Grok para apps: contexto largo, imágenes, llamadas a herramientas y búsqueda en X en tiempo real.
Etiquetado de datos abierto para entrenar modelos
Etiquetas textos, imágenes, audio y vídeo en una sola interfaz y conectas un modelo para preetiquetar. Se instala en tu servidor.
Síntesis y reconocimiento de voz en tiempo real para apps
Modelos rápidos de TTS y STT e inferencia de modelos de lenguaje mediante APIs modulares. Pensado para apps masivas donde importan la latencia y el coste de la voz.
Constructor por nodos para generar imágenes y vídeo
Armas el pipeline con bloques: modelos, ControlNet, escalado y vídeo. Funciona en local con modelos abiertos y tiene versión en la nube.
La interfaz web clásica de Stable Diffusion
Generas en tu propia tarjeta gráfica con cientos de extensiones: inpainting, ControlNet, LoRA y procesamiento por lotes.
Los modelos de vídeo abiertos de Alibaba
Generación de vídeo a partir de texto e imagen con pesos abiertos: se prueba en la web o se ejecuta en local, por ejemplo en ComfyUI.
Pruebas de prompts y ataques a tu propia IA
Compara respuestas de modelos con una batería de tests y ataca tu app de IA para encontrar fugas, jailbreaks y respuestas peligrosas antes del lanzamiento.
Estudios en la nube para entrenar modelos
Entorno de desarrollo con GPU en el navegador: entrenas y ajustas modelos, lanzas APIs y pagas por minuto. De los autores de PyTorch Lightning.
Una sola API para cien modelos
Pasarela abierta con la que la app llama igual a OpenAI, Anthropic, Gemini y otros, con control de gasto, límites y modelos de respaldo.
Depuración y evaluación de apps con LLM
Muestra cada paso del agente o la cadena, reúne datasets y ejecuta evaluaciones de calidad. Del equipo de LangChain, pero sirve con cualquier código.
Inferencia segura de modelos abiertos
Ejecuta el modelo abierto que elijas en capacidad dedicada con peticiones cifradas o enruta cientos de modelos por un solo endpoint. Para empresas que priorizan privacidad y velocidad.
Memoria e infraestructura de agentes para operadoras
Plataforma para empresas de telecomunicaciones: memoria, identidad e inferencia dentro de la red del operador para que los clientes usen agentes de IA sin instalar apps.
Chat gratuito con modelos sin conexión
La app de Nomic ejecuta modelos abiertos en el portátil, incluso sin tarjeta gráfica, y responde sobre tus archivos locales.
El asistente de Zhipu con modelos GLM
Laboratorio chino Zhipu con modelos abiertos GLM potentes: chat, análisis de archivos y tareas de agente. Acceso gratis en el navegador.
El asistente de Alibaba con modelos Qwen
Responde preguntas, escribe código y analiza documentos, y también genera imágenes y vídeo. Funciona con los modelos abiertos Qwen y es gratis.
Modelos locales y en la nube en una sola app
App de escritorio: ejecutas modelos en local o conectas los de la nube, comparas respuestas y conversas con documentos. Los datos se quedan en tu equipo.
Búsqueda vectorial rápida escrita en Rust
Base vectorial abierta con filtros y búsqueda híbrida, disponible en la nube o para instalar en tu servidor.
Base vectorial gestionada para RAG
Guarda embeddings y busca por significado sin administrar servidores, y escala sola. Una de las más usadas.
Busca vulnerabilidades y fallos en apps con LLM
Somete al bot de forma automática a ataques, alucinaciones y sesgos y entrega un informe. Tiene una librería abierta.
Tu propio ChatGPT en tu servidor
Interfaz abierta para modelos locales vía Ollama y para API en la nube, con usuarios, documentos y búsqueda.
Escala cargas de IA sobre Ray
Plataforma de los creadores de Ray: reparte entrenamiento, inferencia y procesado de datos por el clúster sin configurarlo a mano. Para equipos con cómputo pesado.
Monitorización y explicabilidad de modelos
Muestra por qué el modelo tomó una decisión y vigila la deriva y la calidad de las respuestas del LLM. Para sectores con requisitos estrictos.
Interfaz de chat abierta para cualquier modelo
Se parece a ChatGPT, pero conecta decenas de modelos a la vez y se instala en tu servidor para todo el equipo.
Base vectorial abierta con búsqueda híbrida
Combina búsqueda por significado y por palabras clave, y genera ella misma los embeddings. En la nube o en tu servidor.
Chat con tus documentos en tu propio ordenador
Aplicación donde subes archivos y preguntas sobre ellos, conectando cualquier modelo, local o en la nube. Los datos se quedan contigo.
Pone orden en los documentos para los modelos
Convierte PDF, presentaciones, correos y escaneos en fragmentos de texto limpios listos para RAG. Tiene librería abierta.
Base vectorial abierta para RAG
Guarda embeddings y busca por significado: la base de la búsqueda en documentos de las aplicaciones con IA. Se instala con un comando.
Chat abierto con modelos sin conexión
App de escritorio: descargas un modelo y hablas con él en local, los datos no salen de ahí. También conecta API en la nube.
Base vectorial para grandes volúmenes
Base abierta para búsqueda por significado sobre miles de millones de vectores, base de RAG y recomendaciones. Su versión en la nube es Zilliz.
Control de modelos y protección de respuestas LLM
Vigila la calidad de los modelos en producción y filtra respuestas peligrosas del LLM: fugas de datos, datos inventados, toxicidad.
Investigación en simulación para entrenar IA
El laboratorio crea entornos simulados y modelos digitales del mundo donde se entrenan y prueban agentes de IA antes de tareas reales.
Modelos que entienden el vídeo
Encuentran el momento buscado dentro de horas de vídeo a partir de una descripción y resumen el clip. Vía API para medios y archivos.
Los modelos de AI21 Labs por API
Plataforma del laboratorio israelí AI21 con los modelos de la familia Jamba, pensados para contexto largo. Orientada a tareas corporativas.
El hub de modelos abiertos de Alibaba
Catálogo de modelos y demos, especialmente rico en modelos abiertos chinos. Se pueden ejecutar en el navegador.
Repositorio y versiones de prompts
Guarda el historial de cambios de los prompts, registra las llamadas y ejecuta evaluaciones para editarlos sin programador.
Conecta tus datos con los modelos
Framework para RAG y agentes, más el servicio LlamaParse, que desmonta con cuidado PDF complejos con tablas.
Zona de pruebas para los modelos Gemini
Pruebas Gemini gratis en el navegador, ajustas el prompt y obtienes al momento la clave de API y el código para tu proyecto.
Plataforma corporativa de ML y agentes
Construye, valida y despliega modelos y aplicaciones de IA con control de calidad y cumplimiento. Para grandes empresas.
Alquiler barato de GPU por segundos
Levanta un contenedor con tarjeta gráfica en segundos, con máquinas fijas y modo serverless. Popular entre quienes vigilan el gasto.
Inferencia de modelos abiertos en chips propios
Su propio hardware da mucha velocidad con modelos abiertos grandes. Permite despliegue dentro de la red del cliente.
La respuesta más rápida, sobre chips propios
Un chip enorme sostiene el modelo entero, así que los tokens salen varias veces más rápido que en tarjetas gráficas. Se nota en voz y razonamientos largos.
Ejecutar funciones Python en GPU desde el código
Una función normal se convierte en tarea en la nube con un decorador y la infraestructura se levanta sola. Popular para inferencia y procesado de datos.
Despliega tus modelos como servicio
Coge tu modelo y lo convierte en un endpoint escalable con autoescalado y monitorización. Sirve cuando tu propio modelo pasa a producción.
Plataforma para gestionar GPU y procesos de ML
Gestiona clústeres de GPU, reparte la capacidad entre equipos y ayuda a llevar entrenamientos y modelos generativos a producción. Base de código abierto.
Mem0: memoria para aplicaciones de IA
Mem0 es una capa de memoria para aplicaciones y agentes de IA. Permite conservar contexto entre interacciones y reutilizarlo en tareas posteriores.
Alquiler de GPU para entrenar modelos
Da acceso a máquinas con tarjetas punteras por horas o a largo plazo, con el entorno ya preparado. Lo usan investigadores y equipos de ML.
Observabilidad y pruebas de agentes de IA (Opik)
Registra cada paso del agente, detecta errores silenciosos, ejecuta tests y optimiza prompts. El seguimiento de experimentos de ML sigue disponible.
Pasarela a modelos con control y seguridad
Punto único de acceso a cientos de modelos con caché, límites, respaldo y control de gasto. Ahora forma parte de Palo Alto Networks como Prisma AIRS AI Gateway.
Registro de experimentos para equipos de ML
Guarda cada entrenamiento con sus gráficas y artefactos para comparar enfoques. Trae un circuito aparte para aplicaciones con LLM.
Inferencia rápida de modelos abiertos
Mantiene los modelos abiertos populares con alta velocidad de respuesta y permite afinarlos a tu caso. Se paga por tokens.
Vigila la calidad de los modelos en producción
Muestra dónde empezó a fallar el modelo y cómo cambió la calidad de las respuestas con el tiempo. Trae un circuito aparte para evaluar aplicaciones con LLM.
Plataforma serverless para cargas de ML
Despliega el modelo o el procesamiento en GPU sin configurar servidores, y escala según la carga. Se paga por tiempo de ejecución.
Modelos que entienden vídeo y sonido
Trabajan no solo con texto e imágenes, sino también con vídeo y audio en una misma consulta. Se pueden desplegar en tu propia red.
Registros y gasto de las llamadas a los modelos
Guarda cada llamada al LLM con su coste, latencia y respuesta, para ver a dónde se va el dinero. Se conecta con una línea de código.
Estándar abierto de registro de experimentos ML
Guarda parámetros y métricas del entrenamiento, almacena modelos y controla sus versiones. Se ha convertido en el estándar de facto en equipos de ML.
Ejecutar código en GPU bajo demanda
Levanta cómputo en tarjetas gráficas desde un script de Python normal y lo apaga al terminar. Pagas por segundos, no por un servidor parado.
Modelos para tareas de empresa y búsqueda
Están afinados para escenarios corporativos: búsqueda sobre una base documental, clasificación, embeddings. Se pueden desplegar en tu propia red.
Nube de tarjetas gráficas para entrenar e inferir
Alquila clústeres de GPU para cargas pesadas: entrenamiento de modelos grandes e inferencia masiva. Trabaja con equipos de IA grandes.
Comprueba si tu aplicación con IA mejoró
Pasa tus prompts por conjuntos de ejemplos y muestra qué mejoró y qué se rompió tras un cambio. Sirve para no arreglar a ciegas.
Evaluación humana de IA de voz por API
Ofrece a los equipos que crean asistentes de voz y síntesis de habla valoraciones rápidas de personas reales: naturalidad, emoción y calidad del diálogo con una sola llamada a la API.
Detección de deepfakes y marcas de agua para empresas
Verifica en tiempo real voz, vídeo e imágenes en busca de falsificaciones y marca el contenido generado con marcas de agua. En la nube o en tus servidores.
Decenas de modelos en una sola suscripción
Envía la misma consulta a varios modelos a la vez y ayuda a elegir la mejor respuesta. Cómodo para comparar modelos con tus propias tareas sin pagar varias suscripciones.
Más de 500 modelos en una sola nube
Reúne cientos de modelos de imagen, vídeo, audio y lenguaje en una misma interfaz. Para desarrolladores y creadores que quieren comparar y probar.
Arranque rápido de modelos generativos
Inferencia por API de modelos de imagen, vídeo y sonido con foco en la velocidad. Cómodo cuando la generación va dentro de tu propio producto.
Los modelos Claude por API para desarrolladores
La plataforma de Anthropic para integrar Claude en productos: contexto largo, herramientas, caché de prompts y peticiones por lotes. Antes, la consola de Anthropic API.
Una sola API para todos los modelos
Punto de entrada único a modelos de distintos proveedores, con facturación común y cambio automático cuando uno falla.
Framework para aplicaciones con IA
Librería para montar cadenas, RAG y agentes en Python y TypeScript. Incluye herramientas de trazado y evaluación de calidad.
Nube para modelos abiertos
Inferencia, ajuste fino e instancias dedicadas para modelos abiertos, con pago por tokens.
Modelo abierto de reconocimiento de voz
Pasa audio a texto en decenas de idiomas, funciona en local y es gratis. Es la base de un montón de servicios de transcripción.
Modelos locales con interfaz
Aplicación de escritorio: descargas un modelo del catálogo y hablas con él sin conexión; incluye un servidor local compatible con OpenAI.
Inferencia extremadamente rápida
Sus propios chips responden varias veces más rápido que una GPU normal, algo que se nota en escenarios de voz e interactivos.
Ejecutar modelos abiertos por API
Miles de modelos listos que se lanzan con una petición HTTP y se pagan por segundos de uso. También puedes publicar el tuyo.
Modelos en local con un solo comando
Ejecuta modelos abiertos en tu portátil o servidor sin internet. Los datos no salen de ahí y tienes una API local.
Los modelos de OpenAI para desarrolladores
Acceso por API a modelos de texto, imagen, voz y embeddings, con herramientas para agentes y ajuste fino.
Modelo abierto para imágenes
Modelo de pesos abiertos: se ejecuta en tu propio ordenador, se afina a tu estilo y se integra en productos propios sin límites.
Asistente europeo rápido, de Mistral
Asistente del laboratorio francés Mistral, con respuesta muy rápida y modelos abiertos por debajo. Cómodo cuando importa que los datos se queden en la UE.
Modelo de imagen potente de Black Forest Labs
Maneja bien el texto dentro de la imagen y los prompts complicados. Disponible por API y en muchos servicios de terceros; algunas versiones tienen pesos abiertos.
Muchos modelos en una sola interfaz
Agregador de Quora: una suscripción da acceso a modelos de distintos laboratorios, permite armar bots propios y comparar respuestas.
Modelos abiertos fuertes en matemáticas y código
Laboratorio chino conocido por su API barata y por modelos de razonamiento con pesos abiertos. Buena opción cuando hay que cubrir mucho volumen sin gastar.