Hugging Face
O grande hub dos modelos abertos
Centenas de milhares de modelos e datasets, demos no Spaces e bibliotecas de treinamento. É o ponto de partida de qualquer trabalho com código aberto.
Inferência, hospedagem de modelos e acesso por API.
114 ferramentas
O grande hub dos modelos abertos
Centenas de milhares de modelos e datasets, demos no Spaces e bibliotecas de treinamento. É o ponto de partida de qualquer trabalho com código aberto.
Os criadores do YOLO para detecção de objetos
Os populares modelos abertos YOLO para detecção, segmentação e rastreamento, mais uma plataforma na nuvem para treinar com seus dados.
Rotulagem configurável para treinar LLMs e visão
Construtor de interfaces para rotular qualquer tarefa, incluindo avaliação de respostas de modelos, mais um time de avaliadores.
Armazém multimodal de dados para treinar IA
Guarda texto, imagens, vídeo e vetores numa só tabela e acelera a curadoria de dados e a engenharia de atributos para treinar modelos. Formato aberto Lance.
Embeddings, reranking e leitura da web para busca
Modelos multilíngues de embeddings e reranking e uma Reader API que transforma qualquer página em texto limpo para LLMs.
Embeddings precisos para busca e RAG
Modelos de embeddings e rerankers, inclusive para código, textos jurídicos e financeiros. Faz parte do MongoDB.
Busca vetorial e textual barata sobre armazenamento de objetos
Guarda os índices no S3, então buscar em volumes enormes custa muito menos. Usado pelo Cursor, Notion e outros.
Os dados e a IA da empresa numa plataforma
Armazenamento e processamento de dados, treino de modelos e agentes que trabalham sobre os dados corporativos, mais AI/BI para perguntas em linguagem natural.
Extração precisa de dados de documentos complexos
A empresa de Andrew Ng: transforma PDFs com tabelas, gráficos e formulários em dados estruturados para RAG e automação.
A plataforma de IA corporativa do Google Cloud (antigo Vertex AI)
Gemini, Claude e modelos abertos numa só nuvem, mais ferramentas para criar, escalar e governar agentes com proteção de dados.
O motor para rodar LLMs em hardware comum
A base aberta do Ollama, LM Studio e muitos outros: roda modelos quantizados em CPU, Mac e placas de vídeo.
Servidor rápido para rodar modelos em produção
Motor de inferência aberto de alto desempenho: você sobe uma API compatível com a OpenAI para modelos abertos nas suas GPUs.
Banco vetorial na nuvem baseado no Milvus
A versão gerenciada do Milvus aberto para buscar entre bilhões de vetores em RAG, recomendações e busca de imagens.
Modelos abertos na rede da Cloudflare
Você chama modelos de texto, imagem e voz direto dos Workers, perto do usuário, com uma cota diária gratuita.
Busca em documentos pronta para apps de IA
Você envia arquivos e o serviço processa, indexa e busca neles, inclusive imagens e tabelas. Tem modelos de embeddings abertos.
Modelos Claude, Llama e outros na AWS
Acesso unificado a modelos de várias empresas dentro da infraestrutura da AWS, com bases de conhecimento, agentes e filtros de segurança.
A plataforma da Microsoft para modelos e agentes (antigo Azure AI Foundry)
Modelos da OpenAI e milhares de outros no Azure, construtor de agentes, avaliação e monitoramento no ambiente corporativo da Microsoft.
Camada de dados para IA física e robótica
Gerencia, seleciona e rotula petabytes de dados — de sensores e vídeo a texto — para times que treinam robôs, veículos autônomos e modelos multimodais.
Dados especializados e avaliação para laboratórios de IA
Cria datasets com especialistas e rotulagem programática para ajustar e testar modelos em áreas especializadas.
A plataforma de IA da IBM focada em controle e conformidade
Modelos Granite e de terceiros, ferramentas para agentes e controle rigoroso de riscos e exigências regulatórias para grandes empresas.
Visão computacional da rotulagem à implantação
Você rotula fotos, treina um modelo de detecção de objetos e implanta na câmera, servidor ou celular sem saber muito de ML.
Plataforma para rodar modelos e visão computacional
Uma das plataformas de IA mais antigas: inferência de qualquer modelo em GPUs próprias ou na nuvem, moderação e reconhecimento de imagens.
Plataforma corporativa de agentes de IA confiáveis
Cria agentes sobre os dados da empresa com regras de segurança e controle da confiabilidade das respostas para colocá-los diante de clientes com tranquilidade.
Instale programas de IA no computador com um clique
Um navegador-lançador que baixa e configura o ComfyUI, geradores de vídeo, clonadores de voz e outros projetos abertos.
Laboratório francês com modelos abertos e rápidos
API de modelos Mistral para texto, código e reconhecimento de documentos, com muitos pesos abertos. Permite implantação própria para empresas.
Modelos otimizados pela NVIDIA para rodar onde quiser
Catálogo de modelos em contêineres prontos: você testa numa API gratuita e depois implanta nas suas GPUs.
API rápida de modelos abertos chineses e globais
DeepSeek, Qwen, GLM, Kimi e outros modelos numa API única, rápida e barata.
API de modelos e GPUs na nuvem para desenvolvedores
Modelos abertos de texto, imagem e vídeo por API, além de aluguel de GPUs e sandboxes para agentes.
Treine e rode modelos no seu computador
App de desktop aberto e sem código: você ajusta e roda modelos abertos localmente. Por trás há uma biblioteca rápida de fine-tuning.
API barata para modelos abertos
Centenas de modelos abertos de texto, imagem e voz com API compatível com a OpenAI e pagamento por tokens.
GPUs e inferência de modelos abertos a preço baixo
Aluguel de placas de vídeo por hora e API de modelos abertos populares a baixo custo. Para experimentos e startups.
Marketplace de aluguel de placas de vídeo
Você aluga GPUs de data centers e donos particulares muito mais barato que nas grandes nuvens, para treinar e rodar modelos.
Dados de aprendizado por reforço para laboratórios de IA
Prepara ambientes, avaliações e dados especializados para RL e ajuste de modelos de fronteira; trabalha com a maioria dos grandes laboratórios dos EUA.
Dados para treinar os maiores modelos
Prepara dados rotulados e avaliações para laboratórios de IA, governos e empresas, e publica rankings de modelos.
Proteção de apps de IA contra prompt injection
Verifica em tempo real as requisições e respostas do modelo e bloqueia ataques, vazamentos de dados e conteúdo nocivo.
A API dos modelos Grok da xAI
Acesso aos modelos Grok para apps: contexto longo, imagens, chamadas de ferramentas e busca no X em tempo real.
Rotulagem de dados aberta para treinar modelos
Você rotula textos, imagens, áudio e vídeo numa só interface e conecta um modelo para pré-rotular. Instala no seu servidor.
Síntese e reconhecimento de fala em tempo real para apps
Modelos rápidos de TTS e STT e inferência de modelos de linguagem por APIs modulares. Feito para apps de massa em que latência e custo da voz importam.
Construtor por nós para gerar imagens e vídeo
Você monta o pipeline com blocos: modelos, ControlNet, upscale e vídeo. Roda localmente com modelos abertos e tem versão na nuvem.
A interface web clássica do Stable Diffusion
Você gera na própria placa de vídeo com centenas de extensões: inpainting, ControlNet, LoRA e processamento em lote.
Os modelos de vídeo abertos da Alibaba
Geração de vídeo a partir de texto e imagem com pesos abertos: dá para testar no site ou rodar localmente, por exemplo no ComfyUI.
Testes de prompts e ataques à sua própria IA
Compara respostas de modelos numa bateria de testes e ataca o seu app de IA para achar vazamentos, jailbreaks e respostas perigosas antes do lançamento.
Estúdios na nuvem para treinar modelos
Ambiente de desenvolvimento com GPU no navegador: você treina e ajusta modelos, sobe APIs e paga por minuto. Dos autores do PyTorch Lightning.
Uma só API para cem modelos
Gateway aberto pelo qual o app chama OpenAI, Anthropic, Gemini e outros do mesmo jeito, com controle de gastos, limites e modelos reserva.
Depuração e avaliação de apps com LLM
Mostra cada etapa do agente ou da cadeia, reúne datasets e roda avaliações de qualidade. Do time do LangChain, mas funciona com qualquer código.
Inferência segura de modelos abertos
Roda o modelo aberto escolhido em capacidade dedicada com requisições criptografadas ou roteia centenas de modelos por um único endpoint. Para empresas que priorizam privacidade e velocidade.
Memória e infraestrutura de agentes para operadoras
Plataforma para empresas de telecom: memória, identidade e inferência dentro da rede da operadora para que os clientes usem agentes de IA sem instalar apps.
Chat gratuito com modelos sem internet
O app da Nomic roda modelos abertos no notebook, mesmo sem placa de vídeo, e responde sobre os seus arquivos locais.
O assistente da Zhipu com modelos GLM
Laboratório chinês Zhipu com modelos abertos GLM fortes: chat, análise de arquivos e tarefas de agente. Acesso gratuito no navegador.
O assistente da Alibaba com modelos Qwen
Responde perguntas, escreve código e analisa documentos, e também gera imagens e vídeo. Funciona com os modelos abertos Qwen e é gratuito.
Modelos locais e na nuvem num só app
App de desktop: você roda modelos localmente ou conecta os da nuvem, compara respostas e conversa com documentos. Os dados ficam no computador.
Busca vetorial rápida escrita em Rust
Banco vetorial aberto com filtros e busca híbrida, disponível na nuvem ou para instalar no seu servidor.
Banco vetorial gerenciado para RAG
Guarda embeddings e busca por significado sem administrar servidores, e escala sozinho. Um dos mais usados.
Procura vulnerabilidades e falhas em apps com LLM
Submete o bot automaticamente a ataques, alucinações e vieses e entrega um relatório. Tem uma biblioteca aberta.
O seu próprio ChatGPT no seu servidor
Interface aberta para modelos locais via Ollama e para APIs na nuvem, com usuários, documentos e busca.
Escala cargas de IA sobre o Ray
Plataforma dos criadores do Ray: distribui treinamento, inferência e processamento de dados pelo cluster sem configurar à mão. Para times com computação pesada.
Monitoramento e explicabilidade de modelos
Mostra por que o modelo tomou uma decisão e vigia o drift e a qualidade das respostas do LLM. Para setores com exigências rígidas.
Interface de chat aberta para qualquer modelo
Parece o ChatGPT, mas conecta dezenas de modelos ao mesmo tempo e instala no seu servidor para o time todo.
Banco vetorial aberto com busca híbrida
Combina busca por significado e por palavras-chave, e gera ele mesmo os embeddings. Na nuvem ou no seu servidor.
Chat com os seus documentos no seu computador
Aplicativo em que você sobe arquivos e pergunta sobre eles, conectando qualquer modelo, local ou na nuvem. Os dados ficam com você.
Põe ordem nos documentos para os modelos
Transforma PDF, apresentações, e-mails e digitalizações em trechos de texto limpos prontos para RAG. Tem biblioteca aberta.
Banco vetorial aberto para RAG
Guarda embeddings e busca por significado: a base da busca em documentos nas aplicações com IA. Instala-se com um comando.
Chat aberto com modelos sem internet
App de desktop: você baixa um modelo e conversa com ele localmente, os dados não saem dali. Também conecta APIs na nuvem.
Banco vetorial para grandes volumes
Banco aberto para busca por significado em bilhões de vetores, base de RAG e recomendações. A versão em nuvem é o Zilliz.
Controle de modelos e proteção de respostas LLM
Vigia a qualidade dos modelos em produção e filtra respostas perigosas do LLM: vazamentos de dados, fatos inventados, toxicidade.
Pesquisa em simulação para treinar IA
O laboratório cria ambientes simulados e modelos digitais do mundo onde agentes de IA são treinados e testados antes de tarefas reais.
Modelos que entendem vídeo
Encontram o momento procurado dentro de horas de vídeo a partir de uma descrição e resumem o clipe. Via API para mídia e acervos.
Os modelos da AI21 Labs por API
Plataforma do laboratório israelense AI21 com os modelos da família Jamba, feitos para contexto longo. Voltada a tarefas corporativas.
O hub de modelos abertos da Alibaba
Catálogo de modelos e demos, especialmente rico em modelos abertos chineses. Dá para rodar direto no navegador.
Repositório e versões de prompts
Guarda o histórico de mudanças dos prompts, registra as chamadas e roda avaliações para editar sem programador.
Conecta os seus dados aos modelos
Framework para RAG e agentes, mais o serviço LlamaParse, que desmonta com cuidado PDFs complexos com tabelas.
Área de testes para os modelos Gemini
Você testa o Gemini de graça no navegador, ajusta o prompt e recebe na hora a chave de API e o código para o seu projeto.
Plataforma corporativa de ML e agentes
Constrói, valida e publica modelos e aplicações de IA com controle de qualidade e conformidade. Para grandes empresas.
Aluguel barato de GPU por segundos
Sobe um contêiner com placa de vídeo em segundos, com máquinas fixas e modo serverless. Popular entre quem controla o gasto.
Inferência de modelos abertos em chips próprios
O hardware próprio entrega alta velocidade com modelos abertos grandes. Permite implantação dentro da rede do cliente.
A resposta mais rápida, em chips próprios
Um chip enorme segura o modelo inteiro, então os tokens saem várias vezes mais rápido que em placas de vídeo. Aparece em voz e raciocínios longos.
Rodar funções Python em GPU direto do código
Uma função comum vira tarefa na nuvem com um decorador e a infraestrutura sobe sozinha. Popular para inferência e processamento de dados.
Publica seus modelos como serviço
Pega o seu modelo e o transforma num endpoint escalável com autoescalonamento e monitoramento. Serve quando o seu modelo vai para produção.
Plataforma para gerenciar GPUs e processos de ML
Gerencia clusters de GPU, distribui a capacidade entre times e ajuda a colocar treinos e modelos generativos em produção. Base de código aberto.
Mem0: memória para aplicações de IA
Mem0 é uma camada de memória para aplicações e agentes de IA. Permite manter contexto entre interações e reutilizá-lo em tarefas posteriores.
Aluguel de GPU para treinar modelos
Dá acesso a máquinas com placas de ponta por hora ou a longo prazo, com o ambiente já pronto. Usado por pesquisadores e times de ML.
Observabilidade e testes de agentes de IA (Opik)
Registra cada passo do agente, pega erros silenciosos, roda testes e otimiza prompts. O acompanhamento de experimentos de ML continua.
Gateway para modelos com controle e segurança
Ponto único de acesso a centenas de modelos com cache, limites, fallback e controle de gastos. Agora faz parte da Palo Alto Networks como Prisma AIRS AI Gateway.
Registro de experimentos para times de ML
Guarda cada treinamento com seus gráficos e artefatos para comparar abordagens. Traz um circuito à parte para aplicações com LLM.
Inferência rápida de modelos abertos
Mantém os modelos abertos populares com alta velocidade de resposta e permite ajustá-los ao seu caso. Paga-se por tokens.
Vigia a qualidade dos modelos em produção
Mostra onde o modelo começou a errar e como a qualidade das respostas mudou ao longo do tempo. Traz um circuito à parte para avaliar aplicações com LLM.
Plataforma serverless para cargas de ML
Publica o modelo ou o processamento em GPU sem configurar servidores, e escala conforme a carga. Paga-se por tempo de execução.
Modelos que entendem vídeo e som
Trabalham não só com texto e imagens, mas também com vídeo e áudio na mesma consulta. Podem ser instalados na sua própria rede.
Logs e gasto das chamadas aos modelos
Guarda cada chamada ao LLM com custo, latência e resposta, para ver para onde vai o dinheiro. Conecta-se com uma linha de código.
Padrão aberto de registro de experimentos ML
Guarda parâmetros e métricas do treinamento, armazena modelos e controla suas versões. Virou o padrão de fato nos times de ML.
Rodar código em GPU sob demanda
Sobe processamento em placas de vídeo a partir de um script Python comum e desliga ao terminar. Você paga por segundos, não por um servidor parado.
Modelos para tarefas de empresa e busca
São ajustados a cenários corporativos: busca sobre uma base documental, classificação, embeddings. Podem ser instalados na sua própria rede.
Nuvem de placas de vídeo para treinar e inferir
Aluga clusters de GPU para cargas pesadas: treinamento de modelos grandes e inferência em massa. Trabalha com times de IA grandes.
Verifica se a sua aplicação com IA melhorou
Roda os seus prompts em conjuntos de exemplos e mostra o que melhorou e o que quebrou depois de uma mudança. Serve para não consertar às cegas.
Avaliação humana de IA de voz por API
Dá aos times que criam assistentes de voz e síntese de fala avaliações rápidas de pessoas reais: naturalidade, emoção e qualidade do diálogo com uma só chamada de API.
Detecção de deepfakes e marcas d'água para empresas
Verifica em tempo real voz, vídeo e imagens em busca de falsificações e marca o conteúdo gerado com marca d'água. Na nuvem ou nos seus servidores.
Dezenas de modelos numa só assinatura
Envia a mesma pergunta a vários modelos ao mesmo tempo e ajuda a escolher a melhor resposta. Prático para comparar modelos nas suas próprias tarefas sem pagar várias assinaturas.
Mais de 500 modelos numa só nuvem
Reúne centenas de modelos de imagem, vídeo, áudio e linguagem na mesma interface. Para desenvolvedores e criadores que querem comparar e testar.
Execução rápida de modelos generativos
Inferência por API de modelos de imagem, vídeo e som com foco em velocidade. Prático quando a geração roda dentro do seu produto.
Os modelos Claude por API para desenvolvedores
A plataforma da Anthropic para integrar o Claude em produtos: contexto longo, ferramentas, cache de prompts e requisições em lote. Antes, o console da Anthropic API.
Uma única API para todos os modelos
Ponto de entrada único para modelos de vários provedores, com faturamento comum e troca automática quando um falha.
Framework para aplicações com IA
Biblioteca para montar cadeias, RAG e agentes em Python e TypeScript. Inclui ferramentas de rastreamento e avaliação de qualidade.
Nuvem para modelos abertos
Inferência, ajuste fino e instâncias dedicadas para modelos abertos, com pagamento por tokens.
Modelo aberto de reconhecimento de fala
Passa áudio para texto em dezenas de idiomas, funciona local e é gratuito. É a base de um monte de serviços de transcrição.
Modelos locais com interface
Aplicativo de desktop: você baixa um modelo do catálogo e conversa com ele offline; inclui um servidor local compatível com a OpenAI.
Inferência extremamente rápida
Os chips próprios respondem várias vezes mais rápido que uma GPU comum, o que aparece em cenários de voz e interativos.
Executar modelos abertos por API
Milhares de modelos prontos que rodam com uma requisição HTTP e são pagos por segundos de uso. Também dá para publicar o seu.
Modelos locais com um único comando
Executa modelos abertos no seu notebook ou servidor sem internet. Os dados não saem dali e você tem uma API local.
Os modelos da OpenAI para desenvolvedores
Acesso por API a modelos de texto, imagem, voz e embeddings, com ferramentas para agentes e ajuste fino.
Modelo aberto para imagens
Modelo de pesos abertos: roda no seu próprio computador, é ajustado ao seu estilo e se integra a produtos próprios sem limites.
Assistente europeu rápido, da Mistral
Assistente do laboratório francês Mistral, com resposta muito rápida e modelos abertos por baixo. Prático quando importa que os dados fiquem na UE.
Modelo de imagem forte da Black Forest Labs
Lida bem com texto dentro da imagem e com prompts complicados. Disponível por API e em muitos serviços de terceiros; algumas versões têm pesos abertos.
Muitos modelos numa só interface
Agregador da Quora: uma assinatura dá acesso a modelos de vários laboratórios, permite montar bots próprios e comparar respostas.
Modelos abertos fortes em matemática e código
Laboratório chinês conhecido pela API barata e por modelos de raciocínio com pesos abertos. Boa escolha quando é preciso cobrir muito volume sem gastar.