Nota do editor (2026-05). O Chrome 150 descontinuou o navigator.modelContext em favor do document.modelContext (conforme o PR #184 da especificação WebMCP, já que as ferramentas passam a ter escopo por Document). Os exemplos deste post usam o padrão de detecção de recurso compatível com versões futuras, recomendado pela equipe do Chrome:

const modelContext = document.modelContext || navigator.modelContext;
if (modelContext) {
  // Registrar ferramentas...
}

A própria integração do WebConverter usa exatamente esse fallback, então continua funcionando em navegadores que ainda trazem o identificador antigo.

Quando lançamos o suporte a WebMCP pela primeira vez, apenas a conversão de imagens estava conectada. A partir de hoje, todos os recursos do site são expostos como uma ferramenta WebMCP: um agente de IA pode chamar document.modelContext e converter imagens, criar e editar PDFs, fazer OCR de digitalizações, extrair texto de PDF, converter documentos com Pandoc, converter e cortar vídeo, converter e extrair áudio, transcrever fala com Whisper e remover fundos de imagens, tudo localmente no navegador, tudo sem enviar nada.

O catálogo completo de ferramentas

As treze ferramentas são registradas globalmente, em todas as páginas do WebConverter, não apenas na página WebMCP, para que um agente possa usá-las de onde quer que o usuário esteja. Todas retornam um arquivo base64 mais uma URL data: (e, quando apropriado, a saída estruturada como texto simples ou JSON).

As ferramentas incluem: convert_image (com um fallback de decodificação no navegador que adiciona HEIC no Safari/iOS e AVIF), images_to_pdf, images_to_searchable_pdf (OCR com Tesseract), merge_pdfs, reorder_pdf_pages, delete_pdf_pages, extract_pdf_text (pdf.js), convert_document (Pandoc), convert_audio, convert_video e trim_video (ffmpeg-wasm), remove_image_background (U²-Net + matting em WASM), transcribe_audio (Whisper) e list_supported_formats para descoberta.

Por que isso importa para os agentes

Um assistente de IA que quer fazer algo com um arquivo hoje geralmente tem três opções ruins: enviá-lo para uma API de terceiros, executar uma ferramenta no servidor que acessa seus dados ou recusar. O WebMCP muda isso porque a ferramenta é o próprio JavaScript da página. O agente ganha a capacidade; seu arquivo nunca sai da aba. Não há chave de API, nem limite de requisições, nem custo, e quase nenhum CO2, porque o ciclo de envio, processamento e download nunca acontece.

Preguiçoso por design

O bootstrap do webmcp.js é minúsculo. As partes pesadas (os ~56 MB de WASM do Pandoc, os núcleos do ffmpeg, o modelo ONNX do U²-Net, o modelo do Whisper, os dados de idioma do Tesseract) só são baixadas na primeira vez que a ferramenta correspondente é chamada, e então o navegador as armazena em cache. Agentes que nunca chamam convert_video nunca pagam o download do ffmpeg.

Privacidade, segurança, honestidade

Toda ferramenta é anotada com readOnlyHint: bytes entram, bytes saem, sem gravações, sem chamadas de rede, exceto o download único e preguiçoso do motor. Somos honestos sobre os formatos também: o HEIC é listado como "apenas Safari/iOS" porque essa é a verdade. Chrome e Firefox não decodificam HEIC nativamente, e distribuir um decodificador HEIC de vários megabytes violaria o orçamento de tamanho de assets do projeto. O fallback decodifica apenas o que o próprio navegador consegue decodificar, e nada além disso.

Experimente

A página WebMCP lista todas as ferramentas registradas e inclui uma demonstração ao vivo funcional. Se você está construindo um agente no navegador, ou apenas quer ver como é um servidor WebMCP completo, é assim que se parece uma superfície de ferramentas de arquivo honesta, privada e sem custo. E é apenas uma página web.

Pronto para converter suas imagens?

Experimente a WebConverter de Graça