Skip to main content
Inicio / Tokenizador de IA / Tokenizador de Imágenes
Motor de Visión Multimodal

Tokenizador de Imágenes

Visualiza la tokenización de imágenes, desglose de mosaicos de 512x512 de OpenAI y cuadrículas de parches espaciales de Vision Transformer (ViT) con lienzo interactivo y calculadoras de costos.

Respuesta directa: ¿Qué es el Tokenizador de Imágenes?

El Tokenizador de Imágenes es una herramienta visual interactiva que desglosa cómo los modelos multimodales (LLMs) y Vision Transformers (ViTs) procesan imágenes. Inspecciona cuadrículas de parches, recuentos de mosaicos, escalado de resolución y costos de tokens para GPT-4o, Claude 3.5 Sonnet y Gemini.

Drop your image here or click to browse

PNG, JPEG, WebP, or GIF up to 10MB. Or paste directly from clipboard (Ctrl+V / Cmd+V).

Total Image Tokens
0 ~$0.0000 USD
Base Tokens 85
Tile Tokens 0

Grid & Tile Breakdown

Original Size: -
Scaled Calculation Size: -
Grid Configuration: -
Total Grid Tiles: -

Tile Inspection List

Upload an image to inspect grid tiles…