Motor de Visión Multimodal
Tokenizador de Imágenes
Visualiza la tokenización de imágenes, desglose de mosaicos de 512x512 de OpenAI y cuadrículas de parches espaciales de Vision Transformer (ViT) con lienzo interactivo y calculadoras de costos.
Respuesta directa: ¿Qué es el Tokenizador de Imágenes?
El Tokenizador de Imágenes es una herramienta visual interactiva que desglosa cómo los modelos multimodales (LLMs) y Vision Transformers (ViTs) procesan imágenes. Inspecciona cuadrículas de parches, recuentos de mosaicos, escalado de resolución y costos de tokens para GPT-4o, Claude 3.5 Sonnet y Gemini.
Drop your image here or click to browse
PNG, JPEG, WebP, or GIF up to 10MB. Or paste directly from clipboard (Ctrl+V / Cmd+V).
image.png 1920x1080
Total Image Tokens
0 ~$0.0000 USD
Base Tokens 85
Tile Tokens 0
Grid & Tile Breakdown
Original Size: -
Scaled Calculation Size: -
Grid Configuration: -
Total Grid Tiles: -
Tile Inspection List
Upload an image to inspect grid tiles…