Skip to main content
Motor de Visão Multimodal

Tokenizador de Imagens

Visualize a tokenização de imagens, divisão de blocos de 512x512 da OpenAI e grades de patches espaciais de Vision Transformer (ViT) com tela interativa e calculadoras de custos.

Resposta direta: O que é o Tokenizador de Imagens?

O Tokenizador de Imagens é uma ferramenta visual interativa que detalha como modelos multimodais (LLMs) e Vision Transformers (ViTs) processam imagens. Inspecione grades de patches, contagens de blocos, dimensionamento de resolução e custos de tokens para GPT-4o, Claude 3.5 Sonnet e Gemini.

Drop your image here or click to browse

PNG, JPEG, WebP, or GIF up to 10MB. Or paste directly from clipboard (Ctrl+V / Cmd+V).

Total Image Tokens
0 ~$0.0000 USD
Base Tokens 85
Tile Tokens 0

Grid & Tile Breakdown

Original Size: -
Scaled Calculation Size: -
Grid Configuration: -
Total Grid Tiles: -

Tile Inspection List

Upload an image to inspect grid tiles…