Motor de Visão Multimodal
Tokenizador de Imagens
Visualize a tokenização de imagens, divisão de blocos de 512x512 da OpenAI e grades de patches espaciais de Vision Transformer (ViT) com tela interativa e calculadoras de custos.
Resposta direta: O que é o Tokenizador de Imagens?
O Tokenizador de Imagens é uma ferramenta visual interativa que detalha como modelos multimodais (LLMs) e Vision Transformers (ViTs) processam imagens. Inspecione grades de patches, contagens de blocos, dimensionamento de resolução e custos de tokens para GPT-4o, Claude 3.5 Sonnet e Gemini.
Drop your image here or click to browse
PNG, JPEG, WebP, or GIF up to 10MB. Or paste directly from clipboard (Ctrl+V / Cmd+V).
image.png 1920x1080
Total Image Tokens
0 ~$0.0000 USD
Base Tokens 85
Tile Tokens 0
Grid & Tile Breakdown
Original Size: -
Scaled Calculation Size: -
Grid Configuration: -
Total Grid Tiles: -
Tile Inspection List
Upload an image to inspect grid tiles…