Modelos

Explora 47 modelos LLM canónicos de todos los proveedores

Algunas descripciones forman parte del piloto de traducción automática y aún no han sido revisadas.

Mostrando 1–24 de 47 modelos

GPT-5.6 Sol

Estados Unidos

El modelo insignia de la serie GPT-5.6 de OpenAI, que mejora la programación, el razonamiento científico, la planificación a largo plazo y los flujos de trabajo con agentes, al tiempo que aumenta la fiabilidad y la eficiencia en tareas reales exigentes. Añade un nivel máximo de esfuerzo de razonamiento y un modo ultra que inicia subagentes para trabajos complejos de varios pasos.

Contexto
1.0M
Publicado
jul 2026

Gemini 3.5 Pro

Estados Unidos

El modelo insignia Gemini de Google DeepMind, reconstruido sobre una base nueva con una ventana de contexto de 2 millones de tokens y un modo de razonamiento Deep Think para las tareas más difíciles de matemáticas, programación y multimodalidad. Es multimodal de forma nativa para texto, imagen, audio y vídeo, con llamadas de función en streaming y una sólida fundamentación en contextos largos.

Contexto
2.0M
Publicado
jul 2026

GPT-5.6 Luna

Estados Unidos

The fast, low-cost tier of OpenAI's GPT-5.6 series, optimized for high-volume, latency-sensitive tasks such as classification, extraction, routing, and lightweight agentic steps. Approaches the larger GPT-5.6 tiers on many benchmarks while running several times faster at a fraction of the price.

Contexto
400K
Publicado
jul 2026

Muse Spark 1.1

Estados Unidos

Meta Superintelligence Labs' updated flagship, building on Muse Spark with stronger agentic reasoning, more reliable multi-agent orchestration, and improved multimodal understanding across voice, text, and image. Extends the context window and reduces latency and reasoning token usage while raising coding and tool-use accuracy. Powers Meta AI across its product ecosystem.

Contexto
512K
Publicado
jul 2026

GPT-5.6 Terra

Estados Unidos

La opción equilibrada de la serie GPT-5.6 de OpenAI, que intercambia una pequeña parte de la calidad máxima por una latencia y un coste notablemente menores. Conserva sólidas capacidades de razonamiento, programación y uso de herramientas por agentes, con esfuerzo de razonamiento configurable, por lo que resulta adecuada como opción predeterminada para cargas de producción que necesitan capacidades de vanguardia a escala.

Contexto
1.0M
Publicado
jul 2026

Grok 4.5

Estados Unidos

El modelo más potente de xAI hasta la fecha, diseñado para destacar en programación, tareas con agentes y trabajo del conocimiento, y desarrollado junto con herramientas de programación para ingeniería de software real. Ofrece acceso a información en tiempo real, razonamiento ampliado y uso de herramientas con contextos grandes mediante una API compatible con OpenAI.

Contexto
500K
Publicado
jul 2026

Claude Sonnet 5

Estados Unidos

El modelo de clase Sonnet más capaz de Anthropic, que lleva capacidades de vanguardia en programación, agentes y trabajo profesional al nivel intermedio, reduciendo la diferencia con Opus 4.8 a un precio menor. Admite pensamiento adaptativo con niveles de esfuerzo de razonamiento seleccionables, una ventana de contexto de un millón de tokens y entradas de texto, imagen y archivos. Su nombre en clave es Fennec.

Contexto
1.0M
Publicado
jun 2026

Sakana Fugu

Japón

Sakana AI's multi-agent orchestration model from Tokyo, delivered as a single OpenAI-compatible API. Fugu is itself a language model trained to call a pool of specialist LLMs (and recursive instances of itself), handling model selection, delegation, verification, and synthesis behind one endpoint. Built on Sakana AI's TRINITY and Conductor research, its routing intelligence is learned in model weights rather than hand-configured.

Contexto
256K
Publicado
jun 2026

Sakana Fugu Ultra

Japón

The higher-quality tier of Sakana AI's Fugu multi-agent orchestration system, tuned for the hardest coding, reasoning, science, and agentic tasks. Coordinates a swappable pool of frontier LLMs through one OpenAI-compatible endpoint, delegating sub-tasks, verifying intermediate work, and synthesizing a single answer. Sakana reports strong vendor benchmarks including 93.2 on LiveCodeBench, 73.7 on SWE-Bench Pro, and 82.1 on TerminalBench.

Contexto
256K
Publicado
jun 2026

Claude Fable 5

Estados Unidos

El primer modelo de clase Mythos de Anthropic disponible públicamente, con capacidades superiores a las de cualquier modelo que la empresa hubiera ofrecido antes de forma general. Alcanza resultados de vanguardia en casi todos los benchmarks evaluados y destaca en ingeniería de software, trabajo del conocimiento, visión e investigación científica. Su ventaja aumenta en tareas más largas y complejas. Incluye salvaguardas que derivan consultas sensibles de ciberseguridad, biología, química y destilación a Claude Opus 4.8.

Contexto
300K
Publicado
jun 2026

Claude Mythos 5

Estados Unidos

Anthropic's frontier Mythos-class model — the same underlying model as Claude Fable 5 but with safeguards lifted in some areas. It has the strongest cybersecurity capabilities of any model in the world, alongside state-of-the-art performance in software engineering, knowledge work, vision, and scientific research. Access is restricted to a small group of trusted cyberdefenders and infrastructure providers through Project Glasswing.

Contexto
300K
Publicado
jun 2026

MiniMax M3

China

MiniMax's frontier open-weight model with 1M-token context window, native multimodality (text, image, video), and strong coding capabilities. Built on MiniMax Sparse Attention (MSA) architecture, achieving 59% on SWE-Bench Pro with significantly improved efficiency at long context.

Contexto
1.0M
Publicado
jun 2026

Claude Opus 4.8

Estados Unidos

El modelo más avanzado de Anthropic, basado en Opus 4.7 y mejorado en benchmarks de programación, capacidades de agentes, razonamiento y trabajo del conocimiento. Incorpora mayor honestidad, un uso más eficiente de herramientas, compatibilidad con flujos de trabajo dinámicos y una mejor alineación.

Contexto
300K
Publicado
may 2026

Yi-Lightning

China

01.AI's flagship large language model with enhanced Mixture-of-Experts architecture. Ranked 6th on Chatbot Arena with particularly strong results in Chinese, Math, Coding, and Hard Prompts categories. Features advanced expert segmentation and optimized KV-caching.

Contexto
131K
Publicado
may 2026

Palmyra X5

Estados Unidos

Writer's most advanced adaptive reasoning model with a 1 million token context window. Processes full million-token prompts in approximately 22 seconds with multi-turn function calls in 300ms. Optimized for enterprise agentic AI workflows at 3-4x lower cost than GPT-4.1.

Contexto
1.0M
Publicado
may 2026

Solar Pro 3

Corea del Sur

Upstage's powerful Mixture-of-Experts language model with 102B total parameters and 12B active parameters per forward pass. Optimized for Korean with strong English and Japanese support. Excels at complex reasoning, structured output generation, and agentic workflows.

Contexto
128K
Publicado
may 2026

Qwen 3.7 Plus

China

Alibaba's multimodal variant in the Qwen 3.7 family, optimized for vision understanding and multimodal tasks. Ranked

Contexto
131K
Publicado
may 2026

Qwen 3.7 Max

China

Alibaba's flagship proprietary model engineered for advanced agentic coding, complex reasoning, and long-horizon task execution. Ranked

Contexto
131K
Publicado
may 2026

Gemini 3.1 Flash-Lite

Estados Unidos

Google's most cost-efficient Gemini model optimized for high-volume, low-latency use cases. Delivers 2.5x faster time to first token versus Gemini 2.5 Flash with full multimodal support. Ideal for agentic tasks, data extraction, translation, and classification.

Contexto
1.0M
Publicado
may 2026

Gemini 3.5 Flash

Estados Unidos

Google DeepMind's balanced Gemini 3.5 model that pairs Pro-line reasoning quality with Flash-line latency and cost. Natively multimodal across text, image, audio, and video with a 1M-token context window, configurable thinking levels, and streaming function calling, tuned for high-throughput production workloads.

Contexto
1.0M
Publicado
may 2026

Gemini 3 Flash

Estados Unidos

Google's balanced model combining Gemini 3 Pro's reasoning capabilities with the Flash line's latency, efficiency, and cost. Features configurable thinking levels, multimodal function responses, and streaming function calling for complex agentic workflows.

Contexto
1.0M
Publicado
may 2026

Laguna M.1

Estados Unidos

Poolside AI's flagship agentic coding model with 225B total parameters and 23B active (MoE). Trained from scratch in-house on 30T tokens across 6,144 NVIDIA Hopper GPUs. Optimized for complex multi-step software engineering tasks including codebase exploration, file editing, test running, and iterative debugging.

Contexto
128K
Publicado
abr 2026

GPT-5.5

Estados Unidos

OpenAI's most capable model designed for complex real-world work including coding, online research, information analysis, and document creation. Features advanced agentic capabilities with tool search and multi-step task execution.

Contexto
1.0M
Publicado
abr 2026

GPT-5.4 Mini

Estados Unidos

OpenAI's compact reasoning model optimized for coding, computer use, and subagent tasks. Approaches GPT-5.4 performance on several benchmarks while running more than 2x faster.

Contexto
1.1M
Publicado
abr 2026