# LLM index

Lambda's catalog of model cards for the LLMs that matter. Search by model name to get architecture breakdowns, hardware requirements, deployment guides, and throughput benchmarks on NVIDIA GPUs.

## Models

- [**moonshotai/Kimi-K2.6**](https://lambda.ai/inference-models/moonshotai/kimi-k2.6)  
- [**deepseek-ai/DeepSeek-V4-Pro**](https://lambda.ai/inference-models/deepseek-ai/deepseek-v4-pro)  
- [**deepseek-ai/DeepSeek-V4-Flash**](https://lambda.ai/inference-models/deepseek-ai/deepseek-v4-flash)  
- [**zai-org/GLM-5.1**](https://lambda.ai/inference-models/zai-org/glm-5.1)  
- [**nvidia/NVIDIA-Nemotron-3-Super-120B-A12B**](https://lambda.ai/inference-models/nvidia/nvidia-nemotron-3-super-120b-a12b)  
- [**allenai/Olmo-Hybrid-Instruct-DPO-7B**](https://lambda.ai/inference-models/allenai/olmo-hybrid-instruct-dpo-7b)  
- [**Qwen/Qwen3.5-122B-A10B**](https://lambda.ai/inference-models/qwen/qwen3.5-122b-a10b)  
- [**Qwen/Qwen3-Coder-Next**](https://lambda.ai/inference-models/qwen/qwen3-coder-next)  
- [**Nanbeige/Nanbeige4.1-3B**](https://lambda.ai/inference-models/nanbeige/nanbeige4.1-3b)  
- [**Qwen/Qwen3.5-397B-A17B**](https://lambda.ai/inference-models/qwen/qwen3.5-397b-a17b)
