# Serving Endpoint

## Endpoints

### Get

- [GET /api/2.0/serving-endpoints/{name}](get-inference-endpoint.md)

### Create

- [POST /api/2.0/serving-endpoints](create-inference-endpoint.md)

### Update

- [PUT /api/2.0/serving-endpoints/{name}/config](put-inference-endpoint-config.md)

### Delete

- [DELETE /api/2.0/serving-endpoints/{name}](delete-inference-endpoint.md)

### Create Provisioned Throughput Inference Endpoint

- [POST /api/2.0/serving-endpoints/pt](create-provisioned-throughput-inference-endpoint.md)

### Get Export Endpoint Metrics

- [GET /api/2.0/serving-endpoints/{name}/metrics](get-export-endpoint-metrics.md)

### Get Inference Endpoint Schema

- [GET /api/2.0/serving-endpoints/{name}/openapi](get-inference-endpoint-schema.md)

### Get Served Model Build Logs

- [GET /api/2.0/serving-endpoints/{name}/served-models/{served_model_name}/build-logs](get-served-model-build-logs.md)

### Get Served Model Logs

- [GET /api/2.0/serving-endpoints/{name}/served-models/{served_model_name}/logs](get-served-model-logs.md)

### Patch Inference Endpoint Telemetry Config

- [PATCH /api/2.0/serving-endpoints/{name}/telemetry-config](patch-inference-endpoint-telemetry-config.md)

### Put Inference Endpoint Rate Limits

- [PUT /api/2.0/serving-endpoints/{name}/rate-limits](put-inference-endpoint-rate-limits.md)

### Put Provisioned Throughput Inference Endpoint Config

- [PUT /api/2.0/serving-endpoints/pt/{name}/config](put-provisioned-throughput-inference-endpoint-config.md)

### Update Inference Endpoint Notifications

- [PATCH /api/2.0/serving-endpoints/{name}/notifications](update-inference-endpoint-notifications.md)

### Put Inference Endpoint Ai Gateway

- [PUT /api/2.0/serving-endpoints/{name}/ai-gateway](put-inference-endpoint-ai-gateway.md)

### Patch Inference Endpoint Tags

- [PATCH /api/2.0/serving-endpoints/{name}/tags](patch-inference-endpoint-tags.md)

