Update - We are actively investigating elevated error rate on LiveKit Inference (google/gemma-4-31b-it)
Aug 06, 2026 - 12:51 PDT
Identified - Between approximately 18:45 and 19:15 UTC today, a subset of LiveKit Inference requests using the google/gemma-4-31b-it model returned errors. Affected agent sessions would have seen an LLM request error on those requests. Other models and other LiveKit services were not affected.

No action is needed on your part. If you continue to see errors, please reach out to support. We apologize for the disruption.

Aug 06, 2026 - 12:47 PDT
Global Real Time Communication Operational
90 days ago
100.0 % uptime
Today
Cloud Dashboard (cloud.livekit.io) Operational
90 days ago
99.98 % uptime
Today
Global Egress Operational
90 days ago
100.0 % uptime
Today
Global Ingress Operational
90 days ago
100.0 % uptime
Today
Global SIP Operational
90 days ago
100.0 % uptime
Today
Global Cloud Agents Operational
90 days ago
100.0 % uptime
Today
Global Inference Degraded Performance
90 days ago
100.0 % uptime
Today
Regional Real Time Communication Operational
90 days ago
99.99 % uptime
Today
Japan - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
Brazil - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
India - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
US West - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
Australia - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
Singapore - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
US Central - Real Time Communication Operational
90 days ago
99.99 % uptime
Today
South Africa - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
UAE - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
Israel - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
Saudi Arabia - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
Europe South - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
United Kingdom - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
US East - Real Time Communication Operational
90 days ago
99.86 % uptime
Today
Europe Central - Real Time Communication Operational
90 days ago
100.0 % uptime
Today
Regional TURN Operational
90 days ago
100.0 % uptime
Today
Brazil - TURN Operational
90 days ago
100.0 % uptime
Today
Japan - TURN Operational
90 days ago
100.0 % uptime
Today
US West - TURN Operational
90 days ago
100.0 % uptime
Today
India - TURN Operational
90 days ago
100.0 % uptime
Today
Australia - TURN Operational
90 days ago
100.0 % uptime
Today
Singapore - TURN Operational
90 days ago
100.0 % uptime
Today
US Central - TURN Operational
90 days ago
100.0 % uptime
Today
South Africa - TURN Operational
90 days ago
100.0 % uptime
Today
UAE - TURN Operational
90 days ago
100.0 % uptime
Today
Israel - TURN Operational
90 days ago
100.0 % uptime
Today
Saudi Arabia - TURN Operational
90 days ago
100.0 % uptime
Today
US East - TURN Operational
90 days ago
100.0 % uptime
Today
Europe Central - TURN Operational
90 days ago
100.0 % uptime
Today
United Kingdom - TURN Operational
90 days ago
100.0 % uptime
Today
Europe South - TURN Operational
90 days ago
100.0 % uptime
Today
Regional Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
US West - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Brazil - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
India - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Japan - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Australia - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Singapore - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
US Central - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
South Africa - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
UAE - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Israel - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Saudi Arabia - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
United Kingdom - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
US East - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Europe South - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Europe Central - Analytics Ingestion Operational
90 days ago
100.0 % uptime
Today
Regional Phone Numbers Operational
90 days ago
100.0 % uptime
Today
US Phone Numbers Operational
90 days ago
100.0 % uptime
Today
Regional SIP Operational
90 days ago
100.0 % uptime
Today
US West - SIP Operational
90 days ago
100.0 % uptime
Today
US East - SIP Operational
90 days ago
100.0 % uptime
Today
India - SIP Operational
90 days ago
100.0 % uptime
Today
Brazil - SIP Operational
90 days ago
100.0 % uptime
Today
Australia - SIP Operational
90 days ago
100.0 % uptime
Today
Japan - SIP Operational
90 days ago
100.0 % uptime
Today
US Central - SIP Operational
90 days ago
100.0 % uptime
Today
Israel - SIP Operational
90 days ago
100.0 % uptime
Today
Saudi Arabia - SIP Operational
90 days ago
100.0 % uptime
Today
UAE - SIP Operational
90 days ago
100.0 % uptime
Today
South Africa - SIP Operational
90 days ago
100.0 % uptime
Today
Singapore - SIP Operational
90 days ago
100.0 % uptime
Today
Europe Central - SIP Operational
90 days ago
100.0 % uptime
Today
Europe South - SIP Operational
90 days ago
100.0 % uptime
Today
United Kingdom - SIP Operational
90 days ago
100.0 % uptime
Today
Regional Ingress Operational
90 days ago
100.0 % uptime
Today
US East - Ingress Operational
90 days ago
100.0 % uptime
Today
US West - Ingress Operational
90 days ago
100.0 % uptime
Today
Japan - Ingress Operational
90 days ago
100.0 % uptime
Today
Singapore - Ingress Operational
90 days ago
100.0 % uptime
Today
Australia - Ingress Operational
90 days ago
100.0 % uptime
Today
South Africa - Ingress Operational
90 days ago
100.0 % uptime
Today
Saudi Arabia - Ingress Operational
90 days ago
100.0 % uptime
Today
India - Ingress Operational
90 days ago
100.0 % uptime
Today
Brazil - Ingress Operational
90 days ago
100.0 % uptime
Today
Israel - Ingress Operational
90 days ago
100.0 % uptime
Today
UAE - Ingress Operational
90 days ago
100.0 % uptime
Today
Europe South - Ingress Operational
90 days ago
100.0 % uptime
Today
United Kingdom - Ingress Operational
90 days ago
100.0 % uptime
Today
US Central - Ingress Operational
90 days ago
100.0 % uptime
Today
Europe Central - Ingress Operational
90 days ago
100.0 % uptime
Today
Regional Egress Operational
90 days ago
100.0 % uptime
Today
Japan - Egress Operational
90 days ago
100.0 % uptime
Today
US West - Egress Operational
90 days ago
100.0 % uptime
Today
US East - Egress Operational
90 days ago
100.0 % uptime
Today
Singapore - Egress Operational
90 days ago
100.0 % uptime
Today
India - Egress Operational
90 days ago
100.0 % uptime
Today
UAE - Egress Operational
90 days ago
100.0 % uptime
Today
Brazil - Egress Operational
90 days ago
100.0 % uptime
Today
South Africa - Egress Operational
90 days ago
100.0 % uptime
Today
US Central - Egress Operational
90 days ago
100.0 % uptime
Today
Saudi Arabia - Egress Operational
90 days ago
100.0 % uptime
Today
Israel - Egress Operational
90 days ago
100.0 % uptime
Today
Australia - Egress Operational
90 days ago
100.0 % uptime
Today
United Kingdom - Egress Operational
90 days ago
100.0 % uptime
Today
Europe Central - Egress Operational
90 days ago
100.0 % uptime
Today
Europe South - Egress Operational
90 days ago
100.0 % uptime
Today
Regional Cloud Agents Operational
90 days ago
100.0 % uptime
Today
US East - Cloud Agents Operational
90 days ago
100.0 % uptime
Today
Europe Central - Cloud Agents Operational
90 days ago
100.0 % uptime
Today
India - Cloud Agents Operational
90 days ago
100.0 % uptime
Today
Regional Inference Operational
90 days ago
100.0 % uptime
Today
US East - Inference Operational
90 days ago
100.0 % uptime
Today
Australia - Inference Operational
90 days ago
100.0 % uptime
Today
Europe South - Inference Operational
90 days ago
100.0 % uptime
Today
Brazil - Inference Operational
90 days ago
100.0 % uptime
Today
South Africa - Inference Operational
90 days ago
100.0 % uptime
Today
Singapore - Inference Operational
90 days ago
100.0 % uptime
Today
US West - Inference Operational
90 days ago
100.0 % uptime
Today
Saudi Arabia - Inference Operational
90 days ago
100.0 % uptime
Today
Israel - Inference Operational
90 days ago
100.0 % uptime
Today
United Kingdom - Inference Operational
90 days ago
100.0 % uptime
Today
Europe Central - Inference Operational
90 days ago
100.0 % uptime
Today
US Central - Inference Operational
90 days ago
100.0 % uptime
Today
Japan - Inference Operational
90 days ago
100.0 % uptime
Today
UAE - Inference Operational
90 days ago
100.0 % uptime
Today
India - Inference Operational
90 days ago
100.0 % uptime
Today
Operational
Degraded Performance
Partial Outage
Major Outage
Maintenance
Major outage
Partial outage
No downtime recorded on this day.
No data exists for this day.
had a major outage.
had a partial outage.

Aug 6, 2026

Unresolved incident: Elevated error rate on LiveKit Inference (google/gemma-4-31b-it).

Aug 5, 2026

No incidents reported.

Aug 4, 2026

Resolved - This incident has been resolved.
Aug 4, 15:11 PDT
Monitoring - We are monitoring elevated timeouts that affected LiveKit Inference between 14:05 and approximately 15:00 UTC today. During that window, roughly 3% of LLM requests using the google/gemma-4-31b-it model timed out. Impacted customers would have seen LLM request timeouts in their agent sessions (for example, APITimeoutError in agent logs). Other models were not affected.

We have identified the cause. During a period of increased traffic, response times for this model slowed, and a defect in our health-monitoring logic incorrectly marked a backup deployment as unhealthy and removed it from rotation, preventing requests from failing over as designed. Error rates returned to baseline by approximately 15:00 UTC, and a fix for the health-monitoring defect is in progress. We are continuing to monitor before marking this resolved.

No action is needed on your part. If you continue to see timeouts, please reach out to support. We apologize for the disruption.

Aug 4, 13:45 PDT

Aug 3, 2026

Resolved - We have fixed the data pipeline delay and all sessions should be loading now in the Cloud Dashboard.
Aug 3, 12:48 PDT
Update - We have traced the underlying issue to a backlog in our data pipeline, and we are continuing to investigate the root cause while working to clear the backlog. This data ingest delay results in the Sessions view returning no results for any time range ending at the current time, including all Quick Ranges options in the dashboard. As a temporary workaround, select "Custom range" and set the end time at least 30 minutes in the past to load your sessions. Real-time connectivity is not affected and no data has been lost.
Aug 3, 09:51 PDT
Investigating - We are currently investigating an issue where the sessions view does not populate in the Cloud Dashboard. This issue is specific to the dashboard display; all LiveKit services are operating normally and no sessions or sessions data are affected.
Aug 3, 08:30 PDT

Aug 2, 2026

No incidents reported.

Aug 1, 2026

No incidents reported.

Jul 31, 2026

No incidents reported.

Jul 30, 2026

Postmortem - Read details
Jul 30, 15:57 PDT
Resolved - Between 2026-07-16 and 2026-07-29, a caching bug caused webhooks to be intermittently not delivered for about one hour for projects whose configuration was updated during this period.
Jul 30, 15:55 PDT
Resolved - An internal one-off analysis job ran some expensive DB queries which slowed down load times of the dashboard's sessions page. The job was removed and load times are now back to baseline.
Jul 30, 15:25 PDT
Investigating - We are currently investigating longer than usual dashboard loading times. No services appear to be impacted and we don't expect any data to be lost.
Jul 30, 11:53 PDT

Jul 29, 2026

No incidents reported.

Jul 28, 2026

Resolved - Between approximately 10:30 and 11:55 UTC on July 28, customers with telephony workloads in our London region experienced elevated error rates on SIP APIs. Small number of call transfers were affected.

We mitigated by removing the affected infrastructure from service at 11:48 UTC, and error rates returned to normal by 11:55 UTC.

Jul 28, 07:23 PDT

Jul 27, 2026

Resolved - On July 27, our San Jose region experienced a minor networking incident beginning at 16:14 UTC. Some users connected to this region may have experienced disconnects and increased session start times. Traffic was routed away from this region by 16:39 UTC and errors have since returned to baseline.
Jul 27, 10:00 PDT

Jul 26, 2026

No incidents reported.

Jul 25, 2026

No incidents reported.

Jul 24, 2026

No incidents reported.

Jul 23, 2026

Resolved - On July 23, between 07:50 and 08:07 UTC, media servers in our London region experienced a host-level network fault, causing them to fail health checks and restart. Users connected to these servers may have experienced brief connection interruptions, and egress operations may have seen increased latency. The affected servers were removed and replaced. The region has been operating normally since.
Jul 23, 01:00 PDT