Operasional

Tiga layanan AI tumbang bersamaan — dan apa yang perlu disiapkan

Pelanggan tidak tahu penyedia model Anda sedang gangguan. Yang ia tahu hanya satu: pesannya tidak dibalas.

3 menit baca GetCore

Kamis malam waktu Indonesia, 3 September 2026, tiga layanan AI besar berhenti bekerja hampir bersamaan. Urutannya kira-kira begini:

Downdetector mencatat lebih dari 37.000 laporan untuk ChatGPT, sekitar 1.300 untuk Claude, dan sekitar 1.365 untuk Grok. Gemini sempat ramai dilaporkan pengguna, tapi Google tidak pernah mengumumkan gangguan resmi — perbedaan yang penting saat membaca berita semacam ini.

Penyebabnya belum menjadi satu cerita

Tiap perusahaan menyebut sebab yang berbeda. OpenAI menyebut kesalahan routing. Anthropic menyebut masalah infrastruktur. xAI menyebut gangguan di pusat komputasi Memphis dan menyinggung "mitra komputasi yang terdampak".

Sejumlah media menunjuk insiden jaringan di wilayah Azure East US sebagai penyebab bersama. Perlu dicatat: tidak ada perusahaan yang mengonfirmasi kaitan itu, halaman status Azure, AWS, dan Google Cloud tidak menunjukkan gangguan yang relevan, dan Cloudflare menyatakan tidak mengalami masalah berarti. Waktu kejadian yang berdekatan bukan bukti penyebab yang sama.

Yang bisa dipastikan justru hal yang lebih mendasar: layanan-layanan ini berbagi lapisan infrastruktur yang sama, dan sebagian besar bisnis menaruh seluruh alur AI-nya pada satu penyedia. Kalau lapisan itu goyah, semuanya goyah bersamaan.

Yang terjadi pada bot Anda saat model mati

Kalau bot WhatsApp Anda memanggil satu API model dan API itu diam, yang terjadi biasanya bukan pesan error yang rapi:

Bot yang diam lebih merusak daripada tidak punya bot sama sekali. Pelanggan tidak tahu penyedia model Anda sedang gangguan; yang ia tahu hanya pesannya tidak dibalas.

Rancangan yang membuat tiga jam itu nyaris tidak terasa

  1. Batas waktu yang tegas dan pesan yang jujur. Setelah beberapa detik tanpa jawaban, kirim pengakuan: pesan sudah diterima dan akan ditindaklanjuti tim. Diam adalah pilihan terburuk.
  2. Antrian, bukan buang. Pesan masuk disimpan lebih dulu, pemrosesan menyusul. Gangguan menjadi keterlambatan, bukan kehilangan.
  3. Penyedia cadangan yang sudah pernah diuji. Model kedua dari vendor lain, atau jalur cloud berbeda seperti Amazon Bedrock, dengan prompt yang sudah dicoba jauh sebelum dibutuhkan — bukan disiapkan saat panik.
  4. Serah terima otomatis ke manusia begitu tingkat galat melewati ambang, lengkap dengan konteks percakapan.
  5. Jalur kritis yang tidak bergantung pada model. Pencatatan pesanan, pembuatan QRIS, dan notifikasi status sebaiknya tetap jalan meski model mati — ini kode biasa, bukan pekerjaan AI.
  6. Pemantauan yang memberi tahu lebih dulu. Alarm pada tingkat galat dan waktu balas, plus halaman status penyedia yang benar-benar dipantau seseorang.

Semua ini bukan pekerjaan besar. Yang membuatnya jarang ada bukan biayanya, melainkan karena tidak pernah terasa mendesak sampai malam seperti kemarin.

Ketersediaan adalah bagian dari rancangan, bukan urusan penyedia semata — termasuk saat Anda menimbang pindah ke model yang lebih baru. Kalau bot Anda saat ini tidak punya jalur cadangan, itu biasanya perbaikan berhari, bukan berbulan.

FAQ

Pertanyaan yang sering muncul

Apa yang terjadi pada gangguan AI 3 September 2026?

Pada Kamis malam waktu Indonesia, 3 September 2026, ChatGPT, Claude, dan Grok mengalami gangguan hampir bersamaan. xAI mulai menyelidiki sekitar 20.30 WIB, OpenAI melaporkan kesalahan routing sekitar 21.43 WIB dengan mitigasi sekitar 22.17 WIB, dan Anthropic menutup insidennya sekitar 23.16 WIB setelah gangguan sebagian yang berlangsung sekitar tiga jam enam menit.

Apa penyebab gangguan serentak tersebut?

Belum ada penyebab bersama yang dikonfirmasi. OpenAI menyebut kesalahan routing, Anthropic menyebut masalah infrastruktur, dan xAI menyebut gangguan di pusat komputasi Memphis. Sejumlah media menunjuk insiden jaringan Azure East US, tetapi tidak ada perusahaan yang mengonfirmasi kaitan itu, halaman status Azure, AWS, dan Google Cloud tidak menunjukkan gangguan yang relevan, dan Cloudflare menyatakan tidak mengalami masalah berarti.

Apakah Gemini ikut down?

Gemini sempat ramai dilaporkan pengguna, tetapi Google tidak pernah mengumumkan gangguan resmi. Perbedaan antara lonjakan laporan pengguna dan pengumuman resmi penyedia penting saat menilai kabar gangguan.

Bagaimana agar bot tetap berguna saat penyedia model down?

Simpan pesan masuk di antrian agar gangguan menjadi keterlambatan dan bukan kehilangan, kirim pengakuan otomatis setelah beberapa detik tanpa jawaban, dan alihkan percakapan ke tim manusia lengkap dengan konteks begitu tingkat galat melewati ambang. Jalur kritis seperti pencatatan pesanan, pembuatan QRIS, dan notifikasi status sebaiknya ditulis sebagai kode biasa sehingga tetap berjalan meski model mati.

Langkah Pertama

Mulai dari satu proses yang paling merepotkan tim Anda

Ceritakan alur yang masih banyak dikerjakan manual. Kami akan membantu memetakan bagian yang bisa dipercepat atau diotomasi, lalu menyusun langkah pertama yang masuk akal.