Setelah dua minggu peluncuran model audio AI GPT-Live yang lebih alami dan memiliki kemampuan dupleks penuh (mendengarkan dan berbicara secara bersamaan), OpenAI kini mengintegrasikannya langsung ke dalam alur kerja pengembang.
Perusahaan ini mengumumkan bahwa GPT-Live kini menjadi tenaga penggerak aplikasi ChatGPT di desktop untuk sistem operasi macOS dan Windows, terintegrasi langsung dengan sistem agentic seperti Codex dan ChatGPT Work yang menawarkan pengalaman terpisah dalam aplikasi desktop tersebut.
Pada tanggal 8 Juli 2026, OpenAI meluncurkan GPT-Live yang memperkenalkan model audio kontinu yang mampu mendengarkan dan berbicara secara bersamaan. Model ini menghilangkan pengaturan giliran yang kaku dan mendelegasikan pemrosesan yang lebih kompleks kepada model latar belakang seperti GPT-5.5.
Peluncuran terbaru ini memperluas lapisan percakapan ke dalam tugas-tugas teknis, memungkinkan para insinyur perangkat lunak untuk mengelola pekerjaan pemrograman multi-thread, meninjau permintaan tarik, dan memecahkan masalah aplikasi menggunakan perintah suara alami.
Ini bisa jadi tanda awal era baru pengembangan perangkat lunak “tanpa tangan”, dan bahkan pesta coding kelompok secara langsung bagi lebih dari 10 juta pengguna aktif mingguan yang menggunakan Codex dan ChatGPT Work. Codex sendiri adalah nama untuk model OpenAI yang difokuskan pada pengkodean, namun tahun ini telah berkembang menjadi platform produktivitas yang lebih umum. Seorang juru bicara OpenAI mengatakan kepada VentureBeat bahwa ini adalah pertama kalinya aktivasi suara diimplementasikan.
OpenAI juga merilis video promosi yang menunjukkan beberapa karyawan mereka, seperti Jason Liu, insinyur pengalaman pengembang Codex, dan Guinness Chen, staf teknis Codex, berbicara dalam sesi yang sama di aplikasi desktop ChatGPT di ruangan yang sama, masing-masing memberikan instruksi yang berbeda sembari berdiskusi dengan model yang sama.
Kemampuan Baru yang Terbuka
Pada intinya, integrasi ini bergantung pada pemisahan lapisan suara waktu nyata dari mesin eksekusi yang mendasarinya.
Meski GPT-Live menjaga percakapan yang lancar, yaitu dengan menambahkan pengakuan verbal alami seperti “siap” tanpa mengganggu pengguna, namun proses komputasi yang berat diserahkan kepada model pemrosesan latar belakang.
Di macOS, aplikasi desktop ini menghadirkan fitur “Appshots” dan konteks layar, memungkinkan ChatGPT Voice untuk menganalisis jendela terdepan bersamaan dengan file lokal, struktur basis kode, dan plugin aktif.
Arsitektur ini menciptakan dinamika pemrograman pasangan di mana pengembang berdiskusi masalah secara percakapan, sementara agen menjalankan tugas secara asinkron.
Alih-alih menghentikan sesi pemrograman untuk mengetik instruksi yang detail atau berganti jendela, pengembang bisa memandu sistem dengan tangan bebas.
Mesin dupleks penuh ini secara dinamis memutuskan kapan harus berbicara, berhenti, atau memanggil alat lain, menjaga keadaan percakapan meski agen latar belakang memproses modifikasi kode yang kompleks.
Memimpin Koding dan Build Kompleks Hanya Dengan Suara
Kemampuan operasional utama dalam pembaruan ini berfokus pada eksekusi multi-tugas di seluruh lingkungan Codex dan ChatGPT Work.
Para insinyur perangkat lunak bisa memulai beberapa alur tugas bersamaan hanya dengan satu perintah suara. Misalnya, seorang pengembang yang bersiap untuk merilis fitur dapat memberi instruksi kepada sistem untuk menyelidiki bug otentikasi yang terbuka, meninjau permintaan tarik migrasi API yang tertunda, dan membuat unit test yang hilang secara bersamaan.
Aplikasi desktop ini mengoordinasikan tindakan-tindakan tersebut di berbagai konteks, melacak masalah melalui percakapan Slack, repositori GitHub, dan basis kode lokal.
Pengembang juga bisa mengubah mockup desain menjadi kode yang berfungsi hanya dengan suara, membagi tugas di antara frontend, backend, dan lapisan pengujian.
Dengan dukungan untuk proyek multi-folder (build 26.715) serta eksekusi jarak jauh lewat iOS, insinyur bisa memeriksa kemajuan tugas, menjawab pertanyaan agen, dan mengarahkan pekerjaan aktif tanpa harus berganti aplikasi atau mengelola proses satu per satu.
Lisensi Proprietary
Rilisan desktop yang mendukung suara dari OpenAI beroperasi di bawah model enterprise komersial yang proprietary. Akses hanya tersedia untuk pelanggan berbayar di rencana Plus, Pro, Business, Enterprise, dan Education.
Bagi pengembang individu dan departemen teknik perusahaan, struktur komersial ini berarti bahwa bobot model, jalur pemrosesan suara, dan arsitektur keadaan agen sepenuhnya tertutup.
Organisasi tidak dapat memodifikasi atau meng-host sendiri sistem yang mendasari. Selain itu, tugas yang dimulai melalui ChatGPT Voice akan menggunakan alokasi penggunaan standar dari kuota rencana Codex dan ChatGPT Work yang ada, memperlakukan tindakan yang diaktifkan suara secara identik dengan beban kerja agentic standar.
Reaksi Komunitas
Komunitas pengembang segera mencatat implikasi dari membawa suara dupleks kontinu ke dalam alur kerja pengkodean otonom.
Merespons pengumuman rilis build 26.715 yang mendetailkan integrasi suara dan dukungan proyek multi-folder, jurnalis AI Insider @ChrisGPT mencatat di X: “Hari ini OpenAI akan merilis suara dan panduan jarak jauh untuk Codex! Satu langkah lebih dekat menuju AGI personal”.
Umpan balik teknis awal menyoroti antusiasme yang meluas untuk mengatur tugas agentic kompleks tanpa tangan, terutama saat menjauh dari workstation atau mengelola pipeline build secara jarak jauh.

