ChatGPT sekarang dapat melihat, mendengar, dan berbicara

OpenAI memperkenalkan kemampuan suara dan gambar baru di ChatGPT, yang memungkinkan pengguna untuk melakukan percakapan suara dan menampilkan gambar ke AI. Fitur-fitur ini menawarkan cara yang lebih intuitif untuk berinteraksi dengan ChatGPT dalam berbagai skenario, seperti mendiskusikan landmark, merencanakan makanan, atau membantu mengerjakan soal matematika. Percakapan suara dapat dimulai dengan memilih fitur tersebut di pengaturan aplikasi seluler dan memilih suara yang disukai dari lima pilihan. Kemampuan suara didukung oleh model text-to-speech dan pengisi suara profesional. Pengguna juga dapat menampilkan gambar ChatGPT dan menggunakan alat gambar untuk fokus pada bagian tertentu. Pemahaman gambar diaktifkan oleh model GPT multimodal. OpenAI menerapkan kemampuan ini secara bertahap untuk memastikan keamanan dan menyempurnakan mitigasi risiko. Teknologi suara memiliki potensi aplikasi kreatif dan aksesibilitas tetapi juga memiliki risiko, sehingga digunakan secara khusus untuk obrolan suara. Model berbasis visi dirancang untuk membantu pengguna dalam kehidupan sehari-hari dan telah diinformasikan melalui kolaborasi dengan organisasi seperti Be My Eyes. OpenAI transparan tentang keterbatasan model dan menyarankan agar tidak digunakan untuk kasus-kasus tertentu. Pengguna Plus dan Enterprise akan memiliki akses ke kemampuan suara dan gambar terlebih dahulu, dengan rencana untuk memperluas akses ke kelompok pengguna lain di masa mendatang.

Artikel lengkap

Tinggalkan Balasan