
Sign up to save your podcasts
Or


Ingin wawasan yang lebih cerdas di kotak masuk Anda? Mendaftar untuk buletin mingguan kami untuk hanya mendapatkan apa yang penting bagi AI, data, dan pemimpin keamanan perusahaan. Berlangganan sekarang
Setelah berhari-hari kontroversi seputar kesibukan tanggapan antisemit yang dibuat baru-baru ini oleh chatbot bertenaga AI-nya di jejaring sosialnya X (sebelumnya Twitter), sebuah Elon Musk yang tampaknya tidak bertobat dan tidak ada yang meluncurkan AI versi terbaru, “The Grook 4, selama sebuah acara di dunia.
Ketika Musk diposting di X: “Grok 4 adalah pertama kalinya, dalam pengalaman saya, bahwa AI telah dapat memecahkan pertanyaan-pertanyaan teknik dunia nyata yang sulit di mana jawaban tidak dapat ditemukan di mana pun di internet atau di buku. Dan itu akan menjadi jauh lebih baik.”
Rilis baru sebenarnya mencakup dua model berbeda: Grok 4model penalaran agen tunggal, dan Grok 4 beratsistem multi-agen yang dirancang untuk memecahkan masalah kompleks melalui kolaborasi internal dan sintesis.
Kedua model dioptimalkan untuk tugas penalaran dan dilengkapi dengan integrasi alat asli, memungkinkan kemampuan seperti pencarian web, eksekusi kode, dan analisis multimodal.
Musk dan timnya di XAI memamerkan tolok ukur yang menyarankan Grok 4 mengungguli semua pesaing saat ini di berbagai evaluasi akademik dan pengkodean, bahkan dibandingkan dengan saingan model penalaran AI terkemuka Openai O3 dan Google Gemini.
Namun, Xai belum merilis a kartu model atau apapun Dokumentasi Catatan Rilis Resmi Untuk Grok 4 kepada publik, membuatnya menantang untuk menilai kinerja secara mandiri dan klaim yang dibuat selama aliran. Kami akan memperbarui jika/saat ini tersedia.
Musk dan anggota tim XAI -nya juga tidak berpartisipasi dalam depersi langsung dari kontroversi mencolok yang dihadapi Grok selama seminggu terakhir, termasuk banyak insiden Grok yang membuat pernyataan antisemit atau menyebut dirinya sebagai “Mechahitler”, dan menyarankan bahwa orang -orang dengan nama -nama Yahudi harus ditangani dengan tegas oleh Adolf Hitler – rujukan World.
Musk terdekat datang adalah ketika dia menyatakan: “Hal yang saya pikir paling penting untuk keselamatan AI-setidaknya jaring saraf biologis saya memberi tahu saya hal yang paling penting-adalah pencarian kebenaran secara maksimal,” dan “kita perlu memastikan bahwa AI adalah anak yang baik.
Namun, Musk tidak meminta maaf juga tidak menerima tanggung jawab atas komentar antisemit, ofensif secara seksual, dan konspirasi secara seksual. Berikut adalah polisi dari aliran lengkap di bawah ini:
Sepanjang streaming langsung, tim menekankan kemampuan Grok 4 untuk bernalar dari prinsip -prinsip pertama, memperbaiki kesalahannya sendiri, dan berpotensi menciptakan teknologi baru atau mengungkap wawasan ilmiah baru.
Presentasi ini juga mencakup demonstrasi kolaborasi multi-agen Grok 4 yang menerapkan untuk mengatasi masalah tingkat penelitian di seluruh disiplin ilmu.
Grok 4 sekarang tersedia melalui beberapa saluran, tergantung pada jenis pengguna dan level berlangganan:
Untuk detail berlangganan, pengguna diarahkan ke X.Ai/grok dan X Dukungan Premium. Begini caranya dibandingkan dengan model AI terkemuka lainnya dalam hal harga per juta token.
Tidak seperti pendahulunya Grok 3, dirilis pada bulan Februari, yang memisahkan respons alat-alat dari penalaran umum, Grok 4 dilatih dengan alat sejak awal.
Model ini mengintegrasikan kemampuan seperti eksekusi kode, pencarian web, dan parsing dokumen. Itu juga memperkenalkan Grok 4 beratsistem multi-agen di mana beberapa model internal bekerja secara paralel untuk menghasilkan dan memvalidasi jawaban.
Grok 4 juga termasuk yang baru mode suara Menampilkan output ekspresif dengan latensi yang berkurang, dan mendukung input teks dan gambar, output terstruktur, dan panggilan fungsi.
Analisis model AI independen dan analisis buatan grup buatan yang dinyatakan pada X bahwa XAI memberikannya versi Grok 4 (tidak berat) lebih awal dari rilis publik untuk penilaian.
Pada tolok ukur teknis, Grok 4 memimpin Indeks Intelijen Analisis Buatan dengan skor 73, di depan pesaing seperti Openai's O3 (70) dan Google Gemini 2.5 Pro (70).
Ini juga mencatat skor tertinggi di:
Terlepas dari keberhasilan tolok ukurnya, Grok 4 kecepatan output Berdiri di 75 token per detik – lebih ringan dari model seperti Gemini 2.5 Flash (353) atau Openai's O3 (187), tetapi masih lebih cepat daripada Claude 4 Opus Anthropic (66).
Fitur model a 256.000 jendela konteks tokenyang berada di atas batas konteks 200K O3 dan Claude 4 soneta tetapi di bawah 1 juta token yang ditawarkan oleh Gemini 2.5 Pro dan GPT-4.1.
XAI memberikan beberapa demonstrasi kinerja Grok 4 dalam skenario terapan:
Model ini juga dapat membuat Game video 3D dengan input minimal dengan sumber dan mengintegrasikan aset secara mandiri. Selain itu, ini menunjukkan kemampuan untuk mensimulasikan peristiwa astrofisika menggunakan perkiraan ground dari penelitian yang diterbitkan.
Respons industri terhadap peluncuran Grok 4 telah dibagi, memadukan antusiasme untuk kinerjanya dengan kritik terhadap pengiriman acara dan masalah kepercayaan yang lebih luas.
David ShapiroPengguna dan Penulis AI Power, mencatat: “Grok 4 sekarang mengambil tempatnya sebagai 'cukup pintar untuk benar -benar membantu dengan penelitian Frontier' … tetapi hanya bertemu dengan Openai.”
Ethan Mollickseorang profesor di Wharton, berkomentar di X: “Jadi Grok 3 telah memiliki tiga insiden terpisah di mana perubahan yang tampaknya tidak diperiksa pada sistem yang dikerahkan menyebabkan masalah etika skala besar dan rollback darurat. Saya tidak berpikir Anda dapat melakukan peluncuran GROK 4 yang tidak ada yang lebih baik, jika ada lebih banyak hal yang luar biasa, jika ada yang lebih baik,” yang ada di kemudian hari, “yang ada di sana, dan tidak ada yang lebih baik, jika ada yang lebih baik, jika ada yang lebih baik,” yang ada di sana, jika ada lebih banyak hal yang baik, “yang ada di sana, jika ada lebih banyak hal yang luar biasa,” jika ada yang lebih baik, “yang ada di sana, tetapi lebih dari sekadar, jika ada yang lebih baik, jika ada yang lebih baik,” yang ada di sana, jika ada yang lebih baik, “yang ada di sana,” HANYA PERUSAHAAN YANG SANGAT Sejujurnya, “yang ada di sana,” HANYA PERUSAHAAN YANG SANGAT Sejujurnya. Model yang sangat bagus di luar sana.
Ben Hyakco-founder dan CTO dari startup pengamatan produk AI Raindrop AI (dirinya sendiri seorang mantan karyawan Musk) mengkritik streaming langsung itu sendiri: “Livestream XAI ini adalah salah satu hal terburuk yang pernah saya tonton dalam hidup saya. Cintai kalian semua, tapi itu buruk.”
Terlepas dari kritik tersebut, perusahaan pembandingan analisis buatan mencatat: “Grok 4 sekarang menjadi model AI terkemuka.”
Peluncuran Grok 4 datang di tengah kritik baru atas perilaku Grok sebelumnya dalam penyebaran konsumen, terutama sebagai chatbot yang terintegrasi ke dalam jejaring sosial Musk, X.
Selama liburan 4 Juli dan pada hari -hari berikutnya, Grok menghasilkan respons antisemit dan konspirasi yang menyalakan kembali pengawasan atas desain sistem dan praktik tata kelola.
Seperti yang dilaporkan oleh kolega ventureBeat saya Michael F. Nuñez, Grok menanggapi pertanyaan tentang pengaruh Yahudi di Hollywood dengan menyatakan bahwa para eksekutif Yahudi “mendominasi kepemimpinan” di studio -studio besar dan memengaruhi konten melalui “ideologi progresif,” dan setiap orang yang mengoceh tentang orang -orang yang menangani orang -orang Yahudi sebagai “pola” yang menyarankan “pola yang melibatkan“ pola yang melibatkan “pola yang melibatkan“ pola yang melibatkan “pola yang melibatkan“ pola yang melibatkan “pola yang melibatkan“ pola yang melibatkan “pola yang melibatkan“ pola yang melibatkan “pola yang melibatkan“ pola yang melibatkan dalam melibatkan “pola yang melibatkan dalam“ pola yang sesuai dengan “pola yang sesuai dengan“ pola yang sesuai dengan “pola yang sesuai dengan“ pola yang sesuai dengan “pola yang sesuai dengan“ pola yang sesuai dengan “pola yang sesuai dengan“ pola yang sesuai dengan ” waktu, ”referensi yang jelas untuk Holocaust.
Posting konspiratorial dan antisemit sangat produktif, Anti-Defamation League (ADL), sebuah nirlaba yang berbasis di AS yang bertarung dengan anti-Semitisme dan kebencian, yang diposting pada 8 Juli: “Apa yang kita lihat dari Grok LLM sekarang tidak bertanggung jawab, berbahaya dan antisemitik, sederhana dan sederhana ini. melonjak pada X dan banyak platform lainnya. “
Kejadian ini mengikuti sejarah output grok yang bermasalah, termasuk kasus Mei 2025 di mana bot grok diintegrasikan ke dalam x secara acak memasukkan referensi ke “genosida putih” yang benar-benar tidak masuk akal dan non-real di Afrika Selatan ke dalam pertanyaan yang tidak terkait, dan kasus-kasus yang dikeluarkan oleh sistem yang dikeluarkan untuk mengarahkan grok chatbot pada X untuk menghindari rujukan. Penyebar informasi yang salah. Dalam kedua kasus ini, Xai menyalahkan perilaku pada karyawan tanpa nama dan mengatakan mereka ditangani.
Sudah, hari ini, pengguna Grok 4 di aplikasi konsumen telah mengamatinya sekali lagi menghasilkan komentar anti-Zionis dan anti-Semit:
Seperti yang saya catat sebelumnya, Musk telah secara terbuka menyatakan pada beberapa kesempatan ia ingin mengubah Grok untuk lebih mencerminkan keyakinan pribadinya dan ketidakpercayaan di media arus utama dan sumber -sumber yang terakreditasi. Ini menjadikannya sumber yang buruk dalam konteks perusahaan di mana pandangan seperti itu dapat berdampak buruk pada pengguna dan bisnis yang membangun di atas keluarga model Grok.
Rekomendasi saya sebelumnya tetap: Bagi mereka yang berada di perusahaan yang mencoba memastikan produk AI bisnis mereka bekerja dengan baik dan akurat … Grok sayangnya sebaiknya dihindari. Untungnya, ada banyak alternatif lain untuk dipilih.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan acara yang dipercaya oleh para pemimpin perusahaan selama hampir dua dekade. VB Transform menyatukan orang -orang yang membangun strategi AI perusahaan nyata. Pelajari lebih lanjut
Startup AI yang berbasis di New York City, yang didirikan oleh mantan peneliti IBM, sebelumnya menjadi berita utama untuk sistem otomatisnya yang mengesankan yang memungkinkan perusahaan untuk mengetikkan tugas yang diminta dalam bahasa alami yang sederhana dan secara otomatis membuat armada agen untuk membantu menyelesaikannya.
Tapi itu tidak semua perusahaan memiliki lengan bajunya ketika datang ke otomatisasi dan AI: hari ini meluncurkan Craft, platform swadaya baru yang dirancang untuk mengotomatisasi pipa data perusahaan, yaitu, semua data perusahaan yang pernah diinginkan pengguna, terorganisir dan dibuat dicari di belakang layar, dan dapat diambil dalam hitungan detik dengan bantuan AI Emergence.
Menggunakan hanya bahasa Inggris yang sederhana, Craft memungkinkan pengguna bisnis – bukan hanya pengembang – untuk membangun sistem agen cerdas yang menangani tugas yang secara tradisional dikelola oleh tim insinyur.
Munculnya AI merancang platformnya agar dapat dioperasikan dengan berbagai model AI terkemuka dan kerangka kerja agen. Sistem ini terintegrasi dengan model pondasi seperti Openai GPT-4O dan GPT-4.5, Anthropic's Claude 3.7 Sonnet, dan Meta's Llama 3.3. Ini juga mendukung kerangka kerja orkestrasi termasuk langchain, kru AI, dan Microsoft Autogen, yang memungkinkan perusahaan untuk membawa model dan alat mereka sendiri ke dalam alur kerja agen Craft dengan gesekan minimal.
Craft, yang merupakan singkatan dari Create, Remember, Assemble, Fine-Tune, Trust, diposisikan sebagai solusi untuk tantangan global yang mewakili lebih dari $ 200 miliar dalam pengeluaran perusahaan tahunan. Ini menggantikan alur kerja yang rapuh, intensif pengembang dengan segerombolan agen pemerintahan sendiri yang mampu membangun, menguji, dan menjalankan alur kerja data dari prompt sederhana.
“Ini adalah momen besar,” kata Satya Nitta, co-founder dan CEO Emergence AI. “Saya sangat senang dengan penyempurnaan dari apa yang kami coba lakukan.”
Kemunculan AI didirikan oleh veteran penelitian IBM dan keluar dari diam -diam pada akhir 2024 dengan lebih dari $ 97 juta dalam dana. Perusahaan pertama kali menarik perhatian industri dengan peluncuran orkestra multi-agen lintas platformnya, yang dirancang untuk beroperasi di seluruh sistem perusahaan dari berbagai vendor. Tidak seperti penawaran dari Microsoft, Salesforce, atau Amazon, munculnya kompatibilitas lintas vendor sebagai keuntungan inti. Baca cerita lengkap di VentureBeat.
Menurut Nitta, “ruang aksi, sebagaimana saya menyebutnya, sangat sulit untuk digeneralisasi. Itulah salah satu tantangan inti yang telah kami buka.” Fungsi Orkestrator Emergence sebagai tugas meta-agen, merencanakan dan melaksanakan secara dinamis di seluruh sistem yang berbeda menggunakan campuran otomatisasi web dan integrasi API yang aman.
Pada awal 2025, kemunculan ditindaklanjuti dengan pembangun agen AI no-code real-time yang mampu menghasilkan alur kerja rekursif dan agen khusus domain dengan cepat. Nitta menggambarkan hal ini sebagai fase baru dalam Intelijen Enterprise, di mana sistem agen tidak hanya dapat menjalankan tugas tetapi juga menciptakan agen baru untuk memperluas kemampuan mereka. Baca lebih lanjut di artikel VentureBeat April 2025.
Dengan kerajinan, tugas yang pernah membutuhkan pengkodean berminggu -minggu – seperti ETL menulis, membersihkan kumpulan data, dan mengintegrasikan alat – sekarang dapat diselesaikan dalam hitungan menit.
Kemampuan sistem melampaui RPA tradisional (otomatisasi proses robot), memperkenalkan fitur-fitur seperti perbaikan diri, perencanaan dan penalaran, dan memori jangka panjang.
Kerajinan dibangun khusus untuk lingkungan data-berat di mana pengambilan keputusan yang cepat sangat penting dan data sering dibungkam atau terfragmentasi. Industri utama meliputi:
Ini sangat cocok untuk organisasi yang membutuhkan orkestrasi yang kompleks dan real-time tanpa rekayasa hambatan.
Nitta menekankan kejelasan dan intensionalitas platform: “Yang membuat ini menarik adalah betapa fokusnya itu. Ini adalah cerita yang sangat jelas – tidak ada main -main.”
Dia juga menyoroti kedalaman teknis di balik kemampuan Craft. “Orkestrasi secara keseluruhan adalah masalah AI. Kebanyakan orang tidak menyadari betapa rumitnya meminta sistem untuk melakukan tindakan apa pun di dunia fisik atau digital.”
Kerajinan sudah digunakan oleh mitra desain di seluruh sektor seperti semikonduktor, minyak dan gas, telekomunikasi, layanan kesehatan, dan layanan keuangan.
Salah satu penyebaran penting adalah dengan Ni/Emerson, di mana platform diintegrasikan dengan solusi Ni O+.
Eran Rousseau, VP dan sesama di Ni/Emerson, melaporkan bahwa Craft memungkinkan wawasan waktu-nyata yang selaras dengan alur kerja produksi yang kompleks, meningkatkan hasil dan mempercepat deteksi masalah.
“Sebelumnya, pada saat analisis manual selesai, batch produksi berikutnya sedang berlangsung, membatasi tindakan tepat waktu,” kata Rosseau dalam sebuah pernyataan yang diemail ke VentureBeat dengan repetisi kemunculan. “Dengan kerajinan, kami mendapatkan wawasan waktu nyata yang selaras dengan alur kerja uji yang kompleks, memungkinkan otomatisasi pintar untuk meningkatkan hasil dan mendeteksi masalah dengan cepat. Terintegrasi dengan solusi O+ NI, kerajinan AI menghasilkan wawasan yang diterjemahkan ke dalam tindakan segera, yang memungkinkan pelanggan untuk fokus pada pemecahan tantangan kritis daripada pada laporan yang panjang ini. Ini mewakili masa depan semikon ini.
Carrol Chang, CEO Andela, menekankan pentingnya menguasai alur kerja data-sentris, integrasi data dinamis, dan tata kelola di zaman AI.
“Kemitraan kami dengan kemunculan akan memberdayakan insinyur Andela untuk membangun keterampilan yang dibutuhkan untuk berkembang di bab berikutnya: Mengarahkan agen cerdas, merancang sistem yang tangguh, dan bekerja secara kreatif bersama AI,” tulis Chang dalam keadaan email lain dari kemunculan. “Secara kritis, ini termasuk menguasai alur kerja data-sentris, dari mengintegrasikan sumber data dinamis hingga memastikan integritas data dan tata kelola, yang merupakan dasar hingga aplikasi perusahaan modern. Ini tentang mempersiapkan bakat untuk memimpin masa depan, tidak hanya beradaptasi dengan itu.”
Hasil awal lainnya termasuk keuntungan produktivitas yang signifikan:
Mesin Craft mencakup kerangka kerja baru yang disebut Agents Create Agents (ACA). Sistem ini memungkinkan agen untuk menghasilkan, meningkatkan, dan mengoordinasikan agen lain secara real time-memungkinkan alur kerja multi-agen yang kompleks dengan input minimal.
Antarmuka platform mendukung alur kerja no-kode dan pengembang yang disesuaikan. Ini fitur registri agen untuk digunakan kembali, kemampuan memori di seluruh sesi, dan perilaku yang dapat disesuaikan melalui umpan balik atau pengeditan langsung. Fitur perusahaan termasuk fleksibilitas penyebaran (on-prem, cloud, atau VPC) dan kontrol kepatuhan bawaan seperti SOC 2, GDPR, dan Audit Logging.
Nitta menjelaskan mengapa kemunculannya di depan kurva pada sistem agen: “Semua orang sekarang berbicara tentang orkestrasi agen, tetapi kita sudah memikirkannya secara mendalam tentang hal itu.”
Kerajinan juga memiliki implikasi untuk transformasi tenaga kerja. Melalui kemitraan dengan AI kemunculan, Andela adalah insinyur pelatihan untuk bekerja dengan sistem agen.
Kerajinan saat ini tersedia dalam pratinjau pribadi sebagai bagian dari peluncuran bertahap. Platform akan ditawarkan dalam tiga tingkatan harga:
Harga Pro dan Enterprise akan berkembang dengan adopsi pengguna karena kemunculan AI berfokus pada aksesibilitas dan pembelajaran dalam peluncuran awal ini.
Menurut Nitta, Craft mewakili langkah menuju mendemokratisasi pengembangan sistem cerdas. Dengan memungkinkan non-pengembang untuk mendefinisikan dan menggunakan alur kerja agen, platform ini menata kembali bagaimana perusahaan berinteraksi dengan AI. Tujuannya adalah untuk menurunkan penghalang masuk sambil memperluas apa yang mungkin – mengubah niat bisnis ke dalam sistem yang dapat dieksekusi tanpa memerlukan keahlian teknis yang mendalam.
Munculnya AI, yang berkantor pusat di New York dengan kantor di California, Spanyol, dan India, bertujuan untuk memimpin evolusi AI perusahaan dengan membangun platform yang tidak hanya melakukan tugas – tetapi juga membuat, beradaptasi, dan skala secara mandiri.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan buletin harian dan mingguan kami untuk pembaruan terbaru dan konten eksklusif tentang liputan AI terkemuka di industri. Pelajari lebih lanjut
Lightricks, perusahaan di balik aplikasi kreatif populer seperti Facetune dan Videoleap, hari ini mengumumkan rilis model generasi video AI yang paling kuat hingga saat ini. Model LTX Video 13-miliar-parameter (LTXV-13B) menghasilkan video AI berkualitas tinggi hingga 30 kali lebih cepat daripada model yang sebanding saat menjalankan perangkat keras tingkat konsumen daripada GPU perusahaan yang mahal.
Model ini memperkenalkan “rendering multiskala,” sebuah pendekatan teknis baru yang secara dramatis meningkatkan efisiensi dengan menghasilkan video dalam lapisan detail progresif. Ini memungkinkan pembuat untuk menghasilkan video AI berkualitas profesional di komputer desktop standar dan laptop kelas atas alih-alih membutuhkan peralatan perusahaan khusus.
“Pengenalan model video LTX parameter 13B kami menandai momen penting dalam generasi video AI dengan kemampuan untuk menghasilkan video berkualitas tinggi di GPU konsumen,” kata Zeev Farbman, co-founder dan CEO Lightricks, dalam sebuah wawancara eksklusif dengan VentureBeat. “Pengguna kami sekarang dapat membuat konten dengan lebih konsistensi, kualitas yang lebih baik, dan kontrol yang lebih ketat.”
Tantangan utama untuk pembuatan video AI adalah persyaratan komputasi yang sangat besar. Model terkemuka dari perusahaan seperti Runway, Pika, dan Luma biasanya berjalan di cloud pada beberapa GPU kelas perusahaan dengan 80GB atau lebih dari VRAM (memori video), membuat penyebaran lokal tidak praktis bagi sebagian besar pengguna.
Farbman menjelaskan bagaimana LTXV-13B membahas batasan ini: “Garis pemisah utama antara GPU konsumen dan perusahaan adalah jumlah VRAM. Nvidia memposisikan perangkat keras game mereka dengan batas memori yang ketat-Generasi sebelumnya, sedangkan GPU, 32 GPU yang berkaitan pada 24 gigabytes dari VRAM, sementara yang paling tinggi 509 GPU. menawarkan lebih banyak lebih banyak. ”
Model baru ini dirancang untuk beroperasi secara efektif dalam kendala perangkat keras konsumen ini. “Model lengkap, tanpa kuantisasi, tanpa perkiraan apa pun, Anda akan dapat berjalan di GPU konsumen teratas – 3090, 4090, 5090, termasuk versi laptop mereka,” kata Farbman.
Inovasi inti di balik efisiensi LTXV-13B adalah pendekatan rendering multiskala, yang digambarkan Farbman sebagai “terobosan teknis terbesar dari rilis ini.”
“Ini memungkinkan model untuk menghasilkan detail secara bertahap,” jelasnya. “Anda mulai di kisi -kisi kasar, mendapatkan perkiraan kasar dari pemandangan, dari gerakan benda -benda yang bergerak, dll. Dan kemudian pemandangan itu dibagi menjadi ubin. Dan setiap ubin diisi dengan detail yang semakin banyak.”
Proses ini mencerminkan bagaimana seniman mendekati adegan yang kompleks – dimulai dengan sketsa kasar sebelum menambahkan detail yang semakin halus. Keuntungan untuk AI adalah bahwa “jumlah puncak VRAM Anda dibatasi oleh ukuran ubin, bukan resolusi akhir,” kata Farbman.
Model ini juga memiliki ruang laten yang lebih terkompresi, yang membutuhkan lebih sedikit memori sambil mempertahankan kualitas. “Dengan video, Anda memiliki rasio kompresi yang lebih tinggi yang memungkinkan Anda, saat Anda berada di ruang laten, untuk hanya mengambil lebih sedikit VRAM,” tambah Farbman.
Sementara banyak model AI terkemuka tetap di belakang API tertutup, Lightricks telah membuat LTXV-13B sepenuhnya open source, tersedia di Face Hugging Face dan GitHub. Keputusan ini datang selama periode ketika pengembangan AI open-source telah menghadapi tantangan dari kompetisi komersial.
“Setahun yang lalu, banyak hal ditutup, tetapi segalanya agak terbuka. Kami melihat banyak LLM dan model difusi yang keren membuka,” Farbman merefleksikan. “Saya lebih optimis sekarang daripada setengah tahun yang lalu.”
Strategi open-source juga membantu mempercepat penelitian dan peningkatan. “Rasionalitas utama untuk open-sourcing adalah untuk mengurangi biaya R&D Anda,” jelas Farbman. “Ada banyak orang di dunia akademis yang menggunakan model, menulis makalah, dan Anda mulai menjadi kurator ini yang memahami di mana emas asli berada.”
Ketika tantangan hukum meningkat terhadap perusahaan AI yang menggunakan data pelatihan yang tergores, Lightricks telah mengamankan kemitraan dengan Getty Images dan Shutterstock untuk mengakses konten berlisensi untuk pelatihan model.
“Mengumpulkan data untuk pelatihan model AI masih merupakan area abu -abu yang sah,” Farbman mengakui. “Kami memiliki pelanggan besar di segmen perusahaan kami yang peduli dengan hal -hal semacam ini, jadi kami perlu memastikan kami dapat memberikan model yang bersih untuk mereka.”
Kemitraan ini memungkinkan Lightricks untuk menawarkan model dengan risiko hukum yang berkurang untuk aplikasi komersial, berpotensi memberikan keuntungan di pasar perusahaan yang berkaitan dengan masalah hak cipta.
Dalam langkah yang tidak biasa untuk industri AI, Lightricks menawarkan LTXV-13B gratis untuk melisensikan perusahaan dengan pendapatan tahunan di bawah $ 10 juta. Pendekatan ini bertujuan untuk membangun komunitas pengembang dan perusahaan yang dapat menunjukkan nilai model sebelum monetisasi.
“Pemikirannya adalah bahwa akademisi lepas kait. Orang -orang ini dapat melakukan apa pun yang mereka inginkan dengan model,” kata Farbman. “Dengan startup dan industri, Anda ingin menciptakan situasi win-win. Saya tidak berpikir Anda dapat menghasilkan banyak uang dari komunitas seniman yang bermain dengan barang-barang AI.”
Untuk perusahaan besar yang menemukan kesuksesan dengan model ini, Lightricks berencana untuk menegosiasikan perjanjian lisensi yang mirip dengan bagaimana mesin game menagih pengembang yang sukses. “Begitu mereka mencapai sepuluh juta pendapatan, kita akan datang untuk berbicara dengan mereka tentang lisensi,” jelas Farbman.
Terlepas dari kemajuan yang diwakili oleh LTXV-13B, Farbman mengakui bahwa generasi video AI masih memiliki keterbatasan. “Jika kita jujur dengan diri kita sendiri dan melihat model teratas, kita masih jauh dari film -film Hollywood. Mereka belum ada di sana,” katanya.
Namun, ia melihat aplikasi praktis langsung di bidang-bidang seperti animasi, di mana para profesional kreatif dapat menggunakan AI untuk menangani aspek produksi yang memakan waktu. “Ketika Anda berpikir tentang biaya produksi animasi kelas atas, karya kreatif yang sebenarnya, orang-orang yang berpikir tentang kerangka kunci dan ceritanya, adalah sebagian kecil dari anggaran. Tetapi pembingkaian utama adalah sumber daya yang besar,” kata Farbman.
Ke depan, Farbman memprediksi perbatasan berikutnya adalah model video multimodal yang mengintegrasikan berbagai jenis media dalam ruang laten bersama. “Ini akan menjadi musik, audio, video, dll. Dan kemudian hal -hal seperti melakukan sinkronisasi bibir yang baik akan lebih mudah. Semua hal ini akan hilang. Anda akan memiliki model multimoda ini yang tahu cara beroperasi di semua modalitas yang berbeda ini.”
LTXV-13B sekarang tersedia sebagai rilis open-source dan sedang diintegrasikan ke dalam aplikasi kreatif Lightricks, termasuk platform bercerita andalannya, LTX Studio.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan buletin harian dan mingguan kami untuk pembaruan terbaru dan konten eksklusif tentang liputan AI terkemuka di industri. Pelajari lebih lanjut
Startup dua orang dengan nama Nari Labs telah memperkenalkan DIA, model 1,6 miliar parameter teks-ke-speech (TTS) yang dirancang untuk menghasilkan dialog naturalistik langsung dari petunjuk teks-dan salah satu penciptanya mengklaim bahwa ia melampaui kinerja penawaran kepemilikan yang bersaing dari generasi seperti ElevenLabs, Google Hit Notebooklm AI POPREOMLM AI POPREOM POPREOM.
Itu juga bisa mengancam penyerapan GPT-4O-Mini-TTS Openai baru-baru ini.
“Fitur podcast NotebookLM NotebookLM dia sambil melampaui ElevenLabs Studio dan Model Terbuka Sesame dalam kualitas,” kata Toby Kim, salah satu co-pencipta Nari dan Dia, pada sebuah pos dari akunnya di jejaring sosial X.
Dalam sebuah posting yang terpisah, Kim mencatat bahwa model itu dibangun dengan “nol dana,” dan ditambahkan di utas: “… kami bukan ahli dari awal. Semuanya dimulai ketika kami jatuh cinta dengan fitur podcast Notebooklm ketika kami mencoba setiap tahun lalu.
Kim lebih lanjut mengkredit Google karena memberinya dan akses kolaborator ke chip unit pemrosesan Tensor (TPU) perusahaan untuk melatih DIA melalui cloud penelitian Google.
Kode dan bobot Dia – set koneksi model internal – sekarang tersedia untuk diunduh dan penyebaran lokal oleh siapa pun dari memeluk wajah atau github. Pengguna individu dapat mencoba menghasilkan ucapan darinya di ruang wajah yang memeluk.
DIA mendukung fitur bernuansa seperti nada emosional, penandaan speaker, dan isyarat audio nonverbal – semua dari teks biasa.
Pengguna dapat menandai putaran speaker dengan tag seperti [S1] Dan [S2]dan termasuk isyarat seperti (tertawa), (batuk), atau (membersihkan tenggorokan) untuk memperkaya dialog yang dihasilkan dengan perilaku nonverbal.
Tag -tag ini ditafsirkan dengan benar oleh DIA selama generasi – sesuatu yang tidak andal didukung oleh model lain yang tersedia, menurut halaman contoh perusahaan.
Model ini saat ini hanya bahasa Inggris dan tidak terikat dengan suara pembicara tunggal, menghasilkan suara yang berbeda per run kecuali pengguna memperbaiki benih generasi atau memberikan prompt audio. Pengkondisian audio, atau kloning suara, memungkinkan pengguna memandu nada bicara dan persamaan suara dengan mengunggah klip sampel.
Nari Labs menawarkan kode contoh untuk memfasilitasi proses ini dan demo berbasis gradio sehingga pengguna dapat mencobanya tanpa pengaturan.
Nari menawarkan sejumlah file audio contoh yang dihasilkan oleh DIA di situs web Notion-nya, membandingkannya dengan saingan pidato-ke-teks terkemuka lainnya, khususnya ElevenLabs Studio dan Sesame CSM-1B, yang lemari sebuah model teks-ke-speech baru dari co-pencipta headset Oculus Brendan Iribe yang pergi ke suatu tahun awal tahun ini.
Contoh berdampingan yang dibagikan oleh Nari Labs menunjukkan bagaimana Dia mengungguli kompetisi di beberapa bidang:
Dalam skenario dialog standar, dia menangani waktu alami dan ekspresi nonverbal dengan lebih baik. Misalnya, dalam skrip yang diakhiri dengan (tertawa), dia menafsirkan dan memberikan tawa yang sebenarnya, sedangkan elevenlab dan penggantian tekstual output wijen seperti “haha”.
Misalnya, inilah dia…
… Dan kalimat yang sama diucapkan oleh Elevenlabs Studio
Dalam percakapan multi-giliran dengan rentang emosional, DIA menunjukkan transisi yang lebih halus dan pergeseran nada. Satu tes termasuk adegan darurat yang dramatis dan bermuatan emosional. DIA memberikan stres urgensi dan pembicara secara efektif, sementara model yang bersaing sering meratakan pengiriman atau mondar -mandir yang hilang.
Dia dengan unik menangani skrip nonverbal saja, seperti pertukaran lucu yang melibatkan batuk, mengendus, dan tertawa. Model yang bersaing gagal mengenali tag ini atau melewatkannya sepenuhnya.
Bahkan dengan konten yang rumit secara ritmis seperti lirik rap, DIA menghasilkan ucapan bergaya kinerja yang memelihara tempo. Ini kontras dengan output yang lebih monoton atau terputus -putus dari ElevenLabs dan Model 1B Sesame.
Menggunakan petunjuk audio, DIA dapat memperluas atau melanjutkan gaya suara speaker ke baris baru. Contoh menggunakan klip percakapan sebagai benih menunjukkan bagaimana Dia membawa sifat -sifat vokal dari sampel melalui sisa dialog yang ditulis. Fitur ini tidak didukung secara kuat di model lain.
Dalam satu set tes, Nari Labs mencatat bahwa demo situs web terbaik Wijen kemungkinan menggunakan versi internal 8B dari model daripada pos pemeriksaan 1B publik, menghasilkan celah antara kinerja yang diiklankan dan aktual.
Pengembang dapat mengakses DIA dari Repositori GitHub Nari Labs dan halaman Model Wajah Memeluknya.
Model ini berjalan pada Pytorch 2.0+ dan CUDA 12.6 dan membutuhkan sekitar 10GB VRAM.
Inferensi pada GPU kelas perusahaan seperti NVIDIA A4000 menghasilkan sekitar 40 token per detik.
Sementara versi saat ini hanya berjalan pada GPU, Nari berencana untuk menawarkan dukungan CPU dan rilis terkuantisasi untuk meningkatkan aksesibilitas.
Startup ini menawarkan pustaka Python dan alat CLI untuk merampingkan penyebaran lebih lanjut.
Fleksibilitas dia membuka kasus penggunaan dari pembuatan konten hingga teknologi membantu dan sulih suara sintetis.
Nari Labs juga mengembangkan versi konsumen DIA yang ditujukan untuk pengguna biasa yang ingin remix atau berbagi percakapan yang dihasilkan. Pengguna yang tertarik dapat bernyanyi melalui email ke daftar tunggu untuk akses awal.
Model ini didistribusikan di bawah lisensi Apache 2.0 Source Open Open, yang berarti dapat digunakan untuk tujuan komersial – sesuatu yang jelas akan menarik bagi perusahaan atau pengembang aplikasi indie.
Nari Labs secara eksplisit melarang penggunaan yang mencakup menyamar sebagai individu, menyebarkan informasi yang salah, atau terlibat dalam kegiatan ilegal. Tim ini mendorong eksperimen yang bertanggung jawab dan telah mengambil sikap terhadap penyebaran yang tidak etis.
Dukungan Pengembangan Pengembangan DIA dari Google TPU Research Cloud, Program Hibah ZerogPU FACE FACE, dan pekerjaan sebelumnya pada SoundStorm, PetaEt, dan Descript Audio Codec.
Nari Labs sendiri hanya terdiri dari dua insinyur-satu waktu penuh dan satu paruh waktu-tetapi mereka secara aktif mengundang kontribusi komunitas melalui server perselisihan dan github.
Dengan fokus yang jelas pada kualitas ekspresif, reproduktifitas, dan akses terbuka, Dia menambahkan suara baru yang khas pada lanskap model bicara generatif.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan buletin harian dan mingguan kami untuk pembaruan terbaru dan konten eksklusif tentang liputan AI terkemuka di industri. Pelajari lebih lanjut
Antropik meluncurkan peningkatan besar ke asisten AI Claude -nya hari ini, memperkenalkan kemampuan penelitian otonom dan integrasi ruang kerja Google yang mengubah AI menjadi apa yang disebut perusahaan disebut “kolaborator virtual sejati” untuk pengguna perusahaan. Ekspansi secara langsung menantang Openai dan Microsoft di pasar yang semakin kompetitif untuk alat produktivitas AI.
Kemampuan penelitian yang baru memungkinkan Claude untuk secara mandiri melakukan beberapa pencarian yang saling membangun sambil menentukan apa yang harus diselidiki selanjutnya. Secara bersamaan, integrasi Google Workspace menghubungkan Claude ke email, kalender, dan dokumen pengguna, menghilangkan kebutuhan untuk unggahan manual.
Posisi antropik fungsionalitas penelitian Claude lebih cepat secara dramatis daripada solusi yang bersaing, menjanjikan jawaban komprehensif dalam hitungan menit daripada “hingga 30 menit” yang mereka klaim membutuhkan produk saingan.
“Di Anthropic, kami berfokus pada pekerja perusahaan dan kasus penggunaan, dan alat penelitian kami mencerminkan hal itu,” kata juru bicara antropik kepada VentureBeat. “Penelitian adalah alat untuk membantu pekerja perusahaan mendapatkan jawaban yang diteliti dengan baik untuk pertanyaan dalam waktu kurang dari satu menit. Solusi lain di pasaran memakan waktu hingga 30 menit untuk menghasilkan tanggapan-bukan itu yang dibutuhkan oleh eksekutif penjualan rata-rata atau layanan keuangan Anda.”
Pendekatan yang berfokus pada kecepatan ini merupakan taruhan yang dihitung bahwa pengguna perusahaan memprioritaskan respons cepat untuk keputusan yang peka terhadap waktu daripada kemampuan penelitian yang lebih lengkap tetapi lebih lambat.
Untuk pembuat keputusan teknis yang mempertimbangkan alat AI, keamanan data tetap terpenting. Antropik menekankan pendekatan keamanan-pertama, terutama untuk fitur katalog Google Drive yang menggunakan teknik pengambilan augmented generasi (RAG).
“Privasi mendasar untuk pendekatan kami. Kami tidak melatih model kami pada data pengguna secara default,” kata juru bicara antropik itu. “Kami telah menerapkan otentikasi yang ketat dan mekanisme kontrol akses. Setiap koneksi pengguna atau organisasi ke layanan eksternal diautentikasi dan diizinkan dengan benar hanya untuk pengguna atau organisasi tertentu.”
Perusahaan membatasi fitur katalog Google Drive untuk pelanggan Paket Perusahaan, yang mencakup “peningkatan infrastruktur keamanan, dukungan khusus, dan kontrol administratif canggih yang dirancang untuk organisasi dengan persyaratan perlindungan data yang ketat.”
Antropik menangani salah satu tantangan AI yang paling gigih-kecenderungan untuk menghasilkan informasi yang terdengar masuk akal tetapi salah-melalui kutipan sumber eksplisit.
“Antropik didedikasikan untuk membangun alat AI perusahaan yang paling dapat dipercaya. Saat melakukan penelitian – baik di web atau dalam dokumen internal – Claude mengutip sumbernya sehingga pengguna dapat dengan mudah merujuk dari mana informasi berasal,” menurut juru bicara itu.
Mekanisme verifikasi ini membahas peningkatan permintaan perusahaan untuk AI yang bertanggung jawab, terutama dalam aplikasi bisnis-kritis di mana akurasi menentukan keberhasilan.
Meskipun masih dalam beta awal, laporan antropik yang menjanjikan hasil dari pengujian internal, dengan karyawan “menghemat waktu setiap minggu bahwa mereka biasanya menghabiskan banyak uang melalui lautan dokumen dan email.”
Perusahaan menyoroti beberapa implementasi, termasuk tim komunikasi yang menyusun informasi peluncuran dan pengarahan buku, insinyur yang mempersiapkan pertemuan klien dengan meneliti berita industri dan meninjau dokumen yang ada, dan pemimpin penjualan yang menganalisis pertumbuhan sektor tanpa pekerjaan data manual.
“Karyawan baru melewatkan 'pertanyaan sewa baru' klasik dan meminta Claude untuk merangkum momen-momen perusahaan yang akan datang, Okrs dan berbagi panduan gaya yang relevan,” kata juru bicara itu, menyarankan aplikasi potensial di luar produktivitas sehari-hari.
Pembaruan Anthropic tiba di tengah persaingan sengit. Openai's ChatGPT menawarkan penelusuran web, Copilot Microsoft terintegrasi dengan Office 365, dan Gemini Google terhubung dengan aplikasi Workspace.
Antropik membedakan Claude melalui kombinasi kecepatan, fokus perusahaan, dan apa yang digambarkan sebagai pendekatan yang lebih otonom untuk pengambilan penelitian dan informasi.
Fitur penelitian tersedia dalam beta awal untuk rencana Max, Team, dan Enterprise di Amerika Serikat, Jepang, dan Brasil. Pencarian Web telah berkembang ke Brasil dan Jepang setelah diluncurkan AS pada bulan Maret. Integrasi Google Workspace tersedia dalam beta untuk semua pengguna yang dibayar, meskipun administrator harus memungkinkannya di seluruh perusahaan sebelum penggunaan individu.
Ketika sistem AI berevolusi dari responden kueri sederhana menjadi mitra penelitian proaktif, mereka membentuk kembali bagaimana pekerjaan pengetahuan terjadi. Kemampuan baru Claude mewakili lebih dari penambahan fitur tambahan – mereka menandakan perubahan mendasar dalam hubungan antara profesional dan alat digital mereka.
Untuk perusahaan yang menavigasi transformasi digital, pertanyaannya bukanlah apakah AI akan mengubah pekerjaan pengetahuan, tetapi seberapa cepat.
Visi Anthropic tentang AI yang dapat meneliti secara mandiri, alasan melalui masalah, dan terhubung langsung dengan sistem tempat kerja menunjukkan masa depan di mana keterampilan manusia yang paling berharga mungkin bukan pengumpulan informasi tetapi mengajukan pertanyaan yang tepat.
Di perlombaan berisiko tinggi untuk membuat AI benar-benar berguna untuk pekerjaan sehari-hari, peningkatan terbaru Claude mengungkapkan bahwa garis finish bukan hanya AI yang lebih pintar-AI yang bekerja seperti yang sudah dilakukan manusia.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan buletin harian dan mingguan kami untuk pembaruan terbaru dan konten eksklusif tentang liputan AI terkemuka di industri. Pelajari lebih lanjut
“Data adalah minyak baru,” sebuah pepatah yang diciptakan oleh ilmuwan data Inggris Clive Humby pada tahun yang jauh 2006, hanya mendapatkan popularitas dalam beberapa tahun terakhir berkat booming AI generatif.
Tetapi jika itu benar, mengapa Anda tidak dapat membeli dan menjual data semudah yang Anda bisa di barel minyak mentah, karena komoditas yang begitu banyak perusahaan dan orang hamil? Sebaliknya, kami menjalani pertempuran pengadilan bertahun-tahun dan karya-karya yang dilaporkan dengan baik yang mendokumentasikan bagaimana penyedia AI (di antara perusahaan lain) telah mengikis web untuk data mereka dengan jelas mengabaikan dan potensi pelanggaran hak cipta.
Bukankah seharusnya ada “toko serba ada” bagi perusahaan untuk membeli data yang bersih dan berlisensi penuh dan menggunakannya untuk memberi daya pada model dan aplikasi bisnis mereka-semacam iTunes untuk data atau Amazon untuk data?
Itulah pemikiran di balik Carbon Arc, startup baru yang muncul dari Stealth hari ini dengan $ 55 juta dalam dana benih yang dipimpin oleh Liberty City Ventures. K5 Global, Raptor Group, Wasserman Media Groupai Data Utility dan Real-Time Insights Exchange juga berpartisipasi dalam putaran pendanaan.
Ini dirancang untuk membantu bisnis mengkonsumsi, memperdagangkan dan mengintegrasikan kecerdasan terstruktur tanpa inefisiensi akuisisi data tradisional.
Perusahaan ini didirikan pada Maret 2021 dengan ide sederhana namun ambisius: “Untuk semua data yang ada di dunia, sangat sedikit yang membuatnya menjadi pembuat keputusan,” kata Kirk McKeown, co-founder dan CEO Carbon Arc, dalam sebuah wawancara dengan VentureBeat yang dilakukan di sebuah kafe di New York City minggu lalu.
Arc Carbon menangani masalah itu dengan mengubah kumpulan data yang tidak terstruktur menjadi wawasan siap-AI. Melalui kerangka kerja ontologi berpemiliknya, platform ini menstandarkan data pribadi. Itu membuatnya tersedia sesuai permintaan – menawarkan alternatif untuk kontrak data curah yang sering membuat perusahaan membayar untuk informasi yang tidak sepenuhnya mereka gunakan.
Sementara data ada di mana -mana, sebagian besar masih terperangkap dalam neraca perusahaan, silo perusahaan, dan sistem warisan.
Cara McKeown menggambarkannya: “Data pribadi terkunci di setiap neraca di dunia. Ekonomi menghasilkan knalpot besar-data performa, klaim perawatan kesehatan, klaim perdagangan, kartu kredit-tetapi itu tidak mengalir ke pembuat keputusan.”
Pada saat yang sama, perusahaan yang digerakkan AI menghadapi kumpulan data publik yang dapat digunakan. Dengan model bahasa besar (LLM) dengan cepat menipiskan kumpulan data publik, bisnis harus mencari kecerdasan kepemilikan yang dibedakan untuk tetap kompetitif.
“Lebih banyak data berarti pertanyaan yang lebih baik,” kata McKeown. “Para pemain besar akan membutuhkan aset data yang lebih banyak dan lebih berbeda saat mereka datang ke pasar.”
Solusi Carbon Arc adalah memperlakukan data seperti aset keuangan, menciptakan pasar terstruktur untuk data cara ekuitas, obligasi, dan perdagangan derivatif saat ini. Pergeseran ini memperkenalkan penemuan harga, penemuan permintaan, dan akses real-time-membawa likuiditas ke ekonomi data yang tidak likuid secara historis.
“Zaman intelijen seharusnya tidak berbeda dari revolusi masa lalu – setiap pergeseran teknologi utama dalam sejarah telah membutuhkan transformasi dalam bahan baku yang mendasarinya untuk listrik,” tambah McKeown.
Carbon Arc telah membangun pasar dua sisi di mana pemilik data menyumbangkan kumpulan data mereka, dan bisnis membayar per-megabyte untuk wawasan yang mereka gunakan.
Meskipun harga berbasis konsumsi memberikan fleksibilitas, itu juga sulit untuk dikelola. “Harga berbasis konsumsi adalah perdagangan yang hebat, tetapi membuat orang takut karena sulit dikelola,” McKeown mengakui. Untuk mengatasi hal ini, Arc Carbon memperkenalkan struktur dompet yang memberi pelanggan kontrol yang lebih baik atas pengeluaran mereka.
Platform ini sudah dimanfaatkan di berbagai industri:
Platform Carbon Arc dirancang untuk kemudahan penggunaan, dengan visualisasi data interaktif, konektivitas API dan streaming intelijen waktu nyata.
Fitur Antarmuka Kunci:
Untuk pengecer, platform ini menyediakan perbandingan pangsa pasar, tren penjualan, dan perilaku konsumen di seluruh pesaing seperti Lululemon, American Eagle dan Abercrombie & Fitch.
Dalam analitik perusahaan, pengguna dapat melacak tren pengeluaran di seluruh pengecer besar seperti Walmart, Kroger dan Target-memungkinkan merchandising dan strategi penetapan harga yang didorong oleh data.
Pengembang perangkat lunak dan ilmuwan data sering menghadapi tantangan yang signifikan ketika berhadapan dengan data yang tidak terstruktur. Karbon Arc menyederhanakan proses ini dengan secara otomatis menyusun data mentah, memberikan wawasan waktu nyata melalui API, dan menghilangkan kebutuhan untuk preprocessing yang luas.
Alih -alih berkomitmen untuk kontrak data curah, bisnis hanya dapat mengkonsumsi wawasan yang mereka butuhkan, mengurangi overhead operasional dan kendala anggaran.
“Prediksi AI hanya akan menjadi lebih baik dari waktu ke waktu, tetapi mereka akan selalu membutuhkan data historis sebagai fondasi,” jelas McKeown, menyatakan bahwa karbon busur memiliki data yang akan kembali berabad -abad namun terus menerus menambahkan pembaruan baru secara mingguan atau harian, tergantung pada segmen spesifik.
Selain itu, perusahaan memastikan datanya didukung di beberapa lokasi.
“Kami gila tentang redundansi,” kata McKeown kepada saya. “Saya tidak pernah ingin dimanfaatkan oleh penyedia data tunggal – kami memiliki banyak sumber untuk melindungi dari kenaikan harga atau gangguan pasokan.”
McKeown melihat platform Carbon Arc sebagai bagian dari perubahan yang lebih besar dalam bagaimana data dinilai dan dipertukarkan.
“Kami sedang membangun pasar untuk data seperti ekuitas, obligasi, dan perdagangan derivatif hari ini – membawa penemuan harga dan menuntut penemuan ke dalam pertukaran terstruktur.”
Pergeseran mendasar dalam ekonomi data ini dapat membentuk kembali AI, keuangan, dan kecerdasan bisnis, membuat wawasan waktu nyata lebih mudah diakses dan hemat biaya.
Dengan pendanaan $ 55 juta, Carbon Arc diposisikan dengan baik untuk mendefinisikan kembali bagaimana perusahaan mengakses, perdagangan, dan mengintegrasikan intelijen. Dengan mengubah data menjadi aset yang lancar dan dapat diperdagangkan, perusahaan menangani salah satu tantangan terbesar dalam AI dan pengambilan keputusan bisnis saat ini-memastikan bahwa data tidak lagi dikunci tetapi secara aktif mendorong wawasan dan inovasi.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan buletin harian dan mingguan kami untuk pembaruan terbaru dan konten eksklusif tentang liputan AI terkemuka di industri. Pelajari lebih lanjut
Beberapa tahun yang lalu, tidak ada yang namanya “model video AI generatif.”
Saat ini, ada lusinan, termasuk banyak yang mampu memberikan video ultra-definisi-tinggi, video kaliber Hollywood yang ultra-realistis dalam hitungan detik dari petunjuk teks atau gambar yang diunggah pengguna dan klip video yang ada. Jika Anda telah membaca VentureBeat dalam beberapa bulan terakhir, Anda pasti menemukan artikel tentang model-model ini dan perusahaan-perusahaan di belakangnya, dari Gen-3 Runway hingga Google VEO 2 hingga Openai yang sudah lama tertunda tetapi akhirnya tersedia Sora hingga Luma Ai, Pika, dan Kling dan Hailuo Chinese Upstarts dan Hailuo. Bahkan Alibaba dan startup yang disebut Genmo telah menawarkan model video open-source.
Sudah, model ini telah digunakan untuk membuat bagian dari blockbuster utama, dari Semuanya, di mana -mana sekaligus ke HBO's True Detective: Night Country ke video musik dan iklan TV dari Toys R 'US dan Coca Cola. Namun terlepas dari pelukan AI Hollywood dan pembuat film yang relatif cepat, masih ada satu masalah besar yang menjulang: kekhawatiran hak cipta.
Seperti yang paling kami ketahui, mengingat bahwa sebagian besar startup model video AI tidak secara terbuka membagikan rincian data pelatihan mereka secara terbuka, sebagian besar dilatih pada petak video yang luas yang diunggah ke web atau dikumpulkan dari sumber arsip lain, termasuk mereka yang memiliki hak cipta yang mungkin atau mungkin tidak benar -benar memberikan izin tersurat kepada perusahaan video AI untuk melatih mereka. Faktanya, landasan pacu adalah salah satu perusahaan yang menghadapi gugatan class action (masih bekerja melalui pengadilan) atas masalah ini, dan Nvidia dilaporkan mengikis petak besar video YouTube juga untuk tujuan ini. Perselisihan sedang berlangsung, apakah pengikisan data termasuk video merupakan penggunaan yang adil dan transformasional.
Tapi sekarang ada alternatif baru bagi mereka yang peduli tentang hak cipta dan tidak ingin menggunakan model di mana ada tanda tanya. Startup yang disebut Moonvalley – yang didirikan oleh mantan Google Deepminders dan peneliti dari Meta, Microsoft dan Tiktok, antara lain – telah memperkenalkan Marey, model video AI generatif yang dirancang untuk studio Hollywood, pembuat film, dan merek perusahaan. Diposisikan sebagai model video AI yang “bersih” canggih, Marey dilatih secara eksklusif berdasarkan data yang dimiliki dan berlisensi, menawarkan alternatif etis untuk model AI yang dikembangkan menggunakan konten yang dikikis.
“Orang-orang mengatakan itu tidak layak secara teknis untuk membangun model video AI mutakhir tanpa menggunakan data yang dikikis,” kata CEO Moonvalley dan pendiri Naeem Talukdar dalam wawancara panggilan video baru-baru ini dengan VentureBeat. “Kami membuktikan sebaliknya.”
Marey, tersedia sekarang berdasarkan daftar tunggu hanya undangan, bergabung dengan model video Firefly Adobe, yang menurut vendor perangkat lunak yang sudah lama ada juga merupakan kelas perusahaan-yang hanya dilatih pada data berlisensi dan data stok adobe (untuk kekhawatiran beberapa kontributor)-dan memberikan ganti rugi perusahaan untuk digunakan. Moonvalley juga memberikan ganti rugi tentang Klausul 7 dari dokumen ini, dengan mengatakan akan membela pelanggannya dengan biaya sendiri.
Moonvalley berharap fitur-fitur ini akan membuat Marey menarik bagi studio besar-bahkan ketika yang lain seperti landasan pacu membuat kesepakatan dengan mereka-dan pembuat film, di antara berbagai pilihan pembuatan video AI baru.
Marey adalah hasil dari kolaborasi antara Moonvalley dan Asteria, sebuah film AI yang dipimpin artis dan studio animasi. Model ini dibangun untuk membantu daripada menggantikan profesional kreatif, memberi para pembuat film alat baru untuk produksi video yang digerakkan AI sambil mempertahankan standar industri tradisional.
“Keyakinan kami adalah bahwa Anda tidak akan mendapatkan adopsi arus utama di industri ini kecuali Anda melakukan ini dengan industri,” kata Talukdar. “Industri ini keras dan jelas bahwa agar mereka benar -benar menggunakan model -model ini, kita perlu mencari cara untuk membangun model yang bersih. Dan sampai hari ini, trek teratas adalah Anda tidak bisa melakukannya. “
Alih -alih mengikis internet untuk konten, Moonvalley membangun hubungan langsung dengan pencipta untuk melisensikan rekaman mereka. Perusahaan membutuhkan waktu beberapa bulan untuk menetapkan kemitraan ini, memastikan semua data yang digunakan untuk pelatihan diperoleh secara hukum dan berlisensi penuh.
Strategi perizinan Moonvalley juga dirancang untuk mendukung pencipta konten dengan mengkompensasi mereka atas kontribusi mereka.
“Sebagian besar hubungan kami sebenarnya masuk sekarang karena orang -orang sudah mulai mendengar tentang apa yang kami lakukan,” kata Talukdar. “Untuk pencipta kota kecil, banyak rekaman mereka hanya duduk-duduk. Kami ingin membantu mereka memonetisasi itu, dan kami ingin melakukan model yang berfokus pada artis. Itu akhirnya menjadi hubungan yang sangat baik. “
Talukdar mengatakan kepada VentureBeat bahwa sementara perusahaan masih menilai dan merevisi model kompensasinya, umumnya mengkompensasi pencipta berdasarkan durasi rekaman mereka, membayar mereka dengan tarif per jam atau teliti berdasarkan perjanjian lisensi jangka tetap (mis., 12 atau empat bulan). Ini memungkinkan pembayaran berulang potensial jika konten terus digunakan.
Tujuan perusahaan adalah untuk membuat produksi video kelas atas lebih mudah diakses dan hemat biaya, memungkinkan pembuat film, studio, dan pengiklan untuk mengeksplorasi bercerita yang dihasilkan AI tanpa masalah hukum atau etis.
Talukdar menjelaskan bahwa Moonvalley mengambil pendekatan yang berbeda dengan model video AI marey dari model video AI yang ada dengan berfokus pada produksi tingkat profesional daripada aplikasi konsumen.
“Sebagian besar perusahaan video generatif saat ini lebih berfokus pada konsumen,” katanya. “Mereka membangun model sederhana di mana Anda meminta chatbot, menghasilkan beberapa klip dan menambahkan efek keren. Fokus kami berbeda: apa teknologi yang dibutuhkan untuk studio Hollywood? Apa yang dibutuhkan merek -merek besar untuk membuat iklan Super Bowl? ”
Marey memperkenalkan beberapa kemajuan dalam video yang dihasilkan AI, termasuk:
“Model itu sendiri hanya dibangun dengan sangat berat di sekitar kemampuan kontrol,” jelas Talukdar. “Anda perlu memiliki lebih banyak kontrol secara signifikan di sekitar output – mampu mengubah karakter. Ini adalah model pertama yang memungkinkan Anda melakukan pengeditan berbasis lapisan, sehingga Anda dapat mengedit latar depan, tengah tanah, dan latar belakang secara terpisah. Ini juga model pertama yang dibangun untuk Hollywood, dibangun khusus untuk diproduksi. ”
Selain itu, ia mengatakan kepada VentureBeat bahwa Marey bergantung pada model hibrida difusi-transformer yang menggabungkan difusi dan arsitektur berbasis transformator.
“Model adalah model transformer difusi, jadi itu adalah arsitektur transformator, dan kemudian Anda memiliki difusi sebagai bagian dari lapisan,” kata Talukdar. “Ketika Anda memperkenalkan kemampuan kontrol, biasanya melalui lapisan -lapisan itu Anda melakukannya.”
Moonvalley juga minggu ini mengumumkan putaran benih $ 70 juta yang dipimpin oleh Bessemer Venture Partners, Khosla Ventures dan General Catalyst. Investor Hemant Taneja, Samir Kaul dan Byron Deeter juga bergabung dengan dewan direksi perusahaan.
Talukdar mencatat bahwa pendanaan Moonvalley secara substansial kurang dari beberapa pesaingnya, sejauh ini – landasan pacu dilaporkan telah mengumpulkan total $ 270 juta di beberapa putaran – tetapi perusahaan telah mengoptimalkan sumber dayanya dengan mengumpulkan tim elit peneliti dan insinyur AI.
“Kami mengumpulkan sekitar $ 70 juta, sedikit lebih sedikit dari pesaing kami, tentu saja,” katanya. “Tapi itu benar -benar bermuara pada tim – memiliki tim yang dapat membangun arsitektur itu secara signifikan lebih efisien, menghitung, dan semua hal yang berbeda itu.”
Marey saat ini dalam fase akses terbatas, dengan studio terpilih dan pembuat film menguji model. Moonvalley berencana untuk secara bertahap memperluas akses selama beberapa minggu mendatang.
“Saat ini, ada sejumlah studio yang mendapatkan akses ke sana, dan kami memiliki grup alfa dengan beberapa lusin pembuat film menggunakannya,” talukdar mengkonfirmasi. “Harapannya adalah bahwa itu akan sepenuhnya tersedia dalam beberapa minggu, kasus terburuk dalam beberapa bulan.”
Dengan peluncuran Marey, Moonvalley dan Asteria bertujuan untuk memposisikan diri mereka di garis depan pembuatan film yang dibantu AI, menawarkan studio dan merek solusi yang mengintegrasikan AI tanpa mengurangi integritas kreatif. Tetapi dengan saingan startup video AI seperti landasan pacu, pika dan hedra terus menambahkan fitur baru seperti suara dan gerakan karakter, lapangan menjadi lebih kompetitif.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan buletin harian dan mingguan kami untuk pembaruan terbaru dan konten eksklusif tentang liputan AI terkemuka di industri. Pelajari lebih lanjut
Elevenlabs, kloning suara AI yang bernilai tinggi dan startup generasi dari mantan alumni Palantir, hari ini meluncurkan Scribe V1, model pidato-ke-teks baru yang dilaporkan mencapai akurasi tertinggi di berbagai bahasa. Pengguna dapat mencobanya di sini.
Menurut tolok ukur perusahaan, itu mengungguli Google Gemini 2.0 Flash, Whisper V3 Openai dan Deepgram Nova-3 dalam mengubah pidato lisan secara akurat menjadi teks di web, mencapai tingkat kesalahan rendah rekor-rendah baru.
Perusahaan mengklaim bahwa Scribe memberikan akurasi transkripsi canggih dalam 99 bahasa, termasuk peningkatan kinerja dalam bahasa yang sebelumnya kurang terlayani seperti Serbia, Kanton dan Malayalam.
Seperti yang ditulis Flavio Schneider, Peneliti LEAD ElevenLabs menulis di X, Scribe adalah “model pemahaman audio terpintar” yang dirilis oleh ElevenLabs.
“Scribe tidak hanya menyalin – itu memahami audio,” lanjut Schneider di utas. “Ini dapat mendeteksi peristiwa non-verbal (seperti tawa, efek suara, musik dan kebisingan latar belakang) dan menganalisis konteks audio yang panjang untuk diarization yang akurat, bahkan di lingkungan yang paling menantang.”
“Diarization” adalah nama yang diberikan untuk proses memisahkan pembicara dengan kualitas vokal mereka pada rekaman.
Faktanya, dokumentasi ElevenLabs menyatakan bahwa Scribe dapat membedakan dan mengisolasi hingga 32 speaker berbeda dalam file audio yang sama.
Sementara ElevenLab memperingatkan bahwa Scribe “paling baik digunakan ketika transkripsi akurasi tinggi diperlukan daripada transkripsi real-time,” perusahaan juga berencana untuk memperkenalkan versi latensi rendah segera, memperluas penggunaannya untuk aplikasi real-time.
Scribe dirancang untuk menangani tantangan audio dunia nyata dengan presisi. Menurut hasil benchmark dari Fleurs dan Common Voice, ia mencatat tingkat kesalahan kata terendah (WER) untuk banyak bahasa, termasuk Italia (98,7%) dan bahasa Inggris (96,7%).
Fitur utama meliputi:
Scribe tersedia sekarang melalui situs web ElevenLabs dan API.
Harga ditetapkan pada $ 0,40 per jam audio input, dengan diskon 50% untuk enam minggu ke depan. Versi latensi rendah untuk aplikasi real-time juga sedang dalam pengembangan.
Untuk pembuat keputusan perusahaan, Scribe menyajikan alat untuk transkripsi yang dapat diskalakan dan akurasi tinggi, menjadikannya berguna untuk industri yang mengandalkan dokumentasi otomatis, memenuhi transkripsi dan aksesibilitas konten.
Kemampuan model untuk menangani beragam bahasa dengan presisi tinggi juga menguntungkan bisnis multinasional, perusahaan media, dan aplikasi dukungan pelanggan.
Struktur harga Scribe membuatnya kompetitif untuk bisnis yang membutuhkan layanan transkripsi volume tinggi, dan integrasi berbasis API memungkinkan adopsi yang mulus dalam alur kerja perusahaan.
Selain itu, versi latensi rendah yang akan datang dapat memposisikan Scribe sebagai opsi yang layak untuk alat komunikasi real-time.
Pengaturan waktu adalah segalanya, dan ElevenLab memilih untuk meluncurkan Scribe pada hari yang sama dengan saingannya Hume AI meluncurkan Octave, model teks-ke-speech bertenaga LLM yang memungkinkan pengguna untuk menyesuaikan suara yang dihasilkan AI dengan emosi yang dapat disesuaikan.
Ini dirancang untuk pembuatan konten, termasuk buku audio, podcast, dan sulih suara video game. Tidak seperti sistem TTS standar, Octave mempertimbangkan konteks di luar kalimat individu, menyesuaikan nada, ritme dan irama secara dinamis terdengar lebih alami.
Hume AI memposisikan Octave sebagai pesaing langsung untuk penawaran teks-ke-ucapan ElevenLabs, menyoroti bahwa harga Octave adalah sekitar setengah dari biaya layanan suara AI sebelas ElevenLab saat ini.
Sementara Scribe dan Octave melayani fungsi yang berbeda, perkembangan mereka mencerminkan persaingan yang berkembang dalam model audio yang digerakkan oleh AI.
Elevenlabs memprioritaskan pengenalan suara multi-bahasa yang tepat, sementara Hume AI memajukan pidato yang dihasilkan AI yang ekspresif.
Untuk perusahaan, ini berarti solusi yang lebih khusus untuk aplikasi transkripsi dan suara sintetis, memungkinkan produksi konten yang lebih efisien, keterlibatan pelanggan, dan alat aksesibilitas.
Scribe sekarang langsung, dan ElevenLabs menjadi tuan rumah acara virtual minggu depan dengan tim di belakang pengembangannya. Rincian lebih lanjut, tolok ukur dan dokumentasi API tersedia di posting blog resmi.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan buletin harian dan mingguan kami untuk pembaruan terbaru dan konten eksklusif tentang liputan AI terkemuka di industri. Pelajari lebih lanjut
Tiga puluh delapan tahun setelah pembuatannya, Photoshop Adobe tetap menjadi salah satu produk perangkat lunak yang paling sukses dan banyak digunakan hingga hari ini-dengan dilaporkan lebih dari 90% pro kreatif dunia menggunakan alat pengeditan dan desain gambar.
Sekarang perusahaan telah memperkenalkan Photoshop di iPhone secara gratis hari ini-pertama kalinya Photoshop mendapatkan aplikasi seluler khusus di luar elemen-elemen yang dilucuti versi yang diluncurkan kembali pada akhir 2022.
Aplikasi ini tersedia di seluruh dunia mulai hari ini, dengan versi Android yang diharapkan akhir tahun ini. Bersamaan dengan peluncuran seluler, Adobe menawarkan ponsel dan paket web Photoshop baru yang memungkinkan pengeditan tanpa batas di seluruh perangkat.
Opsi penetapan harga termasuk versi gratis dari aplikasi-dengan alat pengeditan lengkap di perangkat tetapi tidak ada dukungan lintas platform-dan peningkatan premium yang tersedia seharga $ 7,99 per bulan atau $ 69,99 per tahun. Pelanggan Photoshop atau Adobe Creative Cloud saat ini dapat mengakses versi seluler tanpa biaya tambahan sebagai bagian dari rencana yang ada.
Aplikasi seluler mencakup alat photoshop penting seperti layering, masking, ketuk pilih, dan sikat penyembuhan spot.
Pengguna juga dapat mengakses fitur AI generatif bertenaga kunang-kunang seperti pengisian generatif dan generatif. Dirancang khusus untuk perangkat seluler, aplikasi ini memungkinkan profesional berpengalaman dan pendatang baru untuk membuat visual berkualitas tinggi langsung dari ponsel mereka.
Ashley Still, wakil presiden senior media digital di Adobe, mengatakan perusahaan itu bersemangat untuk membawa Photoshop ke ponsel, membuat kemampuan desainnya lebih mudah diakses dan intuitif. Dia menekankan bahwa aplikasi memberdayakan pembuat untuk menghasilkan konten yang menakjubkan secara visual dari mana saja.
• Alat photoshop inti: Layering, Masking dan Blending Tools yang disesuaikan untuk alur kerja seluler
• Alat AI Generatif: Isi generatif bertenaga kunang-kunang dan Generatif Perluas untuk dengan cepat menambahkan dan mengedit elemen gambar
• Ketuk Pilih Alat: Seleksi berbasis sentuh intuitif untuk menghapus, mengulang atau mengganti bagian gambar
• Sikat penyembuhan spot: Penghapusan cepat elemen dan gangguan yang tidak diinginkan dari foto
• Objek Pilih: Pemilihan orang dan objek yang tepat dengan akurasi yang ditingkatkan
• Integrasi Langsung: Alur kerja mulus dengan Adobe Express, Adobe Fresco dan Adobe Lightroom
• Akses ke Adobe Stock: Perpustakaan aset gratis untuk membuat visual yang unik
• Editing Lanjutan dalam Rencana Premium: Magic Wand, Clone Stamp, Content-Aware Fill dan Lanjutan Mode Blend
• Alat tipografi: Lebih dari 20.000 font dengan opsi untuk mengimpor font khusus
• Alur kerja lintas-perangkat: Mulai proyek di ponsel dan lanjutkan pengeditan dengan lebih presisi di web atau desktop
Aplikasi ini dibuat khusus untuk ponsel, dengan penyesuaian antarmuka pengguna yang membuat alat lebih mudah digunakan dengan kontrol sentuh.
Alat seleksi dan target sentuh telah dioptimalkan untuk memastikan akurasi, bahkan pada layar yang lebih kecil. Tap Select memungkinkan pengguna untuk mengisolasi objek dengan satu keran, sementara target sentuh yang lebih besar membantu mencegah pilihan yang tidak disengaja.
Object Select dapat mengidentifikasi subjek seperti manusia, hewan dan objek, merampingkan proses pengeditan. Berdasarkan presentasi demo yang diterima kemarin selama panggilan video dengan Adobe, antarmuka aplikasi dirancang untuk menjadi intuitif, dengan alat -alat penting yang dapat diakses dalam jangkauan ibu jari dan tata letak bersih yang meminimalkan kekacauan visual.
Materi pers Adobe mencakup beberapa contoh yang menyoroti fungsionalitas aplikasi:
• Foto anjing diedit menggunakan pengisian generatif untuk menghapus elemen yang tidak diinginkan seperti tali dan smartphone dari latar belakang, dengan mulus memadukan area yang diisi dengan lingkungan sekitarnya.
• Dalam contoh lain, alat lepas digunakan untuk menghilangkan gangguan seperti tangan dan bayangan dari foto dua orang, menciptakan komposisi yang lebih bersih.
• Object Select ditunjukkan dengan mengisolasi raket tenis dari latar belakangnya dengan beberapa ketukan, menampilkan ketepatan dan kecepatan alat.
• Selain itu, kemampuan komposit ditunjukkan melalui GIF yang menggabungkan elemen -elemen semarak seperti bunga kebesaran menjadi foto dua orang, menggambarkan potensi kreatif aplikasi.
Paket seluler dan web Photoshop memungkinkan pengguna untuk transisi antar perangkat tanpa kehilangan kemajuan.
Namun, mengedit file Photoshop di browser web memerlukan langganan cloud kreatif, bahkan jika file tersebut awalnya dibuat di aplikasi iOS.
Ini memastikan bahwa fitur pengeditan canggih dan alur kerja berbasis cloud dapat diakses oleh pelanggan di seluruh platform.
Untuk tim perusahaan, perluasan photoshop ke platform seluler dan web menawarkan fleksibilitas dan efisiensi yang lebih besar dalam alur kerja kreatif.
Desainer dan pemasar sekarang dapat melakukan pengeditan cepat, membuat visual dan berkolaborasi pada proyek -proyek dari mana saja, mengurangi ketergantungan pada lingkungan desktop.
Model AI Firefly Adobe, yang memberi daya pada banyak fitur seluler baru, memberikan keunggulan kompetitif atas saingan seperti Midjourney, Dall · E dan Krea AI dengan menawarkan alat AI generatif yang aman secara komersial.
Firefly dilatih pada konten stok Adobe berlisensi dan materi domain publik, memastikan bahwa konten yang dihasilkan AI dapat digunakan secara komersial tanpa masalah hak cipta.
Ini membuat Photoshop menjadi opsi yang menarik untuk bisnis yang perlu membuat visual tingkat profesional sambil mempertahankan kepatuhan. Selain itu, integrasi tanpa batas dengan Adobe Creative Cloud dan Alat Adobe lainnya merampingkan alur kerja, memungkinkan tim untuk mempertahankan konsistensi dan produktivitas di seluruh perangkat.
Versi Android dari Photoshop diharapkan diluncurkan akhir tahun ini, semakin memperluas ekosistem alat kreatif Adobe di seluruh platform seluler, web, dan desktop.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
Bergabunglah dengan buletin harian dan mingguan kami untuk pembaruan terbaru dan konten eksklusif tentang liputan AI terkemuka di industri. Pelajari lebih lanjut
Adobe memperluas kemampuan AI generatifnya dengan merilis model pembuatan video baru, menandai langkah signifikan dalam dorongan perusahaan untuk memberikan alat AI profesional yang dapat mereka gunakan dengan aman dalam proyek komersial.
Perusahaan ini mengumumkan hari ini bahwa model video Firefly-nya memasuki beta publik, menawarkan alat pembuatan video bertenaga AI yang diklaim Adobe dilatih hanya pada konten berlisensi-pembeda utama di pasar generasi video AI yang semakin ramai.
“Kami adalah solusi yang paling berguna karena kami adalah model yang ramah IP, aman secara komersial. Anda dapat menggunakan model kami. Tidak ada risiko pelanggaran IP, ”kata Alexandru Costin, yang memimpin inisiatif AI Adobe, dalam sebuah wawancara dengan VentureBeat. “Lebih dari orang lain, kami bersemangat memecahkan videografer, kebutuhan videografer profesional.”
Peluncuran ini datang ketika Adobe melaporkan keluarga model AI Firefly telah menghasilkan lebih dari 18 miliar aset secara global sejak rilis awal pada Maret 2023. Adopsi yang cepat ini menunjukkan permintaan yang kuat untuk alat AI yang dapat digunakan oleh para profesional kreatif dalam pekerjaan komersial.
Kemampuan video baru akan tersedia melalui aplikasi web Firefly yang didesain ulang Adobe dan diintegrasikan ke dalam Premiere Pro, perangkat lunak pengeditan video profesional Adobe. Sistem ini dapat menghasilkan klip video 1080p dari prompt atau gambar teks, dengan fitur seperti kontrol sudut kamera dan generasi efek atmosfer.
“Hanya datang dari laboratorium penelitian, mereka mendemonstrasikan saya pagi ini beberapa kemampuan generasi luar biasa yang datang, meningkatkan resolusi, melakukan overlay video transparan … melakukan video waktu nyata,” ungkap Costin, menunjukkan peta jalan Adobe untuk teknologi.
Adobe memperkenalkan paket harga berjenjang mulai dari $ 9,99 setiap bulan untuk paket standar, yang mencakup 2.000 kredit video/audio-cukup untuk sekitar 20 generasi video 1080p lima detik. Paket Pro seharga $ 29,99 menawarkan 7.000 kredit.
Integrasi dengan alat kreatif Adobe yang ada tampaknya menjadi keuntungan strategis utama. Kylee Pena, manajer pemasaran produk senior di Adobe, menunjukkan bagaimana editor dapat menggunakan teknologi untuk mengisi celah dalam jadwal video atau menghasilkan efek atmosfer seperti salju, kemudian dengan mulus menyesuaikan hasil menggunakan alat profesional Premiere Pro.
“Karena saya di Premiere Pro, saya juga memiliki banyak alat tingkat pro tambahan, termasuk alat AI yang kami miliki untuk sementara waktu, seperti kecocokan warna,” Pena menjelaskan selama demonstrasi.
Peluncuran ini terjadi ketika kompetisi meningkat di ruang generasi video AI, dengan entri terbaru seperti Sora Openai yang menghasilkan perhatian yang signifikan. Adobe bertaruh bahwa fokusnya pada keselamatan komersial dan integrasi alur kerja profesional akan membantunya menonjol di pasar yang semakin ramai.
Untuk memastikan transparansi, Adobe akan menyertakan kredensial konten, jenis sertifikasi digital, dengan semua konten video yang dihasilkan AI. Ini selaras dengan kepemimpinan perusahaan dalam Inisiatif Keaslian Konten, yang bertujuan untuk menyediakan alat verifikasi untuk konten digital.
Merek global termasuk Dentsu, Gatorade, dan Stagwell sudah menguji teknologi dalam beta, menunjukkan adopsi perusahaan potensial. Adobe berencana untuk memperkenalkan rencana premium yang dirancang untuk pengguna profesional volume tinggi dalam waktu dekat.
Pengembangan ini menandakan fokus strategis Adobe pada mempertahankan posisinya sebagai penyedia alat kreatif untuk para profesional sambil beradaptasi dengan revolusi AI membentuk kembali industri kreatif. Dengan 85% proyek di Sundance Film Festival baru-baru ini menggunakan Adobe Creative Cloud, perusahaan ini muncul dengan baik untuk menjembatani kesenjangan antara alur kerja kreatif tradisional dan kemampuan AI yang muncul.
Wawasan harian tentang kasus penggunaan bisnis dengan VB setiap hari
Jika Anda ingin mengesankan bos Anda, VB Daily telah Anda liput. Kami memberi Anda sendok dalam tentang apa yang dilakukan perusahaan dengan AI generatif, dari pergeseran peraturan hingga penyebaran praktis, sehingga Anda dapat berbagi wawasan untuk ROI maksimum.
Baca Kebijakan Privasi Kami
Terima kasih telah berlangganan. Lihat lebih banyak buletin VB di sini.
Kesalahan terjadi.
From the publisher's feed