У той час як технологічні компанії, що займаються розробкою ІІ, знаходяться в пошуку джерел даних для навчання своїх ІІ-моделей, у Meta✴, як виявилося, є велика перевага перед ними, оскільки вона може використовувати для цього контент Instagram✴ і Facebook✴. Про це повідомив директор із продукту Meta✴ Кріс Кокс (Chris Cox) на саміті Bloomberg Tech Summit, що відбувся цього тижня.
ИИ контент из I*****m и F****k />
Джерело изображения: geralt/Pixabay
Кріс Кокс уточнив, що Meta✴ використовує для навчання свого генератора зображень за текстовими запитами на базі ІІ загальнодоступні фотографії та текст із Instagram✴ та Facebook✴. “Ми не тренуємося на особистих даних, ми не тренуємося на даних, якими люди діляться зі своїми друзями, ми тренуємося на публічних даних”, – сказав він.
Кріс Кокс зазначив, що Meta✴ AI дозволяє створювати зображення «дійсно приголомшливої якості», оскільки в Instagram✴ багато фотографій «мистецтва, моди, культури, а також просто зображень людей і нас». Щоб створити зображення за допомогою Meta✴ AI, користувачеві достатньо набрати запит, який починається зі слова «намалювати», і, як зазначено на сайті сайту Meta✴.ai, він згенерує чотири зображення.
Для отримання даних, що використовуються для навчання ІІ, компанії поєднують зусилля з іншими фірмами. Наприклад, OpenAI домовилася про співпрацю з кількома ЗМІ, щоб ліцензувати їхній контент для розробки своїх ІІ-моделей. У свою чергу Meta✴ розглядала можливість придбання видавництва Simon & Schuster, щоб отримати більше даних для навчання власних ІІ-моделей, повідомила минулого місяця газета The New York Times.
Крім наборів необроблених даних, компанії використовують так звані «петлі зворотного зв’язку», що є процесом використання результатів роботи системи ІІ та відповідних дій кінцевого користувача для перенавчання та поліпшення моделей.
Гендиректор Meta✴ Марк Цукерберг (Mark Zuckerberg) раніше заявив, що цикли зворотного зв’язку будуть «ціннішими», ніж будь-який «попередній контент».
- Business Insider
