top of page
Поиск

Как приложение для перевода к-поп контентов стало поставщиком данных для крупных технологических компаний

  • 4 часа назад
  • 4 мин. чтения

Корреспондент Мун Чжун Хён



Flitto теперь является частью процесса обучения для некоторых из крупнейших в мире моделей искусственного интеллекта


В июле 2013 года рэпер Psy посоветовал своим поклонникам по всему миру зайти на flitto.com, чтобы читать его твиты на своих языках, что принесло начинающему сеульскому сервису перевода первый всплеск международных пользователей (X)



В июле 2013 года, когда количество просмотров клипа «Gangnam Style» на YouTube превысило миллиард и продолжало расти, Psy направил своих поклонников по всему миру к небольшому стартапу из Сеула: «Используйте flitto.com, чтобы читать мои твиты на вашем языке».



В то время Flitto (веб-сайт: https://about.flitto.com/main) представлял собой небольшое сеульское приложение для перевода, построенное на том, что к-поп фанаты переводили посты знаменитостей в обмен на бонусные баллы. К-поп подарил молодому сервису готовое глобальное сообщество.



Спустя тринадцать лет приложение превратилось в компанию в сфере искусственного интеллекта, котирующуюся на бирже Kosdaq, крупнейшими клиентами которой являются американские технологические гиганты. В конце июня Flitto сообщила, что сумма двух контрактов на поставку данных с глобальными ИТ-клиентами увеличилась более чем вдвое и составила в совокупности 31,6 млрд вон (21,2 млн долл. США). Более крупный из них, на сумму 22,7 млрд вон (15,2 млн. долл. США), превышает весь доход Flitto за 2024 год.


Ли Чжон Су, основатель и генеральный директор Flitto, известный на международном уровне как Саймон Ли, дает интервью газете «The Korea Herald» в штаб-квартире компании в округе Каннам в Сеуле 13 июля. (Flitto)



«Когда мы начинали, мы говорили, что мы — компания, работающая с данными. Нам никто не верил», — сказал основатель и генеральный директор Ли Чжон Су, также известный на международном уровне как Саймон Ли. Он сидел перед экраном, на котором демонстрировался его новейший проект — Flitto Marketplace (веб-сайт: https://www.flitto.com/portal/data-marketplace) — платформа, где компании, располагающие неиспользованными данными, могут выставлять их на продажу покупателям, занимающимся искусственным интеллектом. «Я просто рад, что нам удалось это доказать, не доведя компанию до обанкротства».



Доказательством этому служат финансовые показатели. В прошлом году выручка выросла на 77 процентов до 36 миллиардов вон (24 млн. долл. США), а операционная рентабельность изменилась с минус 2 процента в 2024 году до 17 процентов в 2025 году, что стало первой значимой годовой прибылью в истории компании. Около 71 процента выручки за первый квартал этого года пришлось на экспорт, а в рамках основного бизнеса по работе с данными примерно 95 процентов пришлось на клиентов из США.


Ли Чжон Су, основатель и генеральный директор Flitto, демонстрирует Flitto Marketplace — недавно запущенную компанией платформу, предназначенную для сопоставления компаний, располагающих неиспользуемыми данными, с покупателями ИИ, — во время интервью в штаб-квартире Flitto в округе Каннам в Сеуле 13 июля (Flitto)



Как перевод превратился в бизнес по работе с данными



В 2012 году основатели Flitto сделали ставку на то, что языковые данные станут ценными для любой технологии искусственного интеллекта, которая в конечном итоге возобладает. Потребовалось почти десятилетие, чтобы эта гипотеза оправдалась.



«Краудсорсинговый перевод никогда не был конечной целью» — сказал Ли. — Это был единственный практичный способ сбора данных на тот момент».



Рынок сформировался с появлением нейронного машинного перевода. Такие сервисы, как Papago от Naver, запущенный в конце 2016 года, ослабили позиции первоначальной потребительской платформы Flitto, но повысили спрос на предложения, голоса и исправления, используемые для обучения новых систем. «Глубокое обучение не улучшило старую технологию перевода. Оно заменило её», — сказал Ли. «Внезапно рынок стал нуждаться именно в тех данных, которые мы собирали с 2012 года». Активные продажи данных корпоративным клиентам начались в 2017 году.



Бизнес-модель тогда переориентировалась с ожидания запросов на перевод на производство данных по запросу. Flitto Arcade (веб-сайт: https://www.flitto.com/arcade/), запущенная в 2018 году, превратила работу с данными в небольшие платные задания. Пользователи переводят предложения, исправляют стенограммы или записывают себя, произнося заданные фразы, зарабатывая баллы, которые можно обменять на деньги.



Сегодня компания насчитывает 14 миллионов пользователей в 173 странах.




Обучение ИИ для реального мира



Задания часто разрабатываются с учетом уникальных ситуаций, в которых модель ИИ может дать сбой. Автопроизводителю могут понадобиться люди, чтобы отдавать команды при работающем двигателе автомобиля. Производителю караоке-оборудования может потребоваться запись речи на фоне громкой музыки, чтобы его система могла отделить запрос от песни.



По словам Ли, данные должны соответствовать двум стандартам: быть достаточно точными для улучшения модели и юридически обоснованными для коммерческого обучения. «Если не пройдено хотя бы одно из этих испытаний, объем данных не имеет значения», — сказал он.



По его оценкам, точность исходных данных обычно составляет 70–80 процентов. Flitto пропускает их через три–семь уровней проверки, при этом участники сортируются по навыкам и предыдущим результатам, а те, кто получил более высокие оценки, назначаются для окончательной проверки. Он утверждает, что когда модель клиента сталкивается с незнакомым именем собственным или шумной средой, исправить ситуацию может только тот поставщик, который владеет собственными данными и может переобучать модель на них.




Клиенты обычно тестируют небольшую выборку перед масштабированием. Один из недавних контрактов начался с 568 млн вон (381 тыс. долл. США) в октябре 2025 года, вырос до 3,9 млрд вон (2,6 млн. долл. США) к апрелю и достиг 8,9 млрд вон (6,0 млн. долл. США) к июню. Еще один контракт увеличился более чем вдвое за три дня после того, как клиент запросил дополнительный объем. По мнению Ли, эта тенденция отражает сдвиг в том, что сейчас хотят покупатели из числа крупных технологических компаний: не универсальные языковые данные, которые можно собрать из интернета, а «более узконаправленный, «чистый» материал с большим количеством крайних случаев, который может произвести только специально построенный конвейер».



Несмотря на весь успех за рубежом, Ли разочарован тем, насколько мало понимают суть этого бизнеса у него на родине. Он отметил, что даже крупнейшие корейские конгломераты, работающие в сфере ИИ, редко тратят на обучающие данные более 5 миллиардов вон (3,4 млн. долл. США) в год, а большинство тратит около 1 миллиарда (670 тыс. долл. США). По его утверждению, китайские конкуренты регулярно тратят в 10–100 раз больше.



«Корейские покупатели рассматривают данные как расходные материалы, а не как инвестиции», — сказал Ли. «Именно поэтому практически ни одна часть нашей выручки не поступает из Кореи. Компании, которые понимают ценность данных, находятся где-то в других странах».





 
 
 
2.png

KOREA HERALD RUSSIAN EDITION
Copyright KOREA HERALD & WS PARTNERS

Operated by WS PARTNERS
All Rights Reserved.

Tel.: +82-2-6414-8765

bottom of page