오이마켓기술을 고객가치로 만드는 미디어

비즈니스 기회

메타는 역사상 가장 큰 규모의 '오픈' AI 모델을 출시

박윤석 VP · 2024.08.05

메타는 역사상 가장 큰 규모의 '오픈' AI 모델을 출시

인공 지능의 세계에서는 전투가 진행 중입니다. 한쪽에는 고급 소프트웨어 뒤에 있는 데이터 세트와 알고리즘을 비공개로 기밀로 유지한다고 믿는 회사가 있습니다. 다른 한쪽에는 대중이 정교한 AI 모델의 후드 아래에 무엇이 있는지 볼 수 있다고 믿는 회사가 있습니다.

이를 오픈 소스 AI와 클로즈드 소스 AI 간의 전투로 생각하십시오.

최근 몇 주 동안 Facebook의 모회사인 Meta는 새로운 대규모 AI 모델 컬렉션을 출시하여 오픈 소스 AI를 위한 싸움에 대대적으로 참여했습니다. 여기에는 메타의 창립자이자 CEO인 마크 저커버그(Mark Zuckerberg)가 "최초의 프론티어 수준의 오픈소스 AI 모델"이라고 말한 라마 3.1 405B라는 모델이 포함됩니다.

모든 사람이 AI의 혜택에 접근할 수 있는 미래를 꿈꾸는 사람이라면 누구에게나 좋은 소식입니다.

클로즈드 소스 AI의 위험과 오픈 소스 AI의 약속

클로즈드 소스 AI는 독점적이고 기밀로 유지되는 모델, 데이터 세트 및 알고리즘을 말합니다. 예를 들어 ChatGPT, Google의 Gemini, Anthropic의 Claude가 있습니다.

이러한 제품은 누구나 사용할 수 있지만 AI 모델이나 도구를 구축하는 데 어떤 데이터 세트와 소스 코드가 사용되었는지 확인할 수 있는 방법은 없습니다.

이는 기업이 지적 재산과 이익을 보호할 수 있는 좋은 방법이지만 대중의 신뢰와 책임을 약화시킬 위험이 있습니다. AI 기술을 클로즈드 소스로 만들면 혁신이 느려지고 기업이나 다른 사용자가 AI 요구 사항을 단일 플랫폼에 의존하게 됩니다. 이는 모델을 소유한 플랫폼이 변경, 라이선싱 및 업데이트를 제어하기 때문입니다.

AI의 공정성, 책임성, 투명성, 개인 정보 보호 및 인간 감독을 개선하기 위한 다양한 윤리적 프레임워크가 있습니다. 그러나 이러한 원칙은 독점 시스템과 관련된 투명성 및 외부 책임의 내재적 부족으로 인해 폐쇄 소스 AI로 완전히 달성되지 않는 경우가 많습니다.

ChatGPT의 경우 모회사인 OpenAI는 최신 AI 도구의 데이터 세트나 코드를 대중에게 공개하지 않습니다. 이로 인해 규제 기관이 이를 감사하는 것이 불가능합니다. 또한 서비스에 대한 액세스는 무료이지만 사용자 데이터가 저장되고 모델 재학습에 사용되는 방식에 대한 우려는 여전히 남아 있습니다.

반면, 오픈 소스 AI 모델의 코드와 데이터 세트는 모든 사람이 볼 수 있습니다.

이는 커뮤니티 협업을 통해 빠른 개발을 촉진하고 소규모 조직과 개인이 AI 개발에 참여할 수 있도록 합니다. 또한 대규모 AI 모델을 훈련하는 데 막대한 비용이 들기 때문에 중소기업에 큰 차이를 만듭니다.

아마도 가장 중요한 것은 오픈 소스 AI를 통해 잠재적인 편향과 취약성을 면밀히 조사하고 식별할 수 있다는 것입니다.

그러나 오픈소스 AI는 새로운 위험과 윤리적 문제를 야기합니다.

예를 들어, 오픈 소스 제품의 품질 관리는 일반적으로 낮습니다. 해커도 코드와 데이터에 액세스할 수 있기 때문에 모델은 사이버 공격에 더 취약하며 다크 웹의 데이터로 모델을 재훈련하는 것과 같은 악의적인 목적으로 맞춤화하고 사용자 지정할 수 있습니다.

오픈 소스 AI의 선구자

모든 주요 AI 회사 중에서 Meta는 오픈 소스 AI의 선구자로 부상했습니다. 새로운 AI 모델 제품군을 통해 OpenAI가 2015년 12월 출시 당시 약속한 것, 즉 "인류 전체에 가장 도움이 될 수 있는 방식으로" 디지털 인텔리전스를 발전시키는 일을 하고 있습니다.

Llama 3.1 405B는 역사상 가장 큰 오픈 소스 AI 모델입니다. 이는 여러 언어로 인간 언어 텍스트를 생성할 수 있는 대규모 언어 모델로 알려져 있습니다. 온라인으로 다운로드할 수 있지만 거대한 크기 때문에 사용자는 실행하려면 강력한 하드웨어가 필요합니다.

Llama 3.1 405B는 모든 지표에서 다른 모델보다 성능이 뛰어나지는 않지만 경쟁력이 높은 것으로 간주되며 추론 및 코딩 작업과 같은 특정 작업에서 기존의 폐쇄 소스 및 상용 대규모 언어 모델보다 더 나은 성능을 발휘합니다.

그러나 Meta가 훈련에 사용된 방대한 데이터 세트를 공개하지 않았기 때문에 새 모델은 완전히 공개되지 않았습니다. 이것은 현재 누락 된 중요한 "개방형"요소입니다.

그럼에도 불구하고 Meta의 Llama는 대규모 언어 모델을 처음부터 훈련하는 데 필요한 막대한 리소스 없이도 활용할 수 있기 때문에 연구자, 소규모 조직 및 스타트업을 위한 경쟁의 장을 평준화합니다.

AI의 미래 형성

AI의 민주화를 위해서는 다음과 같은 세 가지 핵심 요소가 필요합니다.

- 거버넌스: AI 기술이 책임감 있고 윤리적으로 개발되고 사용되도록 보장하기 위한 규제 및 윤리적 프레임워크

- 접근성: 저렴한 컴퓨팅 리소스와 사용자 친화적인 도구를 통해 개발자와 사용자에게 공정한 환경을 보장합니다.

- 개방성: AI 도구를 훈련하고 구축하기 위한 데이터 세트와 알고리즘은 투명성을 보장하기 위해 오픈 소스여야 합니다.

이 세 가지 기둥을 달성하는 것은 정부, 산업계, 학계 및 대중의 공동 책임입니다. 대중은 AI의 윤리적 정책을 옹호하고, AI 개발에 대한 정보를 유지하고, AI를 책임감 있게 사용하고, 오픈 소스 AI 이니셔티브를 지원함으로써 중요한 역할을 할 수 있습니다.

그러나 오픈소스 AI에 대한 몇 가지 질문이 남아 있습니다. 오픈 소스 AI를 통한 지적 재산 보호와 혁신 촉진 사이에서 어떻게 균형을 잡을 수 있을까요? 오픈소스 AI에 대한 윤리적 우려를 최소화하려면 어떻게 해야 할까요? 잠재적인 오용으로부터 오픈소스 AI를 어떻게 보호할 수 있을까요?

이러한 질문을 적절하게 해결하면 AI가 모두를 위한 포용적인 도구가 되는 미래를 만드는 데 도움이 될 것입니다.

우리는 도전에 맞서 AI가 더 큰 이익을 위해 봉사하도록 할 수 있을까요? 아니면 그것이 배제와 통제를 위한 또 다른 불쾌한 도구가 되도록 내버려 둘 것인가? 미래는 우리 손에 달려 있습니다.

이상의 기사는 2024년 8월 2일 SingularityHub에 게재된 “Meta Just Launched the Largest ‘Open’ AI Model in History. Here’s Why It Matters.”제목의 기사 내용을 편집하여 작성하였습니다.

이미지 크레디트: Google DeepMind / Unsplash

* 원문정보 출처 : Meta Just Launched the Largest ‘Open’ AI Model in History. Here’s Why ItMatters. (singularityhub.com)