CLIEN

본문 바로가기 메뉴 바로가기 보기설정 테마설정
톺아보기 공감글
커뮤니티 커뮤니티전체 C 모두의광장 F 모두의공원 I 사진게시판 Q 아무거나질문 D 정보와자료 N 새로운소식 T 유용한사이트 P 자료실 E 강좌/사용기 L 팁과강좌 U 사용기 · 체험단사용기 W 사고팔고 J 알뜰구매 S 회원중고장터 B 직접홍보 · 보험상담실 H 클리앙홈
소모임 소모임전체 ·굴러간당 ·아이포니앙 ·주식한당 ·일본산당 ·방탄소년당 ·MaClien ·자전거당 ·개발한당 ·안드로메당 ·클다방 ·야구당 ·가상화폐당 ·달린당 ·퐁당퐁당 ·이륜차당 ·창업한당 ·키보드당 ·땀흘린당 ·소시당 ·나스당 ·덕질한당 ·걸그룹당 ·디아블로당 ·AI그림당 ·소셜게임한당 ·AI당 ·육아당 ·바다건너당 ·3D메이킹 ·X세대당 ·ADHD당 ·날아간당 ·사과시계당 ·배드민턴당 ·농구당 ·블랙베리당 ·곰돌이당 ·비어있당 ·FM당구당 ·블록체인당 ·보드게임당 ·활자중독당 ·볼링친당 ·캠핑간당 ·냐옹이당 ·문명하셨당 ·클래시앙 ·콘솔한당 ·요리한당 ·쿠키런당 ·대구당 ·DANGER당 ·뚝딱뚝당 ·개판이당 ·동숲한당 ·날아올랑 ·전기자전거당 ·e북본당 ·갖고다닌당 ·이브한당 ·패셔니앙 ·물고기당 ·도시어부당 ·FM한당 ·맛있겠당 ·포뮬러당 ·젬워한당 ·안경쓴당 ·골프당 ·차턴당 ·총쏜당 ·하스스톤한당 ·히어로즈한당 ·인스타한당 ·IoT당 ·KARA당 ·꼬들한당 ·어학당 ·가죽당 ·레고당 ·리눅서당 ·LOLien ·Mabinogien ·임시소모임 ·미드당 ·밀리터리당 ·땅판당 ·헌팅한당 ·오른당 ·영화본당 ·MTG한당 ·소리당 ·노키앙 ·적는당 ·방송한당 ·PC튜닝한당 ·찰칵찍당 ·그림그린당 ·소풍간당 ·심는당 ·패스오브엑자일당 ·라즈베리파이당 ·품앱이당 ·리듬탄당 ·노젓는당 ·Sea마당 ·SimSim하당 ·심야식당 ·윈태블릿당 ·미끄러진당 ·축구당 ·나혼자산당 ·스타한당 ·스팀한당 ·파도탄당 ·테니스친당 ·테스트당 ·빨콩이당 ·공대시계당 ·여행을떠난당 ·터치패드당 ·트윗당 ·VR당 ·시계찬당 ·WebOs당 ·위스키당 ·와인마신당 ·WOW당 ·윈폰이당
임시소모임
고객지원
  • 게시물 삭제 요청
  • 불법촬영물등 신고
  • 쪽지 신고
  • 닉네임 신고
  • 제보 및 기타 제안
© CLIEN.NET
공지[점검] 잠시후 서비스 점검을 위해 약 30분간 접속이 차단됩니다. (금일 18:15 ~ 18:45)

새로운소식

삼성이 구상하는 AI의 미래 3

6
2025-11-21 15:21:15 123.♡.171.2
_딘_

"폰 안에 작은 슈퍼컴퓨터"…삼성이 구상하는 AI의 미래


온디바이스 AI 고도화 속도
모델 압축·최적화로 클라우드급 구현
온디바이스 전용 구조로 개인화·보안 강화





삼성전자, AI를 손 안에 담다: 온디바이스 최적화 기술의 혁신


과거 SF 영화 속 인공지능은 거대한 컴퓨터 장비나 초대형 서버로 묘사되곤 했지만, 오늘날 AI는 손 안의 기기에서도 바로 사용하는 일상의 기술이 됐다. 삼성전자는 모바일 기기, 가전 등 다양한 기기에 외부 서버나 클라우드 없이 자체적으로 AI를 구동하는 ‘온디바이스 AI(On-Device AI)’ 기술을 적극 도입하며, 빠르고 안전한 AI 경험을 실현하고 있다.


서버 환경과 달리 온디바이스에서는 메모리와 연산 자원의 제약이 크다. 따라서 AI 모델의 크기를 줄이고, 기기 환경에 맞게 실행 효율을 높이는 온디바이스 AI 최적화 기술이 필수적이다. 삼성리서치 AI 센터는 이를 위해 모델 압축, 실행 소프트웨어 최적화, 새로운 아키텍처 개발 등 핵심 기술 전반에서 연구를 선도하고 있다.


온디바이스 AI의 현재와 미래, 그리고 이를 가능케 하는 최적화 기술에 대해 더 자세히 듣기 위해 삼성전자 뉴스룸이 삼성리서치 AI센터 함명주 마스터를 만나봤다.


삼성리서치 AI센터 함명주 마스터.

▲ 삼성리서치 AI센터 함명주 마스터


‘크기는 DOWN, 효율은 UP’ 온디바이스 AI의 시작, 모델 압축


사용자 언어를 이해하고 자연스러운 답변을 만들어내는 생성형 AI의 중심에는 거대언어모델(Large Language Model, LLM)이 있다. 온디바이스 AI의 첫 단계는 이 거대한 모델이 모바일 기기 안에서도 잘 작동할 수 있도록 작게, 효율적으로 만드는 일이다.


함명주 마스터는 “수십억 개의 연산을 수행하는 초고도 지능 모델을 모바일 기기나 노트북에서 그대로 구동한다면 배터리가 빠르게 소모되고, 기기 발열이 심해지거나 응답 속도가 느려져 사용자 경험이 크게 저하될 것”이라며 이를 해결하기 위해 등장한 것이 ‘모델 압축’ 기술이라고 소개했다.


거대언어모델은 본래 매우 복잡한 숫자로 연산을 수행한다. 모델 압축 기술은 이 숫자를 보다 효율적으로 표현하기 위해 단순한 정수 형태로 바꾸는데, 이 과정을 ‘양자화(Quantization)’라고 한다. 함 마스터는 “고해상도 사진을 압축해 용량은 줄였지만 육안으로는 화질 차이가 거의 없는 상태를 유지하는 것과 비슷하다”며 “예를 들어, 32비트 부동소수점 실수로 계산하던 것을 8비트나 4비트 정수로 단순화하면 메모리 용량과 연산량이 크게 줄어 응답 속도가 빨라진다”고 설명했다.


모델 가중치를 양자화해 성능은 유지하면서 용량을 줄이고 속도를 높이는 모델 압축 기술.

▲ 모델 가중치를 양자화해 성능은 유지하면서 용량을 줄이고 속도를 높이는 모델 압축 기술


양자화 과정에서 숫자의 정밀도가 낮아지면, 모델의 정확도가 떨어질 수 있다. 삼성리서치는 속도와 정확성의 균형을 잡기 위해 압축 이후의 성능을 세밀하게 측정하고 보정하는 알고리즘과 개발 도구를 함께 설계하고 있다.


함명주 마스터는 “모델 압축의 핵심은 단순히 작게 만드는 것이 아니라, 작지만 정확하고 빠른 모델을 만드는 것”이라고 강조했다. 그는 “최적화 알고리즘을 통해 압축 과정에서 모델의 손실 함수를 세밀하게 분석하고, 원래 결과값과 거의 근접한 값이 나올 때까지 학습시키거나 오차가 큰 구간을 부드럽게 다듬는다”며 “모델의 가중치마다 중요도가 다르므로, 중요한 가중치는 정밀하게 유지하고 덜 중요한 부분은 과감하게 압축하는 방식으로 효율을 극대화하면서도 정확도를 유지할 수 있다”고 말했다.


삼성리서치는 모델 압축 기술을 연구 수준에서 구현하는 데 그치지 않고, AI 폰과 가전 등 실제 제품 환경에 맞춰 직접 개발하고 상용화한다. 함 마스터는 “기종마다 메모리 구조나 연산 성능이 모두 다르기 때문에, 일반적인 접근으로는 클라우드 기반 AI 수준의 성능을 내기 어렵다”며 “삼성리서치는 제품 중심(Product-driven) 연구를 통해 자체 설계한 압축 알고리즘으로 사용자의 손 안에서 직접 체감되는 AI 경험 개선을 목표로 하고 있다”고 설명했다.


“AI 성능을 끌어올리는 숨은 엔진” AI 실행 소프트웨어


AI 모델을 아무리 잘 압축하더라도, 기기 안에서 어떻게 구동되는지에 따라 체감 성능은 크게 달라진다. 삼성리서치는 모델이 실제로 작동하는 단계에서 기기의 메모리와 연산 자원을 가장 효율적으로 활용할 수 있는 ‘AI 실행기’를 개발하고 있다.


함명주 마스터는 “AI 실행기는 모델의 ‘엔진 제어장치’와 같다”며 “모델이 CPU, GPU, NPU 등 서로 다른 연산 장치에서 동시에 작동할 때, 어떤 연산을 어느 칩에서 처리할지 자동으로 배분하고 메모리 접근을 최소화해 AI의 성능을 높인다”고 설명했다.


AI 실행기는 동일한 기종의 기기 내에서 더 크고 정교한 모델도 같은 속도로 실행할 수 있게 해 준다. AI 서비스의 응답 지연 시간이 줄어들 뿐만 아니라, 더 높은 정확도와 자연스러운 대화, 정교한 이미지 처리 등 AI 품질 자체가 향상되는 것.


함 마스터는 “온디바이스 AI에서 가장 큰 병목은 메모리 대역폭과 저장장치 접근 속도”라며 “메모리와 연산 간의 균형을 지능적으로 조정하는 최적화 기술을 개발하고 있다”고 말했다. 예를 들어, 모든 데이터를 메모리에 올려두지 않고 필요한 시점에만 불러올 수 있도록 설계해 효율을 높이는 방식이다. 함 마스터는 “삼성리서치는 모델 크기가 16GB 이상인 300억 파라미터 규모의 생성형 모델도 3GB 이하의 메모리로 구동할 수 있는 수준의 기술력을 갖췄다”고 덧붙였다.


AI 실행 소프트웨어가 가중치 연산 시점을 예측해 메모리를 최소화하고 속도를 높이는 AI 최적 실행 기술.

▲ AI 실행 소프트웨어가 가중치 연산 시점을 예측해 메모리를 최소화하고 속도를 높이는 AI 최적 실행 기술


“더 가볍고 똑똑한 AI 모델 설계” 새로운 아키텍처 연구


AI의 설계도 역할을 하는 아키텍처(Architecture) 연구도 활발하게 진행되고 있다.


함명주 마스터는 ““온디바이스 환경에서는 연산 자원과 메모리가 제한적이기 때문에, 모델이 기기에서 원활하게 동작할 수 있도록 구조 자체를 재설계해야 한다”며 “삼성리서치의 아키텍처 연구는 하드웨어 효율을 극대화하는 모델 설계에 집중하고 있다”고 설명했다. 다시 말해, 설계 단계부터 모델과 기기의 하드웨어 자원이 서로 조화롭게 작동할 수 있도록 디바이스 친화적인 모델 구조를 만드는 것.


큰 모델의 지식을 작은 모델에 전달해 성능을 유지하면서 연산 효율을 높이는 AI 아키텍처 최적화 연구.

▲ 큰 모델의 지식을 작은 모델에 전달해 성능을 유지하면서 연산 효율을 높이는 AI 아키텍처 최적화 연구


거대언어모델의 학습에는 막대한 시간과 비용이 투입되는데, 초기에 모델 구조를 잘못 설계하면 이 비용이 크게 늘어날 수 있다. 삼성리서치는 학습 과정에서의 자원 낭비를 최소화하기 위해 학습 이전 단계에서 하드웨어 효율을 미리 예측하고, 구조적으로 최적화된 아키텍처를 설계하고 있다. 함명주 마스터는 “온디바이스 AI 시대에서 핵심 경쟁력은 같은 자원으로 얼마나 높은 효율을 끌어낼 수 있느냐에 있다”며 “작은 칩 안에서 최대의 지능을 구현하는 것이 우리가 지향해야 할 기술적 방향성”이라고 생각을 전했다.


현재 대부분의 거대언어모델은 ‘트랜스포머(Transformer)’ 아키텍처를 기반으로 한다. 트랜스포머 아키텍처는 문장 전체를 한 번에 확인하며 단어 간 관계를 계산하는 방식으로, 문맥 이해에는 뛰어나지만 문장이 길어질수록 계산량이 기하급수적으로 증가한다는 한계가 있다. 함명주 마스터는 “트랜스포머 아키텍처의 한계를 극복하기 위해 다양한 기술적 접근 방식을 검토하는 동시에, 실제 기기 환경에서 얼마나 효율적으로 작동할 수 있는지를 중심으로 평가하고 있다”며 “단순히 기존 방법을 개선하는 수준을 넘어 새로운 방법론을 도입한 ‘다음 단계의 아키텍처’를 만드는 데 집중하고 있다”고 힘주어 말했다.


“언제 어디서나 빠르고 안전하게” 온디바이스 AI의 진화

온디바이스 AI의 현재와 미래에서 가장 중요한 과제가 무엇일까? 함명주 마스터는 “핵심은 클라우드 수준의 성능을 기기 안에서 구현하는 것”이라고 답했다. 클라우드에 연결하지 않아도 빠르고 정확하게 AI가 작동하려면, 모델 최적화와 하드웨어 효율화가 긴밀하게 맞물려야 한다는 것이다. 그는 “속도, 정확도, 전력 효율을 동시에 개선하는 것이 더욱 중요해질 것”이라고 덧붙였다.


함명주 마스터는 "온디바이스 AI 최적화로 언제 어디서나 빠르고 안전하며 개인화된 AI 경험을 만들어간다"고 말했다.


온디바이스 AI 기술의 발전으로 사용자는 언제 어디서나 빠르고 안전하며 개인화된 AI 기능을 누릴 수 있게 됐다. 함명주 마스터는 “AI가 기기 안에서 실시간으로 학습하고 사용자 환경에 적응하는 능력이 강화될 것”이라며 “데이터 프라이버시를 지키면서도 자연스럽고 개인화된 서비스를 제공하는 것이 앞으로의 방향”이라고 말했다.


삼성전자는 온디바이스 AI의 최적화를 통한 한층 진화된 기술 경험을 제공하기 위해 끊임없는 혁신을 이어가고 있다. 이를 통해 더욱 놀라운 사용자 경험을 선사해 나갈 것이다.

출처 : https://www.newspim.com/news/view/20251121000135 https://news.samsung.com/kr/ai-%ED%8A%B9%EC%A7%91-ai%EB%A5%BC-%EC%86%90-%EC%95%88%EC%97%90-%EB%8B%B4%EB%8B%A4-%EC%98%A8%EB%94%94%EB%B0%94%EC%9D%B4%EC%8A%A4-%EC%B5%9C%EC%A0%81%ED%99%94-%EA%B8%B0%EC%88%A0%EC%9D%98-%ED%98%81
_딘_ 님의 게시글 댓글
  • 주소복사
  • Facebook
  • X(Twitter)
댓글 • [3]
날아라국장
IP 59.♡.18.99
11-21 2025-11-21 19:29:49
·
솔직히 저도 이게 맞다고 생각합니다. 범용 LLM은 돈과 인력 풀, 전력공급에서 한계가 있다고 생각합니다. 물론 대체제 차원에서 하나 가지고는 있어야 하지만, 글로벌 경쟁력은 없을 겁니다. 그래서 차라리 이렇게 AI on Device로 특정 파트 특정 분야에 특화된 AI에 집중하는게 맞다고 생각합니다.
섬마을생산직
IP 106.♡.8.82
11-22 2025-11-22 23:54:59 / 수정일: 2025-11-22 23:55:24
·
택도 없는 소리 같다고 옆집 야옹이가 갸르릉거리네요. 클라우드 수준의 AI 성능을 디바이스 단에서 구현가능하다면, 이미 고양이가 세계정복에 성공했을거라구용.
신의한수
IP 1.♡.174.104
11-23 2025-11-23 11:24:26
·
@섬마을생산직님
알파고의 전례를 보면, 이세돌과 둘때 1000대가 넘는 시스템이 가동되었다고 했는데, 2~3년뒤에 모델이 완성되었을 때는 핸드폰으로 들어왔습니다.
에릭 슈밋의 예측에서도 모델이 완성된 뒤에는 수년안에 핸드폰으로 온디바이스 실행가능할거라는 거 같습니다. 정확한 원리는 모르겠습니다만, 모델이 완성된 후에 양자화는 생각보다 높은 비율로 가능한거 아닐까요?
새로운 댓글이 없습니다.
이미지 최대 업로드 용량 15 MB / 업로드 가능 확장자 jpg,gif,png,jpeg,webp
지나치게 큰 이미지의 크기는 조정될 수 있습니다.
목록으로
글쓰기
글쓰기
목록으로 댓글보기 이전글 다음글
아이디  ·  비밀번호 찾기 회원가입
이용규칙 운영알림판 운영소통 재검토요청 도움말 버그신고
개인정보처리방침 이용약관 책임의 한계와 법적고지 청소년 보호정책
©   •  CLIEN.NET
보안 강화를 위한 이메일 인증
안전한 서비스 이용을 위해 이메일 인증을 완료해 주세요. 현재 회원님은 이메일 인증이 완료되지 않은 상태입니다.
최근 급증하는 해킹 및 도용 시도로부터 계정을 보호하기 위해 인증 절차가 강화되었습니다.

  • 이메일 미인증 시 글쓰기, 댓글 작성 등 게시판 활동이 제한됩니다.
  • 이후 새로운 기기에서 로그인할 때마다 반드시 이메일 인증을 거쳐야 합니다.
  • 2단계 인증 사용 회원도 최초 1회는 반드시 인증하여야 합니다.
  • 개인정보에서도 이메일 인증을 할 수 있습니다.
지금 이메일 인증하기
등록된 이메일 주소를 확인하고 인증번호를 입력하여
인증을 완료해 주세요.