CLIEN

본문 바로가기 메뉴 바로가기 보기설정 테마설정
톺아보기 공감글
커뮤니티 커뮤니티전체 C 모두의광장 F 모두의공원 I 사진게시판 Q 아무거나질문 D 정보와자료 N 새로운소식 T 유용한사이트 P 자료실 E 강좌/사용기 L 팁과강좌 U 사용기 · 체험단사용기 W 사고팔고 J 알뜰구매 S 회원중고장터 B 직접홍보 · 보험상담실 H 클리앙홈
소모임 소모임전체 ·굴러간당 ·주식한당 ·아이포니앙 ·방탄소년당 ·일본산당 ·MaClien ·안드로메당 ·개발한당 ·자전거당 ·클다방 ·소셜게임한당 ·키보드당 ·소시당 ·나스당 ·가상화폐당 ·야구당 ·퐁당퐁당 ·창업한당 ·바다건너당 ·육아당 ·디아블로당 ·달린당 ·이륜차당 ·땀흘린당 ·골프당 ·AI당 ·3D메이킹 ·X세대당 ·ADHD당 ·AI그림당 ·날아간당 ·사과시계당 ·배드민턴당 ·농구당 ·블랙베리당 ·곰돌이당 ·비어있당 ·FM당구당 ·블록체인당 ·보드게임당 ·활자중독당 ·볼링친당 ·캠핑간당 ·냐옹이당 ·문명하셨당 ·클래시앙 ·콘솔한당 ·요리한당 ·쿠키런당 ·대구당 ·DANGER당 ·뚝딱뚝당 ·개판이당 ·동숲한당 ·날아올랑 ·전기자전거당 ·e북본당 ·갖고다닌당 ·이브한당 ·패셔니앙 ·물고기당 ·도시어부당 ·FM한당 ·맛있겠당 ·포뮬러당 ·젬워한당 ·걸그룹당 ·안경쓴당 ·차턴당 ·총쏜당 ·하스스톤한당 ·히어로즈한당 ·인스타한당 ·IoT당 ·KARA당 ·꼬들한당 ·덕질한당 ·어학당 ·가죽당 ·레고당 ·리눅서당 ·LOLien ·Mabinogien ·임시소모임 ·미드당 ·밀리터리당 ·땅판당 ·헌팅한당 ·오른당 ·영화본당 ·MTG한당 ·소리당 ·노키앙 ·적는당 ·방송한당 ·PC튜닝한당 ·찰칵찍당 ·그림그린당 ·소풍간당 ·심는당 ·패스오브엑자일당 ·라즈베리파이당 ·품앱이당 ·리듬탄당 ·노젓는당 ·Sea마당 ·SimSim하당 ·심야식당 ·윈태블릿당 ·미끄러진당 ·축구당 ·나혼자산당 ·스타한당 ·스팀한당 ·파도탄당 ·테니스친당 ·테스트당 ·빨콩이당 ·공대시계당 ·여행을떠난당 ·터치패드당 ·트윗당 ·VR당 ·시계찬당 ·WebOs당 ·위스키당 ·와인마신당 ·WOW당 ·윈폰이당
임시소모임
고객지원
  • 게시물 삭제 요청
  • 불법촬영물등 신고
  • 쪽지 신고
  • 닉네임 신고
  • 제보 및 기타 제안
© CLIEN.NET
공지[점검] 잠시후 서비스 점검을 위해 약 30분간 접속이 차단됩니다. (금일 18:15 ~ 18:45)

모두의공원

딥시크, 한동안 계속 퍼줄 모양입니다. 12

9
2025-02-25 15:47:42 수정일 : 2025-02-25 16:11:35 122.♡.56.205
천문공

Multi-Head Latent Attention(MLA) 

이게 딥시크의 핵심 기술 중 하나입니다.

상세한 기술적인 부분을 말씀드리긴 조금 어려운데,

간단하게 기존의 트랜스포머를 동작케 하는 어텐션 기법의

한계를 부수는 발전 버전 정도...로 이해하면 좋겠습니다.


여기서 기술적 설명이 어렵다고 하는 이유는,

여기저기서 얻어 들은 내용이 있긴 하지만 글로 표현이 어려워서인데요.

대략, Cuda 가 아닌 직접 로우레벨로 들어가 코딩했다고 합니다.

아무튼, 이게 이런 코딩하기도 어렵지만, 

새로운 업데이트 때마다 노가다를 해야하고...


최근에 여기서 더 업그레이드 된 FlashMLA 를 공개했습니다.

이와 같은 신 기법을 노가다 하려면...

이게 상당한 인적 자원이 들어가서, 어지간하면 시도하지 못하고,

매번 기술을 개발할 때 마다 하나하나 뜯어 고쳐야 한다니...


즉, 상당히 뛰어난 인재가 효율적으로 작업한다고 해도...

쿠다에 비해 작업 효율이 지극히 떨어지는 대신,

그것을 상쇄 하는 최적화된 성능의 코드를 만들어 낼 수 있다고 하네요.

틀린 점 있으면 지적 바라고요.


여튼, 말하고자 하는 요점이 무엇이냐면...

이 기술이 요즘 폐쇄형 선두의 AI기업들도 매달리고 있는 핵심 기술이라는 것입니다.

오픈소스로 푸니 어쩌니 해도...이런 핵심 기술은 풀지 않는 편인데,

씨게 작심했나 봅니다.

미국의 LLM 독주를 중국만이 아니라

여러 나라에서 염려하고 경계하고 있는 상황에서,

행동 대장으로 선봉에 나서... 가장 앞선 기법을 공개해 버리니...

이 정도면 여러 나라의 여러 능력자들이 뛰어들게 생겼습니다.

전 매우 높은 확률로, 이런 최신 기법을 

또 다른 능력자가 개선 시켜  공개 할 것이라 보고 있습니다.

얼마 전 S1이 공개 되었던것처럼요.


이제 한동안 오픈소스 진영은 불이 붙을 듯 합니다.

FlashMLA는...대부분의 AI연구 하는 곳들이 하고자 했던 방향이라...

로컬로 돌리기 위해서는 메모리 관리 및 효율 최적화가 필요한데,

이 기술이 그런 쪽이거든요.

성능은 높이면서....자원은 덜 들어가는...

천문공 님의 게시글 댓글
  • 주소복사
  • Facebook
  • X(Twitter)
댓글 • [12]
memberst
IP 121.♡.223.50
02-25 2025-02-25 15:49:49 / 수정일: 2025-02-25 15:52:43
·
cuda로 만들지 않아서 화웨이 어센드 칩에서 돌아가죠
그래서 서비스용 서버는 엔비디아 칩을 안씁니다...
딥시크에 대해서 엔비디아가 에써 좋은거다라고 하긴 하지만
내용을 들여다 보면 엔비디아에게 뼈아픈게 많죠
하달탱
IP 106.♡.233.178
02-25 2025-02-25 16:53:11
·
@memberst님 문제는 저렇게 로우레벨로 짜면 유지보수나 범용화가 무지하게 힘든...뭐할때마다 기반을 계속 뜯어고쳐야 하니...
indigo62018
IP 104.♡.86.232
02-25 2025-02-25 15:51:19
·
이젠 중국 기술력 좀 인정 하시는건가요?
천문공
IP 122.♡.56.205
02-25 2025-02-25 15:53:19
·
@이공일팔님
무슨 말씀이신지 모르겠네요..ㅎㅎ
제 글의 일부만 보신 것은 아닌지...생각 됩니다.

어디까지나 제 주관일 뿐이지만,
인정할 것은 하고, 하지 않는 것은 하지 않습니다.
indigo62018
IP 104.♡.86.232
02-25 2025-02-25 15:56:04
·
@천문공님 어찌된 영문인지 여러분야에서 중국 기술력을 폄하하시는 모습을 많이 본걸로 제가 기억해서요. 제가 잘못 기억하는걸수도 있구요.
천문공
IP 122.♡.56.205
02-25 2025-02-25 16:07:31 / 수정일: 2025-02-25 16:09:03
·
@이공일팔님
폄하가 아니라,
제 생각은 반복해서 같은 결로 말하고 있습니다.

중국은 스펙트럼이 넓고,
개중에 진짜와 가짜가 섞여 있으며,
중국 기업들은 제품 발표 때 당장 내일 드러날 일도 허풍과 과장이 일상입니다.
매직그래프 정도로도 욕을 먹는 미국 기업들과는 레벨이 다르다는 말입니다.

즉, 검증이 필요한 부분에 대해 이야기 해온 것이고,
기업마다 허풍의 정도도 다르고... 이게 구별이 잘 되지 않으므로,
시간을 두고 검증과정을 지켜 볼 수 밖에 없습니다.

AI분야는 중국의 인재 양성 기조가 꽤 오래 되었습니다.
당연히 양적으로도 질적으로도 상당합니다.
딥시크가 나오기 이전 즉 Qwen 이 처음 나올 즈음부터
꾸준히 모니터링을 해왔기에,
중국 AI가 앞서가는 것은 이미 예전부터 알고 있었습니다.

수년 전에 1천km 간다는 배터리를 이야기 했을 때처럼,
허풍...검증을 해보면 허풍이라는 것을 아는 것들...
이런 것들은 당연히 인정할 수 없는 것 아니겠습니까?
indigo62018
IP 104.♡.86.232
02-25 2025-02-25 16:47:58
·
@천문공님 큰 원칙은 동의합니다.
야하하하
IP 61.♡.249.83
02-25 2025-02-25 15:52:46
·
CUDA에 의존하지 않고 로우레벨로 들어가 코딩한 게 아니라 CUDA의 로우레벨 까지 들어가 수정한 겁니다. 오히려 CUDA를 벗어날 수 없게 되버린 겁니다.
천문공
IP 122.♡.56.205
02-25 2025-02-25 15:53:49
·
@야하하하님
아.. 그런 내용으로 일부 수정하겠습니다.
그렇게 본 것 같네요.
memberst
IP 121.♡.223.50
02-25 2025-02-25 15:55:55 / 수정일: 2025-02-25 15:58:40
·
@야하하하님 꼭 그렇지는 않습니다 중국 자체제작으로 만들어지는 어센드에서도 PTX로 돌리죠..
최근 어센드 970c에서도 추론 및 학습까지 구현하였고 다음 프로젝트 부터는 상당부분 화웨이 칩에 의존할것 같습니다

엔비디아로서는 속이 탈겁니다
isaiah1
IP 39.♡.231.18
02-25 2025-02-25 15:57:46 / 수정일: 2025-02-25 15:59:40
·
@야하하하님
CUDA를 사용하지 않고 PTX를 사용했다는거네요..
CUDA를 벗어났다고 표현한것은 맞는듯 합니다..

PTX도 nvidia 하드웨어를 위한 API지만 쿠다 보다 로우레벨이라고 하니 NVIDIA에서 NVIDIA하드웨어로 전환할때 해야 할 수고가 cuda대비 클 테니 다른 하드웨어로 전환할때 필요한 기회비용은 감소했다고 볼 수도 있고요,,
주나파
IP 61.♡.170.150
02-25 2025-02-25 16:20:20
·
CUDA 코어를 돌리기 위해 CUDA 라이브러리를 보통 사용하는데 이를 안쓰고 PTX 를 썼다는 말 아닌가요?
새로운 댓글이 없습니다.
이미지 최대 업로드 용량 15 MB / 업로드 가능 확장자 jpg,gif,png,jpeg,webp
지나치게 큰 이미지의 크기는 조정될 수 있습니다.
목록으로
글쓰기
글쓰기
목록으로 댓글보기 이전글 다음글
아이디  ·  비밀번호 찾기 회원가입
이용규칙 운영알림판 운영소통 재검토요청 도움말 버그신고
개인정보처리방침 이용약관 책임의 한계와 법적고지 청소년 보호정책
©   •  CLIEN.NET
보안 강화를 위한 이메일 인증
안전한 서비스 이용을 위해 이메일 인증을 완료해 주세요. 현재 회원님은 이메일 인증이 완료되지 않은 상태입니다.
최근 급증하는 해킹 및 도용 시도로부터 계정을 보호하기 위해 인증 절차가 강화되었습니다.

  • 이메일 미인증 시 글쓰기, 댓글 작성 등 게시판 활동이 제한됩니다.
  • 이후 새로운 기기에서 로그인할 때마다 반드시 이메일 인증을 거쳐야 합니다.
  • 2단계 인증 사용 회원도 최초 1회는 반드시 인증하여야 합니다.
  • 개인정보에서도 이메일 인증을 할 수 있습니다.
지금 이메일 인증하기
등록된 이메일 주소를 확인하고 인증번호를 입력하여
인증을 완료해 주세요.