CLIEN

본문 바로가기 메뉴 바로가기 보기설정 테마설정
톺아보기 공감글
커뮤니티 커뮤니티전체 C 모두의광장 F 모두의공원 I 사진게시판 Q 아무거나질문 D 정보와자료 N 새로운소식 T 유용한사이트 P 자료실 E 강좌/사용기 L 팁과강좌 U 사용기 · 체험단사용기 W 사고팔고 J 알뜰구매 S 회원중고장터 B 직접홍보 · 보험상담실 H 클리앙홈
소모임 소모임전체 ·굴러간당 ·아이포니앙 ·MaClien ·주식한당 ·개발한당 ·일본산당 ·자전거당 ·방탄소년당 ·안드로메당 ·야구당 ·나스당 ·노젓는당 ·소시당 ·이륜차당 ·골프당 ·디아블로당 ·클다방 ·와인마신당 ·AI당 ·레고당 ·어학당 ·위스키당 ·물고기당 ·ADHD당 ·소리당 ·키보드당 ·안경쓴당 ·바다건너당 ·스팀한당 ·리눅서당 ·가상화폐당 ·달린당 ·콘솔한당 ·땀흘린당 ·PC튜닝한당 ·창업한당 ·3D메이킹 ·X세대당 ·AI그림당 ·날아간당 ·사과시계당 ·육아당 ·배드민턴당 ·농구당 ·블랙베리당 ·곰돌이당 ·비어있당 ·FM당구당 ·블록체인당 ·보드게임당 ·활자중독당 ·볼링친당 ·캠핑간당 ·냐옹이당 ·문명하셨당 ·클래시앙 ·요리한당 ·쿠키런당 ·대구당 ·DANGER당 ·뚝딱뚝당 ·개판이당 ·동숲한당 ·날아올랑 ·전기자전거당 ·e북본당 ·갖고다닌당 ·이브한당 ·패셔니앙 ·도시어부당 ·FM한당 ·맛있겠당 ·포뮬러당 ·젬워한당 ·걸그룹당 ·차턴당 ·총쏜당 ·하스스톤한당 ·히어로즈한당 ·인스타한당 ·IoT당 ·KARA당 ·꼬들한당 ·덕질한당 ·가죽당 ·LOLien ·Mabinogien ·임시소모임 ·미드당 ·밀리터리당 ·땅판당 ·헌팅한당 ·오른당 ·영화본당 ·MTG한당 ·노키앙 ·적는당 ·방송한당 ·찰칵찍당 ·그림그린당 ·소풍간당 ·심는당 ·패스오브엑자일당 ·라즈베리파이당 ·품앱이당 ·리듬탄당 ·Sea마당 ·SimSim하당 ·심야식당 ·윈태블릿당 ·미끄러진당 ·축구당 ·나혼자산당 ·스타한당 ·파도탄당 ·퐁당퐁당 ·테니스친당 ·테스트당 ·빨콩이당 ·공대시계당 ·여행을떠난당 ·터치패드당 ·트윗당 ·VR당 ·시계찬당 ·WebOs당 ·소셜게임한당 ·WOW당 ·윈폰이당
임시소모임
고객지원
  • 게시물 삭제 요청
  • 불법촬영물등 신고
  • 쪽지 신고
  • 닉네임 신고
  • 제보 및 기타 제안
© CLIEN.NET
공지[점검] 잠시후 서비스 점검을 위해 약 30분간 접속이 차단됩니다. (금일 18:15 ~ 18:45)

MaClien

맥당이야기 M5 Pro 가 생각보다 메모리 대역폭이 좁은게 로컬 AI 모델에서 체감이 되네요 27

2026-07-04 16:02:32 수정일 : 2026-07-04 16:02:47 27.♡.11.69
점돌야옹이

로컬 AI들 이렇게 저렇게 돌려보는데, 30b 정도 급만 가도 묘하게 느린 느낌이 있는게.., 이럴거면 맥스로 살걸 그랬나 하는 현타가 아주 세게 오고 있습니다 ㄷㄷㄷ...

가격 인상 없이 산건 잘 한거 같은데 묘하게 계속 워크플로우가 끊기는 느낌인게, LM Studio에서 대강 돌리면 30b급 모델이 4bit 양자화로 해도 초당 13토큰을 넘지를 못하네요 ㅠㅠ

맥스는 이거 두배라고 들은거 같은데 그렇게 생각하면 또 뭔가 되게 손해보는 것 같기도 하고..요..

가격 인상 막 발표되었을때 맥스칩 버전은 64램은 없고 48만 있길래 '그래 맥스를 사는데 48은 아니지, 48을 살거면 그냥 프로를 사지' 했는데 그게 실수였습니다 ㄷㄷ...

점돌야옹이 님의 게시글 댓글
  • 주소복사
  • Facebook
  • X(Twitter)
댓글 • [27]
모어댄
IP 222.♡.148.132
07-04 2026-07-04 17:54:48 / 수정일: 2026-07-04 17:55:00
·
맥스 사셨어도 곧 나올수있는 울트라를 애플이 AI어나더레벨이라고 소개할텐데, 두배의 두배인데 가격은 그정도는 아니네. 하시면서 후회하실수도요. ㅎㅎ
점돌야옹이
IP 27.♡.11.69
07-05 2026-07-05 11:08:13
·
@모어댄님 차라리 그게 나을지도 모르겠어요 ㅎㅎ... 거기다 보니까 이제는 제가 하는 게임들은 원래 쓰던 데스크탑보다 맥에서 충분히 성능도 잘 나와줘서 바꾸는게 맞을지도 모르겠습니다
구리나자
IP 172.♡.206.33
07-05 2026-07-05 12:53:54
·
@모어댄님 울트라는 HBM이라도 박는건가요
모어댄
IP 222.♡.148.132
07-05 2026-07-05 20:08:30 / 수정일: 2026-07-05 20:17:52
·
@하라쇼님 M5 MAX가 614GB/s고 ULTRA의 예상스펙은 1.2TB/s로 HBM3e 1개스택급이라고 제미나이가 말해주네요.
사실상 개인이 LLM돌릴때 구하기 쉬운 머신중 최고인듯해요.
A2681
IP 104.♡.68.46
07-07 2026-07-07 20:25:07 / 수정일: 2026-07-07 20:25:54
·
@모어댄님 와...울트라가 진짜 말씀해주신 예상 스펙대로 나온다면
드디어 일반 컨슈머용 제품에서 메모리 대역폭이 1T를 넘는 시대가 됐네요
이제는 가격 때문에 "진짜 컨슈머용 제품"이 맞나 싶긴 하지만요,,,
Gomgome
IP 1.♡.141.82
07-04 2026-07-04 20:58:57
·
흠..... 맥스.... 사고 싶은데... 진짜 안드로메다로 보내버린 가격이...ㅜ
어부바
IP 118.♡.129.199
07-05 2026-07-05 13:04:07
·
로컬LLM에선
m4 맥스가 차라리 낫더라고요. m5 맥스와도 큰 차이 안나구요.
점돌야옹이
IP 27.♡.11.69
07-05 2026-07-05 13:52:36
·
@어부바님 M4 맥스도 나쁜건 아닌데 기왕 사는거 원래는 M5맥스가 사고 싶었는데, 하필이면 결제하려고 켜놓고 고민하다가 유튜브에 가격 인상 관련해서 무슨 라이브 방송 켜져있길래 보고 온라인에서 후다닥 샀죠 ㅠㅠ 사실 프로인것도 아쉽지만, 맥스칩에 48짜리도 재고 있었는데 그건 또 램이 너무 적은 것 같아서 고민하다 놓쳤거든요
happyWorld
IP 59.♡.235.26
07-05 2026-07-05 14:47:15
·
max 쓰면 대역폭이 늘어서 좀더 토큰수가 나오겠지만 그렇다고 월등하게 높아지는것도 아니라서 로컬 모델을 맥북에서 사용하는게 한계가 있죠. 그냥 타협하면서 쓰는게 제일 좋다고 봅니다.
점돌야옹이
IP 27.♡.11.69
07-06 2026-07-06 18:33:20
·
@happyWorld님 사실 이것도 맞습니다 ㅠㅠ M6 계열 나오면 그때 바꾸던지 하고 가진것으로 열심히 쓰는 방안으로 최대한 좋게 생각하고 있습니다 ㄷㄷ
타환
IP 221.♡.125.138
07-05 2026-07-05 20:33:45
·
M5 Max여도 30B 대에 dense 아키텍처면... 주관적인 의견이지만, 속도가 기대한것보다 살짝 아쉬운 부분이 있다고 봅니다.
모델이 출력하는 언어가 영어면 그나마 토크나이징이 효율적으로 되어있어서 모델이 문장을 출력하는 실시간에 동시에 제 눈으로 텍스트를 읽을때의 속도가 느리다는 느낌이 비교적 크게 들지 않는 편이었는데, 한글같은 경우 토크나이징이 비효율적인 축에 속하는 편이어서 출력하는 속도가 빠른 편은 아닌 것 같이 느껴졌어요! 또한 속도 챙기려고 또 양자화를 4비트 이하로 내려버리면 답변 품질면에서 아쉬워지구요... 해결하기 어려운 트레이드 오프같아요!
제가 예전에 측정하였던 초당 토큰생성속도 참고하시면 좋을 것 같아서 아래에 기재해봅니다!
Gemma 3 27B(Dense) 4bit : 27.76tok/s
Gemma 4 31B(Dense) 8bit : 14.55tok/s
EXAONE 4.0.1 32B(Dense) 8bit : 15.48tok/s
점돌야옹이
IP 27.♡.11.69
07-06 2026-07-06 18:37:26
·
@타환님

얼추 제가 사용할때 나오는 속도의 거의 딱 두배네요!
젬마 4 31B를 4비트 양자화로 돌리면 13토큰 퍼세컨드 정도 나오는데, 딱 그 두배면 측정 하신 4비트 젬마3와 비슷한 속도니까요.
4비트 양자화가 요즘은 예전보다 많이 좋아진건지, 실생활에 크게 지장이 없는 수준까지 올라와준건 너무 좋은데, Gemma의 활성 파라미터 적은 모델들로 테스트 해서 30-40토큰 정도 나오는걸 보니까 그 정도 속도면 너무 좋겠다~ 싶었던 거예요,
더군다나 저는 거의 영어로 출력을 사용해도 문제가 없어서 더욱 그렇게 와닿더라구요, 초당 13토큰에서는 읽는 속도보다 나오는 속도가 느린데, 저는 제가 읽는 속도보다만 빠르면 되서..요 ㅠㅠ

가진걸로 열심히 벌어서 다음 세대에서는 더욱 업그레이드 기원하며 사용해야겠어요 ^^...ㅠㅠ
joo720
IP 210.♡.59.133
07-05 2026-07-05 23:52:10
·
맥북에선 안돌리는걸로 하시죠
저도 첨에 48기가로 이것저것 돌리다가
GPU 로 돌리는게 합리적이다 라고 결론이...
nvidia 그래픽카드로 돌리면 30b 가 150토큰 이상 나오니깐요
점돌야옹이
IP 27.♡.11.69
07-06 2026-07-06 18:34:04
·
@joo720님 사실 저는 30토큰만 나오면 제가 쓰는 용도에서는 지장이 없어서요, 근데 지금은 13토큰 정도 나오니까, 그 2배가 의미가 크게 다가오더라구요 ㅎㅎ...
야식컵라면
IP 203.♡.3.253
07-06 2026-07-06 15:06:23
·
저도 맥미니(m4 pro) 램 64gb 제품을 구입해서 openclaw 돌리려고 셋팅해봤지만
결국 그냥 매달 3만원씩 내고 claude로 openclaw를 구동시키기는게 정신건강, 시간대비 비용 절감 효과가 있을 것 같아서 로컬 LLM은 포기했습니다.

저야 어차피 openclaw용 llm이니 그렇게 때운다지만,
답변의 퀄리티는 낮아도 되고 답변 시간도 오래 걸려도 무료로 그냥 한없이 기다려도 좋은 작업이라면 로컬에서 돌리는 것을 허용할텐데.

원글 작성자는 속도체감도 중요한 것으로 보아서는 로컬은 그냥 장난감으로 보셔야 하지 않나 이렇게 생각합니다.
점돌야옹이
IP 27.♡.11.69
07-06 2026-07-06 18:39:19
·
@야식컵라면님

속도체감이 중요하긴 합니다만, 사실 제가 생각하는 속도 라는게, 출력된 텍스트가 제 읽기 속도보다만 빠르면 되어서 조금 답답하더라구요, 더군다나 다른 가벼운 모델들로 테스트 해볼때 초당 50토큰 이상은 전혀 체감이 안되는 한계효용의 느낌이어서, 왠지 더 아쉬움이 크게 와닿는 느낌 같습니다. 애시당초 구독용 서비스들도 일부 사용하고 있고, API로도 섞어서 사용하고 있는데, 그 아쉬운 약간의 부분을 로컬로 채워주고 싶었던거여서요~!!
떵이
IP 121.♡.19.188
07-07 2026-07-07 10:48:42
·
개인적인 질문인데요.
맥당 보면 다들 로컬 LLM 돌리시하시던데 이걸 어떻게 활용하시는걸까요?

저는 기껏해봐야 chatgpt, gemini 활용해서 업무를 하는 정도인데
로컬LLM의 목적이 어떤것일까요?
ORI_R
IP 14.♡.228.131
07-07 2026-07-07 13:44:01
·
@떵이님 로컬 LLM 강점은 대략 아래 내용으로 정리가 되는 편입니다.

- 보안
- 토큰 비용 없음
- 오프라인
- 커스텀 가능

사용하시는 GPT, Gemini 에게 한번 질문해보세요. 장/단점을 금방 이해하실 수 있을 겁니다.
떵이
IP 121.♡.19.188
07-08 2026-07-08 09:54:02
·
@ORI_R님 답변 고맙습니다. 검색해보니 자세하게 나오네요. 검색을 생활화하겠습니다. ㅎㅎ
즐거운 하루 보내세요~
joo720
IP 210.♡.59.133
07-08 2026-07-08 11:35:08
·
@떵이님
저희는 35b 12개
122b 4개 켜놓고

앞단에 게이트웨이 하나 만들어둬서 분산 대기 같은 기능들 넣어놓구

회사 파일 자료 테그 달기
이미지분석 같은
사용량 많고,반복작업,작업이 길어지지 않는 답변이 수천토큰에서 끝나는 작업에
해당하는곳에 사용하고 있습니다
6116
IP 106.♡.36.64
07-07 2026-07-07 15:17:06
·
어차피 로컬 정확성은 거기서 거기라 그냥 moe 모델 쓰고 cline으로 codex랑 병행해서 씁니다
꽁시
IP 140.♡.29.2
07-07 2026-07-07 17:42:22
·
저는 m5max 128gb 맥북프로에서 omlx 추론엔진을 사용하고 모델은 moe 아키텍처인 것만 사용하는데 요즘에는 ornith 1.0으로 코딩 작업용으로 사용합니다 질문 한번하면 2-3분 뒤 답변하는데 끈기를 가지고 작업해야 합니다
https://omlx.ai/ 에 보시면 추론엔진 사용자들이 올린 벤치마크 결과가 있으니 참고해보세요
돈이 많으면 클로드가 좋기는 한데 너무 비싸서
초전재
IP 121.♡.153.134
07-10 2026-07-10 17:50:00
·
제가 맥북 프로 M5 MAX 128GB로 로컬 LLM 돌려보려다가, 느린 속도와 맥북 프로의 팬소음으로 좌절을 한 적이 있었습니다. 맥북 프로가 GPU를 쓰기 시작하면 발열로 인한 팬소리가 거슬립니다. 옛날 인텔 맥북 이륙하는 것과 같은 느낌이었어요 -.- 이 일로 깔끔하게 로컬 LLM 포기했습니다.
점돌야옹이
IP 27.♡.11.69
07-11 2026-07-11 17:35:12
·
@초전재님 팬소리 거슬리죠.., 근데 집에 있는 Nvidia 그래픽카드 돌려도 팬 소리는 엄청난건 매한가지라서요.., 메인 데스크탑 PC 안키고 맥북으로 돌리니까 사실 체감이 심하지 않더라구요, 자택 근무다 보니까 그냥 배경 음악 좀 켜두면 되기도 하구요
독립운동가
IP 211.♡.206.49
07-20 2026-07-20 17:50:20
·
이런 후기들 보면 로컬llm을 만족하면서 돌릴려면 M10정도는 나와야 할 듯하고 맥 구입비로 최소 500은 줘야하니.....
점돌야옹이
IP 140.♡.29.3
07-20 2026-07-20 21:50:16 / 수정일: 2026-07-20 21:51:18
·
@독립운동가님 그래도 이전 윈도우 데스크톱 쓸때의 그런 데스크톱 셋업이 맥에서 가능해서, 처음으로 맥으로 완전히 이주 해서 윈도우 없이 거의 한달째 사용중입니다, M1 Pro 시기에만 하더라도 조금 부족한 면들이 느껴졌었는데, 이제는 정말 쾌적해서 좋아요, 다음번에 Max 칩 가면서 램만 늘리면 될 것 같아요 ^^...

게다가 제가 원래 사용하던 윈도우 데스크톱도 당시에 구매할때 500이상 들였던 물건이라서, 그렇게 생각하면 또 맥이 너무 비싼 것 같지는 않네요... ㅜㅜ 별 워크플로우 없는 것 같아도 성능이 조금 내려가면 역체감이 심하게 느껴져요~!
치즈초코
IP 116.♡.177.17
08-28 2026-08-28 13:36:02
·
M5 Pro 307 GB/s 기본형 대비 2배 수준의 버스 폭
M5 Max 460 ~ 614 GB/s 풀칩 기준 M5 Pro의 2배 수준
M5 Ultra 약 1.2 TB/s (1,228 GB/s) Max 다이 2개를 결합해 Max의 2배 대역폭 구현
새로운 댓글이 없습니다.
이미지 최대 업로드 용량 15 MB / 업로드 가능 확장자 jpg,gif,png,jpeg,webp
지나치게 큰 이미지의 크기는 조정될 수 있습니다.
목록으로
글쓰기
글쓰기
목록으로 댓글보기 이전글 다음글
아이디  ·  비밀번호 찾기 회원가입
이용규칙 운영알림판 운영소통 재검토요청 도움말 버그신고
개인정보처리방침 이용약관 책임의 한계와 법적고지 청소년 보호정책
©   •  CLIEN.NET
보안 강화를 위한 이메일 인증
안전한 서비스 이용을 위해 이메일 인증을 완료해 주세요. 현재 회원님은 이메일 인증이 완료되지 않은 상태입니다.
최근 급증하는 해킹 및 도용 시도로부터 계정을 보호하기 위해 인증 절차가 강화되었습니다.

  • 이메일 미인증 시 글쓰기, 댓글 작성 등 게시판 활동이 제한됩니다.
  • 이후 새로운 기기에서 로그인할 때마다 반드시 이메일 인증을 거쳐야 합니다.
  • 2단계 인증 사용 회원도 최초 1회는 반드시 인증하여야 합니다.
  • 개인정보에서도 이메일 인증을 할 수 있습니다.
지금 이메일 인증하기
등록된 이메일 주소를 확인하고 인증번호를 입력하여
인증을 완료해 주세요.