물론 끌린다고 살 수 있는 가격대가 아니라는 게 문제인데요...
올라마에 보면 로컬 LLM을 클라우드로 돌리는 옵션이 있던데 이걸 오픈클로에 물려 쓰니 젬마4 30B인가 하는 녀석도 그럭저럭 쓸만하게 구동되더라고요.
맥미니 M4 32GB: 인사 주고 받는데만 답변 돌아오는데 수분 이상 걸려서 포기
젬마4 클라우드: GPT보다 약간 느린 정도
물론 답변이 빨리 온다와 어느 정도 정확도를 보여주는가는 다른 문자고 젬마4 클라우드도 월 한도가 있는걸로 알아서 매우 제한적인 용도로 쓰는 중이긴 합니다.
근데 로컬아 스물스물 생각나는 이유가요.....
- 지금 GPT 29만원짜리 쓰고 있는데 이거 3년 쓸거라고 계산하면 그냥 맥스튜디오가 나을지도 모르겠고
- 오픈 AI가 정책상 틀어막는 기능들이 간혹가다 튀어나오는데 결국 오픈 AI가 기능을 막는다는 거 자체가 짜증나네요.
문제는 맥 스튜디오 들여놔도 지금 올라마 클라우드 버전과 어느 정도 스피드 차이가 있을지 장담을 못하겠다는 문제가 하나 있고 설령로컬로 돌리더라도 GPT 유료를 완전히 끊을 수 없다는 문제 정도겠네요....
M5 울트라가 올라마에서 클라우드 올린 젬마 4 정도의 구동속도가 나온다면 진지하게 고민해봐야겠습니다 ㄷㄷ (DGX 스파크도...)
겨우 저정도 모델 돌리려고 울트라 사는건 너무 무의미한 행동같네요.
올라마 클라우드 로컬 llm들은 이런 딜레이가 거의 없어서 고성능 로컬이 필요한 건 아닐까 하는 생각을 해봤고요 ㄷㄷㄷ
Hw 성능이 올라가면 파라미터값도 그에 걸맞게 올릴 수가 있죠 ㅋㅋ
1. 공개되는 로컬 모델들도 성능이 올라가고
2. Gpt의 경우 가격이 낮아지고 있고
3. 이 두 가지를 섞을 경우 코딩은 gpt가, 매니지먼트는 로컬로 이원화시키면 어떨까?
가 생각의 출발점입니다 ㄷㄷ
뤱 db를 긁어와서 헤르메스가 sql lite, ftffs인가 하는 걸로 20gb 정도 내부 db 구축해서 꺼내 쓰고 있는데 풀 로컬로 돌리면 어떨까? 하는 생각이죠 ㄷㄷ
저는 마음은 m5u 512 사고 싶었으나 256이 구매했네요
...라고 생각하며 저는 m5 max 맥스튜디오를 샀습니다만...