HW: 맥미니 M4 32GB (레어템이죠...)
올라마 챗에선 20B 이하들도 잘 굴러가는데 오픈클로에 물리는 순간 대답하는 것조차도 버거운 경우가 대부분입니다.
대화도 어려운데 뭔가 일을 시킨다? 거의 포기하고 살았죠. 문제는 오픈 AI 정책상 막히는 작업들이 있다는 겁니다.
그래서 올라마에서 젬마4-31B-클라우드 모델을 써봤고 오픈 AI가 막은 거 기가막히게 잘 하더군요. (GPT 5.x시절에 만든 자동화 작업 수정을 6부턴 정책상 안 된다고 막아버렸고 이걸 로컬 LLM으로 우회...)
문젠 올라마 클라우드도 유료모델이라 무료 한도 다 차면 한도 초기화될때까지 기다리던가 돈 내야 합니다 ㄷㄷㄷ
그래서 젬마 31B를 LLM으로 올려봤지만..... 클라우드에서 1분도 안 걸리는 거 30분 넘게 진행중이어서…
원문 보기 →