애플 실리콘 맥에서 젬마 4 26B를 램 2GB로 돌리는 오픈소스 엔진 등장
TurboFieldfare는 Gemma 4 26B-A4B 모델을 애플 실리콘 맥에서 약 2GB 메모리로 실행하는 Swift와 Metal 기반 런타임이다. 전체 14.3GB 모델을 메모리에 올리지 않고 공유 코어와 KV 캐시만 유지한 뒤, 토큰마다 필요한 전문가 가중치만 SSD에서 스트리밍하는 방식이 핵심이다.
- 1
Gemma 4 26B-A4B를 약 2GB 메모리 예산으로 실행
- 2
8GB M2 맥북 에어에서 5.1-6.3토큰/초 측정
- 3
24GB M5 Pro에서 31-35토큰/초 측정
- 4
모델 전체 14.3GB를 메모리에 올리지 않고 필요한 전문가 가중치만 SSD에서 스트리밍
- 5
Swift, Metal, SwiftUI, AppKit으로 맥 앱, CLI, OpenAI 호환 로컬 서버 제공
온디바이스 LLM의 병목이 “연산”만이 아니라 “가중치를 어디에 두고 언제 가져오느냐”라는 걸 잘 보여주는 프로젝트다. 실사용 제품이라기보다 연구성 해킹에 가깝지만, 8GB 맥에서 26B급 MoE 모델을 굴리는 설계 자체가 꽤 공유각임.
관련 기사
앤드루 응, 1대1 AI 학습 회사 ‘런벡터’ 시작
앤드루 응이 AI 기반 1대1 학습 경험을 만들겠다며 런벡터를 공개했어. 단순 챗봇이 답을 대신 주는 방식이 아니라, 학습 경로를 같이 짜고 개인별 이해도에 맞춰 끝까지 따라붙는 튜터를 목표로 함.
부산대, AWS·엔비디아·네이버와 실전형 AI 인재 키우는 부트캠프 운영
부산대가 AWS 코리아, 엔비디아, 네이버커넥트재단과 함께 여름계절학기 AI 부트캠프를 운영했음. 100여 명의 학생이 24개 팀으로 참여해 클라우드 배포, 딥러닝, 생성형 AI 서비스 구현, 데모데이 기술 검증까지 경험했음.
제주 소형 AI 데이터센터부터 동물병원 AI 리포트까지, 국내 클라우드 업계 소식 모음
과기정통부와 NIPA가 제주 소형 AI 데이터센터 구축 과제를 선정했고, 인투CNS는 동물병원 진료 대화를 AI 리포트로 바꾸는 기술 특허를 등록했어. 포티투마루는 생성AI 인재 양성 사업 성과를 공유하며 산학 연계 사례를 내놓을 예정이야.
SK텔레콤, 6880억 파라미터 독자 AI 모델 A.X K2 공개
SK텔레콤이 독자 AI 파운데이션 모델 A.X K2를 허깅페이스에 공개했다. 작년 A.X K1보다 추론 성능을 크게 끌어올렸고, 제조·국방·바이오·게임 같은 실제 적용 사례도 같이 밀고 있다.
BC카드, 금융권 AI 플랫폼 BCGPT WebUI 오픈소스로 공개
BC카드가 자체 개발한 AI 통합 플랫폼 BCGPT WebUI를 오픈소스로 공개했다. 문서 검색, 질의응답, 콘텐츠 생성 기능을 제공하며, 금융권 핵심 AI 플랫폼을 오픈소스로 공개한 첫 사례라고 설명했다.
댓글
댓글
댓글을 불러오는 중...