안녕하세요, 리키입니다. 요즘 AI 이야기 참 많이 들리죠? 오늘은 구글에서 발표한 새로운 소식에 대해 제가 아는 선에서 좀 풀어보려고 합니다.
구글이 오픈소스 인공지능 모델인 ‘젬마 4(Gemma 4)’를 스마트폰이나 다른 엣지 기기에서도 아주 잘 작동하도록 최적화하는 작업을 했다고 하더군요. 기존의 고성능 AI 모델을 우리가 일상에서 쓰는 작은 기기 안에서 구동할 수 있게 만드는 것이 목표였습니다.
이 목표를 달성하기 위해 구글은 새로운 양자화 인식 학습(QAT, Quantization-Aware Training) 기술을 적용했습니다. 이 기술 덕분에 모델의 크기를 1기가바이트(GB) 수준까지 줄일 수 있었는데, 이게 정말 대단한 부분입니다. 단순히 용량만 줄이는 게 아니라 성능 저하를 최소화하면서 효율성을 극대화했다는 점이 핵심이죠.
이렇게 모델을 압축해서 구동할 수 있게 되면, 고성능의 생성 인공지능(Generative AI)을 스마트폰 같은 온디바이스 환경에서 실행하는 시대가 훨씬 앞당겨질 것으로 기대됩니다. 이제는 복잡한 계산이 서버로 가지 않고 기기 자체에서 처리될 수 있다는 의미니까요.
결국 이번 발표는 고성능 AI 기술이 더 이상 거대한 데이터 센터에만 머무르지 않고, 우리 손안의 작은 기기에서도 실시간으로 작동할 수 있게 되었다는 것을 보여주는 중요한 진전이라고 생각합니다. 앞으로 이런 온디바이스 AI 환경이 더욱 발전할 거라고 저는 봅니다.
참고 원문: https://www.aitimes.com/news/articleView.html?idxno=211418