Recent Posts

토큰 효율의 시대: MAI가 그리는 새로운 프론티어 성능 곡선

‘토큰맥싱’의 시대가 지나고 토큰 효율이 다음 화두가 됐습니다. Microsoft AI는 모델·하네스·RL 환경을 함께 최적화해 GPU 비용을 50~90%까지 줄이면서 품질을 유지하는 사례를 공개했습니다. 코딩·이미지·음성·전사·보안 전반의 실제 수치를 정리했습니다.

GCC-M에도 커스텀 엔진 에이전트가 열린다

지금까지 상용 클라우드 중심이던 커스텀 엔진 에이전트(Custom Engine Agents)가 GCC-M 환경 사용자에게도 제공됩니다. 규제 환경에서 AI 에이전트 활용 범위가 넓어진다는 신호입니다.