Pitch · 45M 파라미터 모델로, 14MB 바이너리와 28MB RAM에서 실행되는 초경량 에이전트 LLM입니다. 도구 호출, 기기 사용, 구조화 추출에 특화되어 있으며, Raspberry Pi 5에서 500 tokens/sec 디코딩 속도를 달성합니다.
Community · 커뮤니티는 모델 크기 대비 성능에 놀라워하며, ESP32-S3와 같은 마이크로컨트롤러에서의 실행 가능성에 주목합니다. 일부는 벤치마크의 공정성과 실제 사용 사례에 대한 추가 검증을 요구합니다.