사용자가 ESP32S3에서 에스프레소 문제 해결을 위한 Q&A 모델 'barista v0.1'을 개발했어요. 모델은 USB를 통해 질문을 받고 OLED 또는 터미널로 답변을 스트리밍합니다.
모델은 레이어별 임베딩과 비대칭 어휘를 사용하여 메모리 사용량을 줄이고 성능을 최적화했어요. 입력 토큰 어휘는 8k+이지만 출력 클래스는 854개로 제한돼 있어요.
모델은 현재 이전 스토리 모델보다 작지만, 더 많은 Q&A 데이터와 더 큰 모델을 테스트할 계획이에요.
GitHub 저장소를 통해 관련 코드를 공개했으며, 모델은 클라우드 연결 없이 오프라인으로 작동합니다.