Wei는 Yaps 기술로 구동되는 셀프 서비스 AI 에이전트 플랫폼입니다. 직관적인 채팅 인터페이스를 제공하여 사용자는 Wei에게 메시지 초안, 보고서 요약, 브레인스토밍 아이디어 생성, 캘린더 관리, 텍스트에서 핵심 인사이트 추출을 요청할 수 있습니다. 기억 기능을 갖추어 대화 맥락을 기억하고 다단계 지시를 따를 수 있어 전문가들이 커뮤니케이션과 연구 업무를 효율화하는 데 도움을 줍니다.
Text-to-Reward는 텍스트 기반 작업 설명 또는 피드백을 RL 에이전트의 스칼라 보상 값으로 매핑하는 보상 모델을 훈련하는 파이프라인을 제공합니다. 트랜스포머 기반 아키텍처와 수집된 인간 선호 데이터로 미세 조정하여 자연어 지시문을 보상 신호로 해석하는 방식을 자동으로 학습합니다. 사용자는 텍스트 프롬프트를 통해 임의의 작업 정의가 가능하며, 모델을 훈련시키고 학습된 보상 함수를 어떤 RL 알고리즘에든 통합할 수 있습니다. 이 방식은 수작업 보상 설계를 제거하고 샘플 효율성을 향상시키며, 에이전트가 복잡한 다단계 지시를 따라가도록 지원합니다.