The standard in AI Quality
와이즈스톤은 다양한 산업의 AI를 검증하며 품질의 기준을 만들어갑니다.
WISESTONE
와이즈스톤은 1,352건의 AI 시험을 수행하며 AI 검증 기준을 만들어가고 있습니다.
추론/수학
811건
언어
127건
이미지/비전
122건
특화도메인
95건
로보틱스/물리
4건
AI 에이전트
34건
음성
1건
기타
121건
추론/수학 (Reasoning)
수학 | 예측 | 코드 | 소프트웨어
주요지표 : RMSE, MAE, GPQA, SWE-bench, 정상동작률
언어 (Language)
언어이해 | 생성 | RAG | 검색증강 | 정보추출 | OCR
주요지표 : MMLU, Chatbot Arena, ROUGE, BLEU, 검색 정확도, Recall@K F1, CER, WER
이미지/비디오 (Vision)
이미지 분류 | 객체검출 | 이미지생성 | 품질 | 세그멘테이션
주요지표 : mAP, IoU, Accuracy, SSIM, PSNR, FID, CMMD, CLIP Score, Dice, IoU
특화도메인 (Specialized)
의료 · 금융 · 법률 · 제조 · 건설 · 보안
주요지표 : 도메인별 전문 벤치마크
로보틱스/물리 (Robotics)
3D | AR·VR·XR | 자율주행 | 측위
주요지표 : RMSE(위치), NeRF 품질, mAP, 충돌회피율
AI 에이전트 (Agents)
추천 시스템 | 이상 탐지 | 예측
주요지표 : NDCG, Precision@K, AUC, F1, Recall
음성 (Speech)
STT | TTS | 화자인식
주요지표 : WER, CER, MOS
the future.