cuda.fast가 문을 열었습니다.
🟢첫 챌린지는 Qwen 3.8 Flash Next를 NVIDIA와 Apple에서 각각 더 빠르게 돌리는 것입니다.
🟢두 트랙의 성적은 하나의 그래프에 함께 올립니다.
🖥 두 개의 트랙
· cuda.fast — DGX Spark 1대, 시작 속도 초당 17~18토큰
· mlx.fast — 128GB M5 맥북 1대, 시작 속도 초당 35~36토큰
📐 채점 방식
🟢 정확성 검사를 통과한 뒤, 같은 머신의 레퍼런스 엔진보다 빨라야 합니다
🟢 프롬프트 처리(prefill) 25%, 토큰 생성(decode) 75%의 기하평균으로 점수를 냅니다
🗓 마감
제출은 9월 24일에 마감됩니다
🙌 두 엔진을 만들어 준 TheDavidTai와 GumbiiDigital에게 감사드립니다.
👉cuda.fast 바로가기
🔗 공지 원문 보기
