PANews는 2월 6일 Sina Technology에 따르면, Fei-Fei Li와 스탠포드 대학과 워싱턴 대학의 다른 연구자들이 클라우드 컴퓨팅 수수료 50달러 미만으로 s1이라는 인공지능 추론 모델을 훈련했다고 보도했습니다. 이 모델의 수학 및 코딩 능력 테스트에서의 성과는 OpenAl의 o1과 Depsek의 R1과 같은 최첨단 추론 모델과 유사했으며, 이는 널리 주목을 받았습니다. 그러나 s1 모델은 곧 "처음부터 학습된 것이 아니며" 기본 모델은 "Ali Tongyi Qianwen(Qwen) 모델"이라는 점이 지적되었습니다. 이와 관련하여 기자는 알리바바 클라우드에 확인을 요청했습니다. 알리바바 클라우드는 이 소식을 확인하고 다음과 같이 답했습니다. "그들은 Alitong YiQianwen Qwen2.5-32B-Instruct 오픈소스 모델을 기반으로 26분 동안 16개의 H100 GPU에서 감독 미세 조정을 수행하여 새로운 모델 s1-32B를 학습시켰는데, 이는 OpenAI의 o1 및 DeepSeek의 R1과 같은 최첨단 추론 모델의 수학적 및 코딩 기능과 동일한 결과를 달성했으며, 경쟁 수학 문제에서 o1-preview보다 27% 더 높은 성과를 보였습니다."
알리바바 클라우드, 페이페이 리 팀의 S1 모델이 Qwen 훈련 기반임을 확인
댓글
추천 읽어보기
- 2025-05-17
바이낸스 수익 창출 효과 가이드: BNB 보유자 vs. 알파 포인트 보유자, 수익을 극대화하는 방법은?
- 2025-05-17
주간 추천丨미국-중국 관세 전쟁 완화, 암호화폐 시장 반등 AI 트랙이 선두를 달리고, 밈 출시 플랫폼을 둘러싼 경쟁이 시작된다
- 2025-05-17
바이낸스 알파, 출시 150일: 버블에 대처하는 최고의 솔루션
- 2025-05-16
OpenAI, 클라우드 기반 소프트웨어 엔지니어링 에이전트인 Codex에 대한 연구 미리보기 출시
- 2025-05-16
BSC 재단은 $WOD, $KILO 및 $KOMA를 구입하기 위해 25,000달러를 지출했습니다.
- 2025-05-16
OpenAI: 생방송은 2시간 후에 진행됩니다.