오픈AI, 실제 프리랜서 코딩 과제 기반 AI 성능 평가 기준 'SWE-Lancer' 출시

[핵심요약]
- 업워크 플랫폼의 실제 프리랜서 코딩 과제 1,400개 포함
- 총 100만 달러 규모의 과제 데이터 수집
- 과제 범위: $50 버그 수정부터 $32K 기능 구현까지
- UI/UX, 시스템 설계 등 다양한 분야 포함
- 도커 이미지와 'SWE-Lancer Diamond' 공개 평가 세트 제공

[한줄요약]
오픈AI가 실제 프리랜서 코딩 과제를 기반으로 한 AI 코딩 성능 평가 기준 'SWE-Lancer'를 출시하며 소프트웨어 개발 분야 AI 역량 측정 도구 제공

제미니
[핵심 요약]
* OpenAI는 AI 코딩 성능 평가를 위한 새로운 벤치마크인 SWE-Lancer를 출시했습니다.
* SWE-Lancer는 Upwork에서 수집한 1,400개의 실제 프리랜서 코딩 과제를 포함하고 있으며, 총 100만 달러 상당의 보상이 걸린 과제들로 구성되어 있습니다.
* 과제는 버그 수정($50)에서부터 기능 구현($32,000)까지 다양하며, UI/UX 디자인에서 시스템 설계에 이르기까지 광범위한 분야를 다룹니다.
* OpenAI는 SWE-Lancer가 소프트웨어 엔지니어링에서 AI의 역할을 평가하는 데 중요한 기준이 될 것이라고 밝혔습니다.
* 이 프로젝트는 오픈 소스 Docker 이미지와 공개 평가 세트인 SWE-Lancer Diamond를 포함합니다.
[한줄 요약]
OpenAI, 실제 프리랜서 코딩 과제 기반 AI 코딩 성능 평가 기준 "SWE-Lancer" 출시.

- dc official App