OpenAI, 복잡한 작업을 위한 가장 스마트한 모델 GPT-4.1 발표

OpenAI는 공식적으로 GPT-4.1, GPT-4.1 mini, GPT-4.1 nano라는 세 가지 새로운 모델을 출시했습니다. 이러한 모델은 최대 100만 개의 토큰에 달하는 대규모 컨텍스트 처리 기능과 2024년 6월까지 업데이트된 지식 한도를 갖추고 있습니다.

이 회사는 이 모델이 지난 7월에 출시되어 최근 업데이트된 GPT-4o와 GPT-4o 미니보다 성능이 뛰어나다고 밝혔습니다. 현재 GPT-4.1은 API를 통해서만 제공되므로 아직은 ChatGPT에서 직접 사용할 수 없습니다.

OpenAI는 GPT-4.1은 API를 통해서만 사용할 수 있다고 밝혔습니다. ChatGPT에서는 명령어 준수, 프로그래밍, 인텔리전스 측면에서 많은 개선 사항이 최신 버전의 GPT-4o에 점진적으로 통합되었으며, 회사는 향후 릴리스에서 더 많은 기능을 추가할 예정입니다.

OpenAI, 복잡한 작업을 위한 가장 스마트한 모델 GPT-4.1 발표

벤치마크 결과는 GPT-4.1이 놀라운 개선을 가져왔음을 보여줍니다. 이 모델은 SWE-bench Verified에서 54.6%의 점수를 받았으며, 이는 GPT-4o보다 21.4포인트 증가한 수치입니다. 이 모델은 가이드라인 준수를 측정하는 벤치마크인 MultiChallenge에서 38.3%의 점수를 받았고, 모델이 자막 없이 최대 1시간 길이의 비디오를 분석하는 Video-MME 벤치마크에서 72.0%의 점수를 받아 장편 비디오 이해도에서 새로운 기록을 세웠습니다.

OpenAI는 또한 알파 파트너와 협력하여 실제 사용 사례에서 GPT-4.1의 성능을 테스트했습니다.

  • Thomson Reuters는 자사의 법률 AI 지원 서비스인 CoCounsel을 통해 GPT-4.1을 테스트했습니다. GPT-4o와 비교했을 때 GPT-4.1은 다중 문서 평가에서 정확도가 17% 향상되었습니다. 이러한 유형의 작업은 여러 소스에서 맥락을 추적하고 상충되는 용어나 숨겨진 종속성과 같은 복잡한 관계를 식별하는 능력에 크게 의존하며, GPT-4.1은 지속적으로 강력한 성능을 입증했습니다.
  • Carlyle은 GPT-4.1을 사용하여 Excel 및 PDF 파일을 포함한 길고 복잡한 문서에서 재무 데이터를 추출했습니다. 회사 내부 벤치마크에 따르면, 이 모델은 문서 검색 측면에서 이전 모델보다 50% 더 나은 성능을 보였습니다. 이 모델은 "건초더미에서 바늘 찾기", 문서 중간에서 정보 손실, 여러 파일에 걸쳐 정보를 연결해야 하는 인수 등의 문제를 안정적으로 처리하는 최초의 모델입니다.

성능도 중요하지만, 속도도 마찬가지로 중요합니다. OpenAI에 따르면 GPT-4.1은 128,000개의 토큰을 처리할 때 약 15초 만에 첫 번째 토큰을 반환하고, 100만 개의 토큰을 처리할 때는 최대 30초가 걸린다고 합니다. GPT-4.1 미니와 나노는 더 빠릅니다.

GPT-4.1 nano는 일반적으로 128,000개의 입력 토큰이 있는 프롬프트에 5초 이내에 응답합니다. 즉각적인 캐싱을 통해 비용을 절감하는 동시에 지연 시간을 더욱 줄일 수 있습니다.

이미지 이해도 상당한 진전을 이루었습니다. 특히, GPT-4.1 mini는 다양한 시각적 벤치마크에서 GPT-4o보다 우수한 성능을 보입니다.

  • MMMU (그래프, 다이어그램, 지도 포함) 에서 GPT-4.1 mini는 73%를 기록했습니다. 이는 GPT-4.5보다 높고 GPT-4o mini의 56%를 훨씬 넘어섭니다.
  • MathVista (이미지 문제 해결 능력을 테스트하는 기관) 에서는 GPT-4.1과 GPT-4.1 mini 모두 57%의 성적을 기록했는데, 이는 GPT-4o mini의 37%를 훨씬 뛰어넘는 수치입니다.
  • 과학적 그래프를 기반으로 모델이 질문에 답하는 CharXiv-Reasoning 에서는 GPT-4.1이 계속해서 선두를 달리고 있습니다.
  • Video-MME (자막 없는 긴 영상) 에서 GPT-4.1은 72%를 달성했는데, 이는 GPT-4o의 65%에 비해 상당히 개선된 수치입니다.

가격에 관하여:

  • GPT-4.1의 비용은 100만 개의 토큰 입력당 2달러, 출력당 8달러입니다.
  • GPT-4.1 mini의 입력 가격은 0.40달러, 출력 가격은 1.60달러입니다.
  • GPT-4.1 nano의 입력 비용은 $0.10, 출력 비용은 $0.40입니다.

프롬프트 캐싱이나 배치 API를 사용하면 이러한 비용을 더욱 줄일 수 있으며, 이는 대규모 애플리케이션에 매우 유용합니다. OpenAI는 또한 GPT-4.1의 더 나은 성능, 낮은 지연 시간, 낮은 비용을 이유로 2025년 7월 14일에 GPT-4.5 Preview에 대한 지원을 중단할 준비를 하고 있습니다.

댓글 남기기

청주에서 에어컨 버리는 방법: 무상수거부터 대형폐기물 신고까지

청주에서 에어컨 버리는 방법: 무상수거부터 대형폐기물 신고까지

청주에서 에어컨을 버릴 때 판매처 회수, 1599-0903 폐가전 무상방문수거, 청주시 대형폐기물 신고 중 맞는 방법과 철거·배출 주의사항을 정리했습니다.

부천에서 스마트폰 버리는 방법: 개인정보 삭제부터 소형폐가전 수거함까지

부천에서 스마트폰 버리는 방법: 개인정보 삭제부터 소형폐가전 수거함까지

부천에서 오래된 스마트폰을 안전하게 버리는 방법을 정리했습니다. 백업, SIM·메모리카드 제거, 계정 해제와 초기화, 소형폐가전 수거함 배출, 배터리 이상 시 주의사항까지 공식 안내를 기준으로 확인하세요.

안산에서 형광등 버리는 방법: 깨지지 않은 등과 깨진 등, 이렇게 구분하세요

안산에서 형광등 버리는 방법: 깨지지 않은 등과 깨진 등, 이렇게 구분하세요

안산시 공식 기준에 따라 폐형광등을 안전하게 버리는 방법을 정리했습니다. 전용수거함 배출, 파손 시 종량제봉투 처리, 공동주택 확인법과 배출 전 점검 기준까지 확인하세요.

평택에서 폐건전지 버리는 방법: 수거함 찾기부터 안전 배출까지

평택에서 폐건전지 버리는 방법: 수거함 찾기부터 안전 배출까지

평택에서 폐건전지를 버리는 순서와 가까운 전용 수거함 찾는 법을 안내합니다. 건전지 분리·보관, 손상된 리튬전지 주의사항, 교환 여부 확인법도 살펴보세요.

서울에서 부탄가스통 버리는 방법: 잔량 확인부터 캔류 배출까지

서울에서 부탄가스통 버리는 방법: 잔량 확인부터 캔류 배출까지

서울에서 부탄가스통을 버리는 방법을 정리했습니다. 완전 소진 여부, 구멍을 뚫기 전 안전 확인, 캔류 배출과 자치구별 문의 방법을 안내합니다.

서울에서 냉장고 버리는 방법: 무료 방문수거·새 제품 회수·구청 신고 비교

서울에서 냉장고 버리는 방법: 무료 방문수거·새 제품 회수·구청 신고 비교

서울에서 냉장고를 버리는 방법을 비교합니다. 무상방문수거 예약, 새 냉장고 구매 시 회수, 구청 대형폐기물 신고의 조건과 준비 사항을 확인하세요.

평택에서 형광등 버리는 방법: 전용 수거함 확인과 안전한 배출 요령

평택에서 형광등 버리는 방법: 전용 수거함 확인과 안전한 배출 요령

평택에서 폐형광등을 버리는 방법을 정리했습니다. 아파트 수거함과 행정복지센터 확인법, 안전한 포장, 깨진 형광등과 LED 구분까지 안내합니다.

안양에서 폐건전지 버리는 방법: 수거함 위치 확인부터 안전한 배출까지

안양에서 폐건전지 버리는 방법: 수거함 위치 확인부터 안전한 배출까지

안양에서 폐건전지를 올바르게 버리는 방법을 정리했습니다. 단독주택·공동주택 배출처, 전용수거함 이용법, 내장형 배터리 제품 구분과 화재 예방 주의사항을 확인하세요.

부산에서 자전거 버리는 방법: 재사용, 대형폐기물 신고와 비용 비교

부산에서 자전거 버리는 방법: 재사용, 대형폐기물 신고와 비용 비교

부산에서 자전거 버리는 방법을 비교합니다. 판매·나눔과 대형폐기물 신고, 구·군별 수수료, 온라인·전화 접수, 배출 전 체크리스트를 확인하세요.

고양에서 폐건전지 버리는 방법: 수거함 위치와 안전한 분리배출

고양에서 폐건전지 버리는 방법: 수거함 위치와 안전한 분리배출

고양에서 폐건전지를 버릴 때 수거함을 찾는 순서와 일반 건전지, 보조배터리, 부푼 리튬 배터리의 안전한 배출 방법을 정리했습니다.