뉴스
-
[위클리AI] 오픈AI·앤트로픽·메타, 전략 다변화로 경쟁 새 국면
유료 사용자에게는 답변 품질을 끌어올린 GPT-5.6 솔(GPT-5.6 Sol)을, 무료 사용자에게는 텍스트 대화 무제한이라는 파격적인 혜택을 담은 GPT-5.6 루나(GPT-5.6 프리(Free)와 고(Go) 사용자의 기본 모델을 GPT-5.6 루나로 전환하는 것은 이번주,
www.donga.com · 2026.08.11
-
오픈AI, 계산생물학 벤치마크 '진벤치-프로' 공개…최고 모델도 정답률 32%
-5.6 Sol Pro가 정답률 31.5%, GPT-5.6 Sol이 28.7%를 기록했다. 언뜻 보면 낮은 수치 같지만 GPT 계열 외 가장 강한 모델인 클로드 오퍼스 4.8은 16.0%에 그쳤다.
zdnet.co.kr · 2026.07.02
-
AI 에이전트 '딥코드', 클로드 정면 겨냥
V4 정식판, 코딩 능력 GPT-5.6 Sol급, 가격은 Fable 5 대비 178분의 1
DeepSeek V4 시리즈는 플래그십 버전 Pro(총 파라미터 1.6조, 활성 파라미터 일부 테스터는 특정 테스트, 예를 들어 게임 코드 생성에서 V4가 Fable 5와 GPT-5.6을 능가했다는 더 과감한 평가도 내놓고 있습니다.
www.ohmynews.com · 2026.07.21
-
SK쉴더스, AI 레드팀 해킹대회 ‘Judgement Day’ 1위
GPT-5.4, Gemini 3.1 Pro, Claude Opus 4.6 등 최신 AI 모델 기반으로 실제 산업 시나리오를 적용해 운영됐으며, 글로벌 보안 조직과 AI 기업, 연구기관
zdnet.co.kr · 2026.06.15
-
[안광섭 AI 진테제] 독파모 2차평가 눈앞...무엇을 '평가' 해야 하나
업스테이지는 한국어 벤치마크에서 폐쇄형 모델을 앞섰다고 밝혔는데, 그 대상은 'GPT-5.4 미니'와 '클로드 하이쿠 4.5'였다. 둘 다 각 사의 경량·저가 라인이다. 78.9점• GLM-5.1의 CLIcK: SK텔레콤 88.8점, LG 88.7점• GLM-5.1의 KMMLU-Pro: SK텔레콤 76.5점, LG 75.8점• 큐원3.5의 KMMLU-Pro
zdnet.co.kr · 2026.08.10