Benchmark Results
주제 아카이브 • 2 건
AI 생성: 요약은 링크된 출처를 바탕으로 AI가 작성했습니다. AI 활용 방식
2026-10-10
기술
DeepSeek-V4.1-Flash로 구동되는 Lenovo의 TianxiCode 코딩 에이전트는 SWE-bench-Live Lite에서 71%의 검증된 점수를 달성했습니다. 이 성과는 사내 엔터프라이즈 AI 코딩 프레임워크의 중요한 이정표를 나타냅니다.
벤치마크 결과 • Pandaily
퍼머링크
2026-09-28
기술
이 비디오는 Sonnet 5.5와 같은 곧 출시될 모델과 GPT-7 루머를 포함한 최신 AI 모델 뉴스와 DeepSeek V5 및 Qwen 4의 벤치마크 결과를 전달합니다. 빠르게 진화하는 AI 환경에 대해 최신 정보를 유지해야 하는 전문가를 위한 간결한 요약입니다.
AI News • Universe of AI
퍼머링크