Skip to content

Model Launch

주제 아카이브5

AI 생성: 요약은 링크된 출처를 바탕으로 AI가 작성했습니다. AI 활용 방식

홈으로 돌아가기GEO summary endpoint

2026-09-22

기술

  • Qualcomm이 300억 파라미터 혼합 전문가 모델을 기기 내에서 직접 실행할 수 있는 두 개의 새로운 스마트폰 프로세서를 출시했습니다. 이러한 발전은 로컬 AI 추론으로의 전환을 가속화하여 모바일 애플리케이션의 지연 시간과 클라우드 의존도를 줄입니다.

    엣지 컴퓨팅TechCrunch AI

    퍼머링크
  • OpenAI는 GPT-6 Sol과 Luna를 출시하고, 더 낮은 운영 비용과 감소된 오류율을 주장하며 Astra 모델과 함께 포지셔닝했습니다. 이번 출시는 OpenAI의 최신 세대를 더 접근 가능한 가격대로 확장하여 상용 API 시장에서의 경쟁을 심화시킵니다.

    모델 출시TechCrunch AI

    퍼머링크
  • Anthropic은 Opus 5.5를 소개하며 Fable 등급 모델과 비교 가능한 성능을 제공하면서도 상당히 낮은 가격을 제공한다고 밝혔습니다. 이번 출시는 프론티어 모델 경쟁이 엔터프라이즈 워크로드에 맞춘 비용 효율적이고 고성능 배치로 전환되는 흐름을 계속합니다.

    모델 출시TechCrunch AI

    퍼머링크

2026-09-18

기술

  • Zhipu AI는 GLM-5.3-FlashX를 출시하면서 약 100,000개의 국내 가속기에서 초당 약 200토큰 추론을 달성한다고 주장한다. 기본 Flash 모델은 18B 활성 파라미터를 가진 320B MoE이며, Infra Agent 서빙 스택으로 최적화되었다.

    모델 출시Pandaily

    퍼머링크

2026-09-19

투자

  • BABA

    Alibaba의 Qwen 팀은 Qwen3.8-Omni-Flash를 출시했다. 이는 텍스트/이미지/오디오/비디오를 기본 지원하는 네이티브 모델로, 1M 컨텍스트와 Omni-Plus 대비 평균 약 26%의 성능 향상을 제공한다. 이번 출시에는 오픈된 Qwen-Live Harness와 대폭적인 API 오디오 가격 인하가 포함된다.

    퍼머링크