Key Specifications

Vendoralibaba
Version1.5-72b
Release Date2024-02-25
Context Window32768 tokens
Input Modalitiestext
Output Modalitiestext
LicenseQwen License
Documentationhttps://qwenlm.github.io/

Benchmark Performance

BenchmarkScoreUnitEvaluated AtNotesSource
MMLU81.3%2024-02-255-shotview
HUMANEVAL65.2pass@12024-02-25view
GSM8K80.9%2024-02-250-shot CoTview
MATH37.6%2024-02-250-shot CoTview
BBH76.5%2024-02-253-shot CoTview
GPQA39.8%2024-02-250-shotview
IFEVAL76.4%2024-02-25prompt_strictview
ARC92.6%2024-02-25challengeview
MUSR50.8%2024-02-250-shotview
WINOGRANDE83.1%2024-02-250-shotview

Pricing

TierPriceCurrency
Input$0.5 / MtokUSD
Output$0.8 / MtokUSD
Cache Read$0 / MtokUSD
Cache Write$0 / MtokUSD

Source: https://help.aliyun.com/zh/model-studio/getting-started/models · as of 2024-02-25

Compliance

  • Data Residency: CN
  • SOC2: ✗
  • HIPAA: ✗
  • GDPR: ✗
  • ISO 27001: ✗

Qwen1.5 72B

Modellübersicht

阿里巴巴 Qwen1.5 72B 开源模型, 32K 上下文, 中文理解与生成能力突出, 适合企业部署。

Kernspezifikationen

AnbieterVersionVeröffentlichungsdatumKontextfensterEingabemodalitätenAusgabemodalitätenLizenz
Alibaba1.5-72b2024-02-2532KtexttextQwen License

Benchmark-Leistung

BenchmarkErgebnisEinheitNotizen
MMLU (Massive Multitask Language Understanding)81.3%5-shot
HumanEval65.2pass@1
GSM8K (Grade School Math 8K)80.9%0-shot CoT
MATH37.6%0-shot CoT
BBH (BIG-Bench Hard)76.5%3-shot CoT
GPQA39.8%0-shot
IFEval76.4%prompt_strict
ARC92.6%challenge
MUSR50.8%0-shot
WinoGrande83.1%0-shot

Preise

EingabeAusgabeCache-LesenCache-Schreiben

pro Million Token

Stärken

  • MMLU score 81.3, strong knowledge reasoning.

Schwächen

  • 闭源专有模型,不支持自托管。

Anwendungsfälle

  • 通用对话与问答

Referenzen