Qwen 3.8 27BがCerebrasで1500トークン/秒で利用可能に
Qwen 3.8 27B available on Cerebras at 1500 tokens/s
inference-docs.cerebras.ai ·
Cerebrasの公開エンドポイントで利用可能なモデルの一覧が紹介されています。Qwen 3.8 27Bが1500トークン/秒という高速な推論速度で提供され、無料トライアルと従量課金の両方で利用できます。モデルの圧縮状態やREAPプルーニングなどの透明性も説明されています。