タグ一覧に戻る

効率性

記事数: 2
Nvidia の軽量オープンモデル Nemotron 3.5 Lightning──670 tokens/秒で ChatGPT 同等の性能、エッジ AI 時代へ

Nvidia の軽量オープンモデル Nemotron 3.5 Lightning──670 tokens/秒で ChatGPT 同等の性能、エッジ AI 時代へ

Nvidia が 3.6B パラメータのオープンウェイトモデル Nemotron 3.5 Lightning をリリース。OpenAI の gpt-oss-120b と同等の知能ベンチマークスコアながら、処理速度は 670 tokens/秒で圧倒的に高速。HuggingFace から即座に利用可能。

続きを読む