Nvidia の軽量オープンモデル Nemotron 3.5 Lightning──670 tokens/秒で ChatGPT 同等の性能、エッジ AI 時代へ
Nvidia が 3.6B パラメータのオープンウェイトモデル Nemotron 3.5 Lightning をリリース。OpenAI の gpt-oss-120b と同等の知能ベンチマークスコアながら、処理速度は 670 tokens/秒で圧倒的に高速。HuggingFace から即座に利用可能。
続きを読むNvidia が 3.6B パラメータのオープンウェイトモデル Nemotron 3.5 Lightning をリリース。OpenAI の gpt-oss-120b と同等の知能ベンチマークスコアながら、処理速度は 670 tokens/秒で圧倒的に高速。HuggingFace から即座に利用可能。
続きを読むPoolsideが発表した Laguna S 2.1 は118億パラメータの混合エキスパート構造で、思考モード導入により大規模モデルを上回るコーディング性能を実現。低コストで企業が実用できる効率性が特徴です。
続きを読む