Qwen 35Bの品質を7つの質問で採点したら、GPT-4に勝てるのは3領域だけだった
ローカル LLM は所詮遊びだと思って、3ヶ月ほど RTX 4070 のフォルダを放置していました。家庭用 GPU で 35B クラスを動かせても、どうせ品質は API の GPT-4 に完敗するのだろう。そう決めつけて、ベンチ計測もサボっていたのが正直なところです。 でも、勝ち構成を作った勢いで 7 つの質問を投げてみたら、話が少し変わりました。 「賢いモデルほど広く使える」という常識の外で、Qwen 35B がはっきり刺さる領域が確実にあったのです。今日はその 7 項目採点の結果を、勝敗マップとしてまとめて共有します。なお、Dev.to 側では別記事で KV cache 最適化による...
出典: Zenn AI(配信元の紹介文より引用)
このニュースの全文は、配信元でお読みいただけます。 Zenn AIで元記事を読む →


