AIの鬼
#新モデル Zenn AI

Qwen 35Bの品質を7つの質問で採点したら、GPT-4に勝てるのは3領域だけだった

Qwen 35Bの品質を7つの質問で採点したら、GPT-4に勝てるのは3領域だけだった(内容を表す図ではないイメージ画像)
イメージ

ローカル LLM は所詮遊びだと思って、3ヶ月ほど RTX 4070 のフォルダを放置していました。家庭用 GPU で 35B クラスを動かせても、どうせ品質は API の GPT-4 に完敗するのだろう。そう決めつけて、ベンチ計測もサボっていたのが正直なところです。 でも、勝ち構成を作った勢いで 7 つの質問を投げてみたら、話が少し変わりました。 「賢いモデルほど広く使える」という常識の外で、Qwen 35B がはっきり刺さる領域が確実にあったのです。今日はその 7 項目採点の結果を、勝敗マップとしてまとめて共有します。なお、Dev.to 側では別記事で KV cache 最適化による...

出典: Zenn AI(配信元の紹介文より引用)
御社でもAIを使ってみませんか
まずはここから 御社でもAIを使ってみませんか? 御社の実際の業務を題材に、AIで何ができるかを一緒に考えます。 「ChatGPTの使い方」を教えるだけの研修ではありません。 AI研修・AI活用相談 →