ニュース › Hugging Face #新モデル Hugging Face 2025年11月19日 Apriel-H1、効率的な推論モデル蒸留の鍵となる手法 イメージ このニュースの全文は、配信元でお読みいただけます。 Hugging Faceで元記事を読む → 編集部の実践記録から 当社が自社の業務でAIを動かし、処理件数・所要時間・失敗件数まで 実際に測った記録です。 AI解体新書 AIに詳しい人の2025年予測は、どこが当たりどこが外れたのか(SWE-Bench 予測88%に対し実績80.9%) AI Digestが集めた421名の予測を、2026年1月に答え合わせした調査です。コーディング系ベンチマークは唯一の過大予測、セキュリティ系と業界売上は大幅な過小評価でした。自己選択サンプルという限界も含めて、中小企業の計画づくりにどう使えるかを整理します。 続きを読む → AI解体新書 ベンチマークの順位差は何を示すのか──39ベンチマークの分散の約半分が単一軸で説明できるという分析 Epoch AIが2023年以降に作られた39ベンチマークを主成分分析したところ、分散の約半分が第1主成分(総合力)で説明でき、各ベンチマークの重みは0.19〜0.30に収まりました。「このベンチマークで1位」という宣伝文句が自社のツール選定にどこまで使えるのかを、限界も含めて整理します。 続きを読む → AI解体新書 自社サイトの4.2%はAIボット、6.2%は遮断対象——2025年のインターネットで何が起きていたのか? Cloudflareが2025年1月1日から12月2日までの自社ネットワーク実測をまとめた。HTMLリクエストの4.2%がAIボット、Googlebot単独では4.5%、全トラフィックの6.2%が緩和対象で3.3%がDDoS対策とWAFで遮断。中小企業のサイト運用に直結する数字を、母集団の偏りと発信元の利害ごと読む。 続きを読む →
AI解体新書 AIに詳しい人の2025年予測は、どこが当たりどこが外れたのか(SWE-Bench 予測88%に対し実績80.9%) AI Digestが集めた421名の予測を、2026年1月に答え合わせした調査です。コーディング系ベンチマークは唯一の過大予測、セキュリティ系と業界売上は大幅な過小評価でした。自己選択サンプルという限界も含めて、中小企業の計画づくりにどう使えるかを整理します。 続きを読む →
AI解体新書 ベンチマークの順位差は何を示すのか──39ベンチマークの分散の約半分が単一軸で説明できるという分析 Epoch AIが2023年以降に作られた39ベンチマークを主成分分析したところ、分散の約半分が第1主成分(総合力)で説明でき、各ベンチマークの重みは0.19〜0.30に収まりました。「このベンチマークで1位」という宣伝文句が自社のツール選定にどこまで使えるのかを、限界も含めて整理します。 続きを読む →
AI解体新書 自社サイトの4.2%はAIボット、6.2%は遮断対象——2025年のインターネットで何が起きていたのか? Cloudflareが2025年1月1日から12月2日までの自社ネットワーク実測をまとめた。HTMLリクエストの4.2%がAIボット、Googlebot単独では4.5%、全トラフィックの6.2%が緩和対象で3.3%がDDoS対策とWAFで遮断。中小企業のサイト運用に直結する数字を、母集団の偏りと発信元の利害ごと読む。 続きを読む →