ニュース › Hugging Face Hugging Face 2026年4月15日 Meet HoloTab by HCompany. Your AI browser companion. イメージ このニュースの全文は、配信元でお読みいただけます。 Hugging Faceで元記事を読む → 編集部の実践記録から 当社が自社の業務でAIを動かし、処理件数・所要時間・失敗件数まで 実際に測った記録です。 AI解体新書 情シスの仕事はAIでどこまで速くなるのか ― 181名のランダム化比較試験が示した「効く業務」と「25%遅くなる業務」 Microsoftが181名を対象に行ったランダム化比較試験で、情シス業務の正答精度は平均34.53%改善しました。ただし効いたのは自由記述型の作業で、多肢選択型は精度が有意に上がらず所要時間は25.13%増えています。発信元が製品提供者本人である点も含め、業務単位の線引きを整理します。 続きを読む → AI解体新書 安いから中国製モデル、は成立するのか? 米国政府機関の実測でGPT-5-miniが平均35%安かった 米国商務省NIST傘下のCAISIがDeepSeekの各モデルを実測しました。同等性能に要した費用はGPT-5-miniが平均35%安く、エージェント乗っ取りではDeepSeek最良モデルでも認証情報の窃取が37%の試行で発生。トークン単価ではなく総額と乗っ取り耐性で選ぶべき理由を、評価の立場性と限界も含めて整理します。 続きを読む → AI解体新書 既知の脱獄攻撃を受けると、AIの安全性は39システム中35システムで落ちる? MLCommonsが公開した脱獄ベンチマークv0.5では、公開・既知の攻撃を加えるとテキスト対テキストの安全性スコアが平均19.81%下がり、39システム中35システムが安全グレードを1段階以上落としました。通常利用の安全性と攻撃下の安全性は別物だという実測を、中小企業の受け入れテストの話に落とします。 続きを読む →
AI解体新書 情シスの仕事はAIでどこまで速くなるのか ― 181名のランダム化比較試験が示した「効く業務」と「25%遅くなる業務」 Microsoftが181名を対象に行ったランダム化比較試験で、情シス業務の正答精度は平均34.53%改善しました。ただし効いたのは自由記述型の作業で、多肢選択型は精度が有意に上がらず所要時間は25.13%増えています。発信元が製品提供者本人である点も含め、業務単位の線引きを整理します。 続きを読む →
AI解体新書 安いから中国製モデル、は成立するのか? 米国政府機関の実測でGPT-5-miniが平均35%安かった 米国商務省NIST傘下のCAISIがDeepSeekの各モデルを実測しました。同等性能に要した費用はGPT-5-miniが平均35%安く、エージェント乗っ取りではDeepSeek最良モデルでも認証情報の窃取が37%の試行で発生。トークン単価ではなく総額と乗っ取り耐性で選ぶべき理由を、評価の立場性と限界も含めて整理します。 続きを読む →
AI解体新書 既知の脱獄攻撃を受けると、AIの安全性は39システム中35システムで落ちる? MLCommonsが公開した脱獄ベンチマークv0.5では、公開・既知の攻撃を加えるとテキスト対テキストの安全性スコアが平均19.81%下がり、39システム中35システムが安全グレードを1段階以上落としました。通常利用の安全性と攻撃下の安全性は別物だという実測を、中小企業の受け入れテストの話に落とします。 続きを読む →