ニュース › Hugging Face #開発・実装 Hugging Face 2026年6月17日 エージェント型リソース発見、検索能力で可能性を拡張 画像: Hugging Face(配信元より) このニュースの全文は、配信元でお読みいただけます。 Hugging Faceで元記事を読む → この話題に関連する、TOEの実践・観測記録 ニュースの背景を、当社が実際にAIを動かした一次記録から補足します。 AI解体新書 採点の仕組みが作れない業務でも、AIを自社向けに鍛えられるのか? 1本52分・3ドル未満の実測 自動採点の仕組みが用意できない業務でも、指示と正解の組だけで推論AIモデルを自社向けに調整できるか。研究チームは、GPU1枚・平均52分・1件あたり3米ドル未満で調整を終え、Rustコード生成で平均+7.0ポイントの向上と推論能力の維持を同時に達成したと報告しました。中小企業にとっての意味を整理します。 続きを読む → AI解体新書 学習データを71%捨てても精度は落ちないのか?場所認識AIの実測で見る「データ選別」の費用対効果 AIの精度はデータ量で決まる、という前提を疑う実測が出ました。画像による場所認識AIの学習で、データを71%削減しても精度は維持され、総学習時間は19.152時間から4.825時間へ74.8%削減。データを増やす前に選別する工程を挟む、という予算配分の話として読めます。ただし対象は特定タスクに限られます。 続きを読む → AI解体新書 AIの評価軸を「正答率」から「越えてはいけない線」に変えられるか——医療AI検査ベンチマーク100件の設計 臨床医1名が作った医療AI安全性ベンチマーク「MedFailBench」は、合成症例100件を6種類の失敗ゲートと5段階の重大度で分類した。正解率ではなく「どの安全境界が破られたか」で測る設計思想は、中小企業の社内AI評価表にそのまま応用できる。ただし実験規模は極端に小さく、論文自身が限界を並べている。 続きを読む → 御社でもAIを使ってみませんか まずはここから 御社でもAIを使ってみませんか? 御社の実際の業務を題材に、AIで何ができるかを一緒に考えます。 「ChatGPTの使い方」を教えるだけの研修ではありません。 AI研修・AI活用相談 → AI検索で自社がどう見えるか知りたい ChatGPTやPerplexityで自社が言及されるかを実際に測ります。 引用を約束するものではなく、まず現状を測るサービスです。 AI検索可視性診断 → Webサイトを改善したい 測った結果、サイト側に原因があった場合の改善まで対応します。 Web制作25年・1000案件の実績があります。 SEO・Webサイト改善 →
AI解体新書 採点の仕組みが作れない業務でも、AIを自社向けに鍛えられるのか? 1本52分・3ドル未満の実測 自動採点の仕組みが用意できない業務でも、指示と正解の組だけで推論AIモデルを自社向けに調整できるか。研究チームは、GPU1枚・平均52分・1件あたり3米ドル未満で調整を終え、Rustコード生成で平均+7.0ポイントの向上と推論能力の維持を同時に達成したと報告しました。中小企業にとっての意味を整理します。 続きを読む →
AI解体新書 学習データを71%捨てても精度は落ちないのか?場所認識AIの実測で見る「データ選別」の費用対効果 AIの精度はデータ量で決まる、という前提を疑う実測が出ました。画像による場所認識AIの学習で、データを71%削減しても精度は維持され、総学習時間は19.152時間から4.825時間へ74.8%削減。データを増やす前に選別する工程を挟む、という予算配分の話として読めます。ただし対象は特定タスクに限られます。 続きを読む →
AI解体新書 AIの評価軸を「正答率」から「越えてはいけない線」に変えられるか——医療AI検査ベンチマーク100件の設計 臨床医1名が作った医療AI安全性ベンチマーク「MedFailBench」は、合成症例100件を6種類の失敗ゲートと5段階の重大度で分類した。正解率ではなく「どの安全境界が破られたか」で測る設計思想は、中小企業の社内AI評価表にそのまま応用できる。ただし実験規模は極端に小さく、論文自身が限界を並べている。 続きを読む →