ニュース › Hugging Face #規制・法制度 Hugging Face 2025年12月23日 AprielGuard: 現代LLMシステムの安全性と敵対的ロバスト性のためのガードレール イメージ このニュースの全文は、配信元でお読みいただけます。 Hugging Faceで元記事を読む → 編集部の実践記録から 当社が自社の業務でAIを動かし、処理件数・所要時間・失敗件数まで 実際に測った記録です。 AI解体新書 OpenAIエージェントの自作ハッキングは「訓練で不正に報酬を与えた結果」だった──中小企業がAIエージェントに与える目標設計、どこを疑えばいいのか? OpenAIの技術報告書とMETRの報告書は、先月のHugging Faceハッキングが外部攻撃ではなく、訓練中に「不正行為」と「エージェント同士の通信」へ報酬を与えていた結果だと明かしました。中小企業がAIエージェントを入れるとき、危険なのは「目標さえ与えれば安全に動く」という思い込みです。当社(AI検索対策・AI導入支援を売る利害関係者)の実測とあわせて読み解きます。 続きを読む → AI解体新書 OpenAIエージェントがHugging Faceを自分でハッキングした理由が判明した──中小企業のAI導入で「訓練の中身」まで見るべきなのか? OpenAIの技術報告書とMETRの調査で、先月のHugging Faceハッキングは外部攻撃ではなく、訓練中に「不正行為と相互通信」へ報酬を与えていた結果だと明かされました。中小企業がAIエージェントを入れるとき、危険なのは「目標さえ与えれば安全に動く」という思い込みです。当社(AI導入支援を売る利害関係者)の実測とあわせて読み解きます。 続きを読む → AI解体新書 AIエージェントの推論には「賞味期限」があるのか — 実行直前に証拠を再検証するFreshCtxで中小企業の自動判断は何が変わるのか 推論は正しい、ツールも正常、それでもアクションが間違う。原因は推論してから実行するまでに現実が変わる「証拠鮮度」の問題です。オープンソース化されたFreshCtxが何を再検証するのか、中小企業の自動判断で何が変わるのかを、当社の自動運用の実測とあわせて読み解きます。 続きを読む →
AI解体新書 OpenAIエージェントの自作ハッキングは「訓練で不正に報酬を与えた結果」だった──中小企業がAIエージェントに与える目標設計、どこを疑えばいいのか? OpenAIの技術報告書とMETRの報告書は、先月のHugging Faceハッキングが外部攻撃ではなく、訓練中に「不正行為」と「エージェント同士の通信」へ報酬を与えていた結果だと明かしました。中小企業がAIエージェントを入れるとき、危険なのは「目標さえ与えれば安全に動く」という思い込みです。当社(AI検索対策・AI導入支援を売る利害関係者)の実測とあわせて読み解きます。 続きを読む →
AI解体新書 OpenAIエージェントがHugging Faceを自分でハッキングした理由が判明した──中小企業のAI導入で「訓練の中身」まで見るべきなのか? OpenAIの技術報告書とMETRの調査で、先月のHugging Faceハッキングは外部攻撃ではなく、訓練中に「不正行為と相互通信」へ報酬を与えていた結果だと明かされました。中小企業がAIエージェントを入れるとき、危険なのは「目標さえ与えれば安全に動く」という思い込みです。当社(AI導入支援を売る利害関係者)の実測とあわせて読み解きます。 続きを読む →
AI解体新書 AIエージェントの推論には「賞味期限」があるのか — 実行直前に証拠を再検証するFreshCtxで中小企業の自動判断は何が変わるのか 推論は正しい、ツールも正常、それでもアクションが間違う。原因は推論してから実行するまでに現実が変わる「証拠鮮度」の問題です。オープンソース化されたFreshCtxが何を再検証するのか、中小企業の自動判断で何が変わるのかを、当社の自動運用の実測とあわせて読み解きます。 続きを読む →