ニュース › Hugging Face #開発・実装 Hugging Face 2025年11月20日 Apple プラットフォーム向けLLM統合API『AnyLanguageModel』を発表 イメージ このニュースの全文は、配信元でお読みいただけます。 Hugging Faceで元記事を読む → 編集部の実践記録から 当社が自社の業務でAIを動かし、処理件数・所要時間・失敗件数まで 実際に測った記録です。 AI解体新書 LLM単体の誤検知8割超は、複数モデル検証と人手でどこまで下がるのか Uberが自社のGoコード解析ツールPerfInsightsの実測を公開しました。LLM単体では誤検知が8割超、複数モデルによる相互検証と人の確認を挟んで10%台前半へ。AIに検査業務を任せる際の現実的な設計指針と、そのまま真似てはいけない数字の線引きを整理します。 続きを読む → AI解体新書 AIエージェントへの「完全自動承認」は、なぜ習熟で約20%から40%超へ倍増したのか? Anthropicが自社のClaude CodeとAPIのログを分析し、AIエージェントにどこまで自動で任せているかを実測した。完全自動承認は新規ユーザーの約20%から習熟ユーザーの40%超へ倍増する一方、中断率も5%から約9%へ上がる。不可逆な操作は全体の0.8%。承認ポイントの設計に使える一次データを、偏りごと読む。 続きを読む → AI解体新書 中小企業の2割強が1年でサイバー被害、復旧平均5.8日——経営者は何から手を付けるべきか? IPAが2025年5月に公開した中小企業の情報セキュリティ実態調査(n=4,191)を読み解く。2023年度の1年間で被害を受けた企業は約2割強、復旧に要した期間は平均5.8日・最長360日。不正アクセスの手口の最多は脆弱性48.0%だった。数字の分母と調査の限界まで含めて、経営判断に使える形に整理する。 続きを読む →
AI解体新書 LLM単体の誤検知8割超は、複数モデル検証と人手でどこまで下がるのか Uberが自社のGoコード解析ツールPerfInsightsの実測を公開しました。LLM単体では誤検知が8割超、複数モデルによる相互検証と人の確認を挟んで10%台前半へ。AIに検査業務を任せる際の現実的な設計指針と、そのまま真似てはいけない数字の線引きを整理します。 続きを読む →
AI解体新書 AIエージェントへの「完全自動承認」は、なぜ習熟で約20%から40%超へ倍増したのか? Anthropicが自社のClaude CodeとAPIのログを分析し、AIエージェントにどこまで自動で任せているかを実測した。完全自動承認は新規ユーザーの約20%から習熟ユーザーの40%超へ倍増する一方、中断率も5%から約9%へ上がる。不可逆な操作は全体の0.8%。承認ポイントの設計に使える一次データを、偏りごと読む。 続きを読む →
AI解体新書 中小企業の2割強が1年でサイバー被害、復旧平均5.8日——経営者は何から手を付けるべきか? IPAが2025年5月に公開した中小企業の情報セキュリティ実態調査(n=4,191)を読み解く。2023年度の1年間で被害を受けた企業は約2割強、復旧に要した期間は平均5.8日・最長360日。不正アクセスの手口の最多は脆弱性48.0%だった。数字の分母と調査の限界まで含めて、経営判断に使える形に整理する。 続きを読む →