ニュース › OpenAI #規制・法制度 OpenAI 2026年4月6日 OpenAI、Safety Fellowshipを発表 イメージ 独立した安全性とアライメント研究を支援し、次世代の人材を育成するパイロットプログラム。 出典: OpenAI(配信元の紹介文より引用) このニュースの全文は、配信元でお読みいただけます。 OpenAIで元記事を読む → 編集部の実践記録から 当社が自社の業務でAIを動かし、処理件数・所要時間・失敗件数まで 実際に測った記録です。 AI解体新書 AIは「人間なら数週間」の開発をどこまで完遂できるのか ― 1.7万行の再実装はテスト2,000/2,001件、6.1万行は35%止まり Epoch AIの暫定結果によると、熟練エンジニアで2〜17週と見積もられた約16,905行のツールキット再実装を最新モデルがE2Eテスト2,000/2,001件(99.95%)で完遂した一方、約61,461行の課題は10億トークンの約9割を使って可視テスト256/733件(35%)で未解決でした。規模と費用の境界線を読み解きます。 続きを読む → AI解体新書 AIは人間の何時間ぶんの仕事まで任せられるのか? 4分未満はほぼ100%、4時間超は10%未満だった METRが2025年3月19日に公開した測定によると、現行モデルは人間が4分未満で終える作業をほぼ100%こなす一方、人間が約4時間超かかる一続きの仕事は10%未満しか完遂できない。成功率50%の時間地平は約7か月で倍化。中小企業が導入判断に使える物差しとして読み解く。 続きを読む → AI解体新書 AIに詳しい人の2025年予測は、どこが当たりどこが外れたのか(SWE-Bench 予測88%に対し実績80.9%) AI Digestが集めた421名の予測を、2026年1月に答え合わせした調査です。コーディング系ベンチマークは唯一の過大予測、セキュリティ系と業界売上は大幅な過小評価でした。自己選択サンプルという限界も含めて、中小企業の計画づくりにどう使えるかを整理します。 続きを読む →
AI解体新書 AIは「人間なら数週間」の開発をどこまで完遂できるのか ― 1.7万行の再実装はテスト2,000/2,001件、6.1万行は35%止まり Epoch AIの暫定結果によると、熟練エンジニアで2〜17週と見積もられた約16,905行のツールキット再実装を最新モデルがE2Eテスト2,000/2,001件(99.95%)で完遂した一方、約61,461行の課題は10億トークンの約9割を使って可視テスト256/733件(35%)で未解決でした。規模と費用の境界線を読み解きます。 続きを読む →
AI解体新書 AIは人間の何時間ぶんの仕事まで任せられるのか? 4分未満はほぼ100%、4時間超は10%未満だった METRが2025年3月19日に公開した測定によると、現行モデルは人間が4分未満で終える作業をほぼ100%こなす一方、人間が約4時間超かかる一続きの仕事は10%未満しか完遂できない。成功率50%の時間地平は約7か月で倍化。中小企業が導入判断に使える物差しとして読み解く。 続きを読む →
AI解体新書 AIに詳しい人の2025年予測は、どこが当たりどこが外れたのか(SWE-Bench 予測88%に対し実績80.9%) AI Digestが集めた421名の予測を、2026年1月に答え合わせした調査です。コーディング系ベンチマークは唯一の過大予測、セキュリティ系と業界売上は大幅な過小評価でした。自己選択サンプルという限界も含めて、中小企業の計画づくりにどう使えるかを整理します。 続きを読む →