MIT(マサチューセッツ工科大学)は、人種差別用語や女性差別を助長するとして、大規模なデータセットを削除しました。
このデータセットは、高度な物体検出技術を開発するために2008年に作成されたもので、8000万枚の画像が使われた「Tiny Images」という画像ライブラリです。機械学習モデルに静止画中の人物や物体を識別するための学習モデルを教えるために使用されてきました。
8000万枚のTiny Imagesの欠点を発見したのは、プライバシーに特化したスタートアップ「UnifyID」のチーフサイエンティストであるVinay Prabhu氏と、ユニバーシティ・カレッジ・ダブリンの博士号候補であるAbeba Birhane氏です。「Tiny Images」にはアジア系や黒人、女性の差別につながるラベル付けがされていたといいます。
ディープラーニングでは、ラベルつけされた画像を大量に学習することで、画像とラベル(言葉)の関連付けをしています。「Tiny Images」の画像をディープラーニングで学習することで、ラベルに含まれた差別的な表現を学習してしまい、結果として偏ったモデルが構築されてしまうおそれがあります。
データセットには、売春婦や水着姿の女性など、不必要に日常の画像を差別的な言葉にリンクさせ、将来的にAIモデルに偏見を植え付ける可能性があります。
MITは「TinyImages」のデータセットを削除し、研究者や開発者にライブラリの使用を中止しています。また、そのコピーをすべて削除するよう促しています。また、公式声明と謝罪文をサイト上で発表しました。
Tiny Imagesのデータセットには、カテゴリや攻撃的な画像などの軽蔑的な用語が含まれていることが判明しました。
(中略)
このことを大変心配しており、影響を受けた可能性のある方々にお詫び申し上げます。
AIが人種や性別の偏見や差別を示す例は数多くあり、学習させるデータをいかに公平公正な品質に保つのがが大きな課題となっています。特にディープラーニングでは、膨大なデータを学習するため、わずかな偏見でも差別表現を助長して誇張してしまう可能性があります。
過去にもGoogle Photo上で、黒人を「ゴリラ」と認識してしまったり、米アマゾンに導入された採用システムが、女性差別を行うなど倫理的な問題に問われるケースが多くあります。
国内では人工知能学会に「倫理委員会」が設けられるなど、AIの倫理性を向上させる取り組みが行われていますが、AIの発展に伴い、社全体で議論が行わていくことが望まれます。
「人間とAIが共存する社会をつくる」をビジョンに掲げ、AI分野で幅広く活動。書籍『生成AI導入の教科書』『AIエージェントの教科書』『40代・50代でもよくわかる 宇宙一やさしいAIの教科書』の刊行や、1500本以上のAI関連記事の執筆を通じて、AIの可能性と実践的活用法を発信し続けてきた。年間登壇は300回以上。
一般社団法人AICX協会を設立し、代表理事として、国内最大級のAIエージェントカンファレンス「AI Agent Day」の主催や、国内初のAIエージェント実装人材資格制度(AIエージェント・ストラテジスト/アーキテクト)の創設を牽引。一般社団法人生成AI活用普及協会常任協議員を務めるほか、経済産業省「AX時代のスキルに関するワーキンググループ」委員として国のAI政策にも参画。シンシアリー株式会社の取締役CCOとしてAI企業の経営にも関わる。日本HP、Lightblue、NTTデータグループ、THAなど複数社のアドバイザーも務める。
NewsPicksプロピッカー、Udemyベストセラー講師、クラウドワークス アンバサダーとして情報発信・人材育成にも注力。千葉県船橋市生成AIアドバイザーとして行政のDX推進にも携わる。
AI領域以外では、2022年にCinematoricoを創業しCOOに就任。PR・映像制作・フリーカメラマン・日本大学文理学部次世代社会研究センタープロボノなど、多彩な経験を基盤に活動を展開している。



















