ラベル データ の投稿を表示しています。 すべての投稿を表示
ラベル データ の投稿を表示しています。 すべての投稿を表示

データ:IBM 大規模データセット「Project CodeNet」を公開

IBMは、AIにコードを教えることを目的とする大規模データセット「Project CodeNet」を公表、
55種類以上のプログラミング言語、約1400万のコードサンプル、約5億行のコードで構成

https://research.ibm.com/blog/codenet-ai-for-code

データ:rinna GPT-2、BERT 事前学習モデルを無償公開

rinna株式会社
製品開発のための実験過程で、日本語に特化した「GPT-2」「BERT」の事前学習モデルを開発
開発した事前学習モデルと学習再現用モデルをGitHubおよびHuggineFaceにオープンソースとして公開

https://github.com/rinnakk/japanese-pretrained-models
https://huggingface.co/rinna

rinna、日本語に特化した「GPT-2」「BERT」事前学習モデルを無償公開 75ギガバイトのデータを最大45日間で学習 | Ledge.ai

データ:ZOZO ファッション流行の大規模データセットを無償公開

ZOZO研究所 (株式会社ZOZOテクノロジーズの研究開発組織) は
研究員が研究に使用している大規模データセット「Shift15M および 実装基盤」をGitHub上にオープンソースとして公開

「Shift15M」・・・
ファッションアプリ「IQON」に投稿されたコーディネートをもとに構成した大規模データセット。
IQONのサービス提供期間である2010年〜2020年までに投稿されたコーディネート255万件以上のほか、これらのコーディネートを構成する1500万件以上のアイテムに関する特徴量、アイテムカテゴリに関するデータやコーディネート投稿への「いいね」数などの関連データも含む。

https://github.com/st-tech/zozo-shift15m

概要説明:https://research.zozo.com/data.html#Shift15mDataset

ZOZO、ファッション流行の大規模データセットGitHub上に無償公開、アイテム数は1500万件以上

その他の記事