【論文読解】img2pose: Face Alignment and Detection via 6DoF, Face Pose Estimation
概要 顔の姿勢推定モデルimg2poseを提案している論文を読んだので紹介してみます。 本手法の特徴は、既存の多くの顔の6自由度(6DoF)の姿勢推定手法において事前処理として採用されている顔検...
59 search resultsShowing 1~20 results
You need to log-in
概要 顔の姿勢推定モデルimg2poseを提案している論文を読んだので紹介してみます。 本手法の特徴は、既存の多くの顔の6自由度(6DoF)の姿勢推定手法において事前処理として採用されている顔検...
概要 物体検出手法において必須ともいえるNon-Maximum suppression(NMS)を使用しないことを目指した手法DeFCNを提案している論文を読んだので紹介します。 NMSを使用し...
概要 幼児に対する2次元姿勢推定モデルFiDIPを提案している論文を読んだので紹介してみます。 長期間にわたる用事の動きの観察は、発達の問題や病気を早期に発見するための重要な手掛かりになることが...
概要 $\mathrm{U}^2$-NetというSaliency Object Detection(SOD)のためのネットワーク構造を提案している論文を読んだので紹介します。 SODは画像中の目...
概要 訓練中に存在しない話者の数秒の音声をもとに、Zero-shotなText-to-Speechを実現する手法であるSV2TTSを提案している2018年の論文で、GoogleのTacotron...
概要 深層学習モデルの大規模な訓練では、訓練の効率を最大化するために、大きなサイズのミニバッチを使用します。しかし、ミニバッチサイズを大きくするといくつかの問題のためにモデルの精度が劣化するとい...
概要 画像のドメイン変換に連続的な変化を与えることができる手法SAVI2Iを提案している論文を読んだので紹介してみます。 画像のドメイン変換は、pix2pix1に代表される、入力画像を目的となる...
概要 『天空の城』の名を冠する動画合成に関する論文を読んでみたので、紹介してみます。 この論文で提案している手法は、以下の画像のように、空の領域を別途用意されたテンプレート画像と置き換えることで...
概要 3次元点群に対するシンプルですが強力な前処理を実現するMaskNetを提案している論文を読んだので紹介します。 MaskNetのアイディアは単純です。 下図の左に示されるような赤い点群と緑...
概要 SVGの生成モデルDeepSVGを提案している論文を読んだので紹介してみます。 ラスタ画像に関する深層学習の生成モデルは様々に研究されていますが、ベクタ画像の生成モデルはそれほどには研究さ...
概要 エッジ検出のための深層学習モデルDexiNedを提案している論文を読んだので紹介してみます。 エッジ検出のような低レベルタスクを深層学習で行うのは、一見簡単そうに見えますが、意外にもなかな...
概要 劣化した古い写真を復元する深層生成モデルを提案している論文を紹介します。本論文には、ジャーナル版があり、そちらではさらに人間の顔領域に特化した修復手法も追加で提案されていますが、本稿ではそ...
概要 End-to-Endのシーンテキスト検出手法であるCharNetを提案している論文を読んだので紹介します。 特徴として、それまでのシーンテキスト検出手法が「テキスト領域検出→テキスト認識」...
概要 自然画像中の文字検出タスク、いわゆるシーンテキストのための合成データ作成手法であるSynthTextを提案している論文を紹介します。本論文では合成データの作成手法と、シーンテキストのための...
概要 事前に学習された画像生成モデルを蒸留することで、形状(コンテンツ)と外観(スタイル)を個別にコントロールできるような潜在空間を持つ新しい生成モデルを作る手法NeuralCrossbreed...
はじめに 最近、シングルステージの物体検出であるYOLOの名を冠する手法が、立て続けに公開されました。 まず、YOLOv4が2020年4月公開されました。v3までの著者であるJoseph Red...
概要 動画中の人物の密な3次元ポーズを推定する手法であるVIBE(Video Inference for Body Pose and Shape Estimation)の論文を読んだので紹介しま...
概要 画像集合をもとに新しい視点からの画像を合成する技術であるNeRF in the Wild(NeRF-W)について紹介します。 例えば、Photo Tourism Datasetには、ある特...
概要 複雑なレイアウトを持つドキュメントからの情報抽出を目的とした手法を提案している論文を読んだので紹介します。本手法が対象とするのは、例えば以下のようなドキュメントです。丸カッコの中は、各ドキ...
概要 テキスト領域の検出手法ContourNetの論文を読んでみたので紹介します。本論文はCVPR2020採択論文です。 いわゆるシーンテキストと呼ばれるタイプのテキスト検出タスクに対する手法で...
59 search resultsShowing 1~20 results
Qiita is a knowledge sharing service for engineers.