Macのターミナルでテキストファイルを整形する
はじめに 「この文書を形態素解析してくれ」とか言われてShift_JISテキストやらdocxやらrtfやらの詰め合わせを渡されたときに役に立ちそうなコマンドラインツールのまとめ。 命名ルールに違...
14 search resultsShowing 1~14 results
You need to log-in
はじめに 「この文書を形態素解析してくれ」とか言われてShift_JISテキストやらdocxやらrtfやらの詰め合わせを渡されたときに役に立ちそうなコマンドラインツールのまとめ。 命名ルールに違...
はじめに 日本語拡張モダリティ解析器ZundaをMacにインストールしたときのメモです。 Zundaのバージョンは1.6、MacOSはBig Surです。 手順 ファイルをダウンロード とりあえ...
はじめに 遠隔授業用の動画をPowerPointで作るにあたり、ノートを合成音声で読み上げて、スライドにオーディオ・オブジェクトとして埋め込むマクロを作成しました。 Windows限定です。 開...
はじめに ちょっと前にRubyでExcelワークシートを作ることがあったので、そのまとめ。 書式設定とかその辺を中心に。 基本 axlsxを使う。 MacでExcelワークシートを作るライブラリ...
はじめに あるテキストが、どのくらい語彙が豊かかを評価するために、異なり語数(types)と延べ語数(tokens)という数値が使われます。 異なり語数(types): 使われている語の種類の数...
オブジェクトを再帰的に辿る グラフのノードを再帰的に辿るような繰り返し処理をいい感じに書くにはどうすればよいか。 簡単な例 ごく簡単な例を設定する。ある文字列sについて、s[1..-1]を繰り返...
はじめに SUMO(Suggested Upper Merged Ontology) を neo4j に変換する。 SUMO クラス・インスタンス階層や一階述語論理の機構を備えたオントロジー。k...
はじめに 言語学の研究のためにWordNetやSUMOのようなオントロジーデータベースを使いたいが、主に使いたいのはクラス階層とかなのでグラフ型データベースが便利かなあと思って試してみたメモ。 ...
『現代日本語書き言葉均衡コーパス』(BCCWJ)をRで読み込んで集計したりグラフを描いたりするメモ。 tidyverse データの集計とかを効率よくやるために、dplyrとtidyrというライブ...
gb4e 例文番号を振ったりするやつ。似たようなものは他にもあるが、これが一番しっくりくるのでこれを使っている。 \documentclass[uplatex,12pt]{jsarticle} ...
概要 cabocha-rubyの使い方メモ。 インストール gem install cabocha 使い方 require "cabocha" include CaboCha parser = ...
IO#pipeは読み出さずに書き込み続けるとブロックされる。 r, w = IO.pipe 20000.times { |n| print "\b\b\b\b\b%05d" % n w.prin...
モデルファイルのコピー Macの次のフォルダから関係ありそうなファイルをコピー /usr/local/lib/cabocha/model Winの次のフォルダに置く C:\Program Fil...
標準入力を2つに分ける。 def splitter(source, number = 2) pipes = number.times.map{ IO.pipe } Thread.fork do ...
14 search resultsShowing 1~14 results
Qiita is a knowledge sharing service for engineers.