SeqGANの論文を読む

SeqGAN: Sequence Generative Adversarial Nets with Policy Gradient https://arxiv.org/pdf/1609.05473.pdf SeqGANの論文を読んだのでまとめておきます。実装を行おうと思って読んだので手法をメインに読 …

word2vecでベクトルから単語を出力する

word2vecで単語をベクトルにしたり、類似度判定した記事はたくさんあるが、ベクトルから類似単語を出力する日本語記事を見つけられなかったのでメモ。 stack overflowにあった。 …

自然言語処理シリーズの構文解析を読む(概要)

はじめに 自然言語処理シリーズの構文解析を読んでいきます。 全体の概要把握:1時間 中身の細かいとこ:3時間 という感じで読み進めて行こうと思います。 概要 構文解析を用いることで、単語の並びの背後にある文法的な構造を明らかにすることができる。構文解析を学ぶことで、自然言語処理で用いられる様々な先人 …

文字をベクトル化する

文章生成にchar-level lstmを使ってみる。英語ではうまくいっている例があるが日本語では難しい。これは、日本語は英語に比べ文字数が多く、ニューラルネットワークの次元数(パラメータ数)が増やす必要があるのが原因の1つだと思う。また、次元削減のため、日本語では文章を単語に区切り単語をベクトル化 …

pythonで拡張子を取得する

ファイルの拡張子を取得する方法をいつも忘れるのでメモ import os file_path = "hoge/test.md" root, ext = os.path.splitext(file_path) print(root, ext) 出力 hoge/test .md

lsp-modeを導入する

大学時代から使っていたemacsの設定たちを綺麗にするという目的で、ついでにlsp-modeを導入してみようと思う。 lsp-mode https://github.com/emacs-lsp/lsp-mode language server protocolとは language server …