アンドロイドは推理小説を書くか?

rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking (AI論文要約)

AIを使った論文要約です。簡単なサーベイ用で詳細は論文を参照してください。 https://arxiv.org/abs/2501.04519 どんなもの rStar-Mathは、大規模言語モデル(LLM)からの蒸留なしに、小さな言語モデル(SLM)がOpenAI o1と同等以上の数学的推論能力を持つ …

nlp deeplearning paper_summary

2025-01-11

Fact-aware Sentence Split and Rephrase with Permutation Invariant Training (AI論文要約)

AIを使った論文要約です。簡単なサーベイ用で詳細は論文を参照してください。 https://arxiv.org/abs/2001.11383 どんなもの複雑な文を意味を保ったまま複数の簡単な文に分割・言い換える Sentence Split and Rephrase タスクのための新しいフレーム …

nlp deeplearning paper_summary

2025-01-02

Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention (AI論文要約)

AIを使った論文要約です。簡単なサーベイ用で詳細は論文を参照してください。 https://arxiv.org/abs/2404.07143 どんなもの Transformerベースの大規模言語モデル(LLMs)を、bounded memoryとcomputationで無限長の入力にスケールするため …

nlp deeplearning paper_summary

2025-01-02

Only-IF :Revealing the Decisive Effect of instruction diversity on Generalization (AI論文要約)

AIを使った論文要約です。簡単なサーベイ用で詳細は論文を参照してください。 https://arxiv.org/abs/2410.04717 どんなもの大規模言語モデル（LLM）の指示遵守能力を向上させるためのデータセット構築戦略に関する研究。特に、instruction diversity（指示 …

nlp deeplearning paper_summary

2025-01-02

Steering Knowledge Selection Behaviours in LLMs via SAE-Based Representation Engineering (AI論文要約)

AIを使った論文要約です。簡単なサーベイ用で詳細は論文を参照してください。 https://arxiv.org/abs/2410.15999 どんなもの本論文は、大規模言語モデル (LLM) の知識選択行動を、事前学習済みスパースオートエンコーダ (SAE) …

nlp deeplearning paper_summary

2025-01-02

Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization(AI論文要約)

AIを使った論文要約です。簡単なサーベイ用で詳細は論文を参照してください。 https://arxiv.org/abs/2410.12949 どんなもの本論文は、大規模言語モデル(LLM)から望ましくない知識を削除または修正する「知識のアンラーニングと編集」手法に関する研究です。特に、モデルの特定 …

nlp deeplearning paper_summary

2025-01-02

Mixture of expertsのサンプル実装

mixture of expertsを実装してみる。並列化や計算効率の向上などの部分は複雑なので、それら取り除いた簡単な実装を行ってみる。 Mixture of expertsとは特定のタスクに特化したexpertを複数用意し、入力に対してexpertを切り替えることで性能を上げる手法。 …

python nlp torch

2023-12-16

huggingfaceのgenerationの関数をtorch modelから使えるようにしたい

torchなどのライブラリを使いpre_trainingを行い文章生成させる際、文章生成の計算は基本的に自分で実装する必要がある。 huggingface用のmodelに変換しても良いが、おれおれアーキテクチャにした場合、変換も面倒… そこで、huggingfaceにあるtop_k …

python nlp huggingface torch pre_training

2023-12-05

llama2のアーキテクチャを変更してpre trainingしてみる

できるだけ小さいサイズのモデルで日本語を喋れるモデルを作りたい、ということでllama2のpre_trainingはすでにおこなったがさらなる改善のため、いくつかのアーキテクチャを考えてみる。比較のベースとなる標準的なモデルに対し、新たに3つのモデルを作成し比較する transformer …

python nlp transformer pre_training

2023-12-05

複数ファイルに分割されたデータセットをHuggingface Hubにアップロードするメモ

データセットなどサイズの大きいデータをHuggingface Hubにアップロードして使う場合のメモ。公式ドキュメントにはアップロードする方法が様々あるが、いまいちどれを使えば良いか分かりづらかったのでメモ。今回作成したデータセットは以下。 …

python nlp huggingface

2023-11-21

HuggingfaceのDataLoaderとDatacollatorのソースコードを眺める

エラーでハマったので、hugging faceのdatasetからbatche_sizeごとのinput_idsやlabelsにするあたりの実装、特にDataLoaderとDataCollatorあたりをちゃんと確認しておく train loopは以下から始まる def train( self, …

python nlp huggingface

2023-09-21

xgenでJGLUEを試す

日本語ベンチマークとしてJGLUE(JP Language Model Evaluation Harness)が提案されている。 https://techblog.yahoo.co.jp/entry/2022122030379907/ 文章分類、文ペア分類、質問応答のタスクに対し評価を行う。タスク …

python nlp jglue xgen

2023-07-01

OpenCALM-7Bをloraで学習して、quantizeするまで

cyberagent/open-calm-7bをLoraを用いて学習し、quantizeするまでやっていきます https://huggingface.co/cyberagent/open-calm-7b gpt-neoxのlora weight mergeの記事が見つからなかったのでメモとして動 …

nlp deeplearning python huggingface

2023-05-22

loraで学習する場合のpromptって何でも良いんだっけ？rinna instruction 3Bで試す

loraを用いて学習する場合の、promptのtemplateは日本語にしたほうが良いんだっけ？ユーザー入力のフォーマットとかLLM側の出力のフォーマットとかどうすれば良いんだっけ？ってなったので学習させて結果を比較してみる。せっかくなの …

nlp deeplearning python huggingface

2023-05-21

rinna 3Bをcppで動かす

rinnaをcppで動かせるように色々試して見ました。 instructionもあり、そのままlangchainなどに突っ込んでも動かせそうということで、ローカルで遊ぶならcppしてないと遊べないので色々試してみました。 …

nlp deeplearning python huggingface

2023-05-18

VicunaでReActっぽいことを試してみる

vicunaでReActっぽいことを試してみる。正確には違うので注意 ReActは、Thought、Action、Observationをループさせ、LLMの出力の精度上げる手法 ReActの処理の流れは以下のような形。LangChainの実装を参考にする。与えられた質問(Question)に対 …

nlp python langchain

2023-04-01

Rust TokenizerをC++から呼び出す

Bloomz.cppのtokenizerが日本語でうまく動かなかったので、 Rust製のHuggingface TokenizerをC++から呼び出せるようにしました。初めに「応答」の応の文字には２つのIDが振られている。 model_name = …

nlp deeplearning python huggingface

2023-03-31

BloomをLoRaで日本語finetuning

LlamaをAlpacaデータセットを使いLoRaでfine tuneしたものが良い感じだったので、Bloomを日本語で学習させてみようと思う。 https://github.com/tloen/alpaca-lora とりあえず動かすまででしっかりfine tune …

nlp deeplearning python huggingface

2023-03-20

LlamaIndex(GPTIndex)を触る

LlamaIndexを動かしていきます。最近名前がGPTIndexから変わったみたい。 LlamaIndexとは、LLMのPromptの作成などを外部のデータソースと連携して行えるようにしたツールキット。 …

nlp deeplearning python huggingface

2023-03-04

code blockにrefarenceをつける

Hugoでコードブロックを使うときは、GitHubからの引用し、その下に参照元のURLを貼り付けることが多い。コードブロックの下にそのままURLが表示されるの若干見づらかったので、コードブロックとセットでいい感じに表示したい。 HugoにMarkdown Render Hooks …

hugo

2023-02-28