MiniGPT-4をAutoGPTQ/BitsAndBytesで量子化時の生成文章の定量評価
                529{icon} {views} LLMをデプロイする際に、LLM部分の量子化が必要になることが多いです。MiniGPT4のようなVLMに焦点をあて、AutoGPTQとBitsAndBytesという2つの量子化フレーム […]...
              
            
  
       MiniGPT4をAutoGPTQ/BitsAndBytesで量子化してAWS上でのスループットを検証する
                901{icon} {views} LLMをデプロイする際に、LLM部分の量子化が必要になることが多いです。MiniGPT4のようなVision & Language(マルチモーダル)なLLMに焦点をあて、Aut […]...
              
            
  
       論文まとめ:Investigating Emergent Goal-Like Behaviour in Large Language Models Using Experimental Economics
                322{icon} {views} タイトル:Investigating Emergent Goal-Like Behaviour in Large Language Models Using Experimental  […]...
              
            
  
       LLaMA.cpp+(cu)BLASのCPU/GPUのスループット検証(AWS編)
                1k{icon} {views} AWSのEC2環境でのLLaMA.cppのスループットをCPU,GPUインスタンスで比較してみました。結論としてはGPUのほうが良さそうということですが、インスタンスあたりのコストを考慮 […]...
              
            
  
       LLaMA.cpp+(cu)BLASのCPU/GPUのスループット検証(ローカル編)
                2.2k{icon} {views} LLaMA.cppのスループットをローカルで検証してみました。OpenLLaMA 7B/13Bをベースに、CPU/GPUのそれぞれの生成速度(token per second)と量子 […]...
              
            
  
       論文まとめ:Evaluating and Inducing Personality in Pre-trained Language Models
                481{icon} {views} タイトル:Evaluating and Inducing Personality in Pre-trained Language Models 著者:Guangyuan Jiang,  […]...
              
            
  
       Mini-GPT4をDockerで動かしてバッチ処理する
                885{icon} {views} Mini-GPT4というマルチモーダルLLMをDockerを使ってバッチ処理をしてみました。係数を部分的にDockerイメージに組み込んだり、使用するLLMを切り替えられるようにちょっ […]...
              
            
  
       OpenAIのChatGPT APIの並列化を試す(LangChain)
                2.2k{icon} {views} 大量のデータをChatGPTで推論したいときに、並列化したらどの程度速くなったのかを実験してみました。振れ幅はかなり大きいですが、かなり並列化の効果はありました。 はじめに Chat […]...
              
            
  
       論文まとめ:TinyStories: How Small Can Language Models Be and Still Speak Coherent English?
                771{icon} {views} タイトル:TinyStories: How Small Can Language Models Be and Still Speak Coherent English? 著者:Rone […]...
              
            
  
       論文まとめ:Sentence Simplification via Large Language Models
                623{icon} {views} 論文:Sentence Simplification via Large Language Models 著者:Yutao Feng, Jipeng Qiang, Yun Li, Yu […]...