なんJLLM部避難所 ★7

1002コメント348KB

なんJLLM部避難所 ★7

■ このスレッドは過去ログ倉庫に格納されています

0001名無しさん＠ピンキー

2025/03/23(日) 14:58:05.71ID:bsaTSAD8

AIに色々なことをしゃべってもらうんやで
そこそこのデスクトップPC（できれば＋3060 12GB以上）でもなんぼか楽しめるで
自薦・他薦のモデルやツールは>>2以降

本スレ(避難中)
なんJLLM部 ★7
https://fate.5ch.net/test/read.cgi/liveuranus/1710561010/
前スレ(実質本スレ)
なんJLLM部避難所 ★6
https://mercury.bbspink.com/test/read.cgi/onatech/1739448962/

0042名無しさん＠ピンキー

2025/03/24(月) 12:35:33.76ID:mmyDiBpb

5080（16GB）ワイの場合
24Bモデル→サクサク
画像生成→サクサク
SillyTavernでチャットしながら画像生成→激重

STで同時にやる場合、画像生成はクラウド環境借りるのが良いというのが今の結論
TTSも組み合わせたいけど16GBだと24B乗せた時点でパンパンになるから無理なんだよな

ローカルで全部やるならTitanRTXかき集めて何台かマシン作るのが今のところ一番現実的に思える

0043名無しさん＠ピンキー

2025/03/24(月) 12:44:45.02ID:???

TTSって意外とメモリ食わないからCPU側で仕事させる事出来たりせんのかな？
RVCでボイチェンしつつモンハンやってた時はRVCをCPU処理させたらゲームがカクつかなくなったしボイチェンもスムーズなままだったので

0044名無しさん＠ピンキー

2025/03/24(月) 12:53:51.88ID:???

推論はどうにかなってるけどfinetuneしたい場合今の環境だと辛い

0045名無しさん＠ピンキー

2025/03/24(月) 13:37:09.48ID:???

企業が出したファインチューニングモデルもオリジナルより性能低下してるのを見ると自分でやる気は起きんなあ
LLMはモデル自体がオープンでも学習法が謎に包まれとるから素人には厳しい

0046名無しさん＠ピンキー

2025/03/24(月) 13:41:24.80ID:???

PRO6000や5000や中華4090改造版のおかげでA6000や6000 ADAの中古価格は結構下がりそうやけどな
RTX8000が10万台、A6000は30万円台まで落ちると予想してる　

0047名無しさん＠ピンキー

2025/03/24(月) 13:56:17.89ID:???

ワイはLLMはいのちの電話にもなると思っとるから
人生最後のグラボやと思って4090買ったんやが
スタートラインでしかなかったんやな……

でも
プロデジかm3maxを買うゼニーはないんで
rayzenAIがんばえー

0048名無しさん＠ピンキー

2025/03/24(月) 14:17:47.62ID:???

>>41
そうかな？このスレの話題って大体30B前後の話題が多いと思うけど

0049名無しさん＠ピンキー

2025/03/24(月) 14:25:02.89ID:???

ファインチューンって牛乳にrank分の濃さ、学習率分量のコーヒーを混ぜて同じ量に調整するようなことだとふんわり思ってたけど違うのかな

0050名無しさん＠ピンキー

2025/03/24(月) 14:30:06.90ID:???

むしろ中規模モデルはリリース多いしスコアも上がっていってるから熱い

0051名無しさん＠ピンキー

2025/03/24(月) 14:46:58.89ID:???

32Bをまともに動かすならVRAM 24GBはいるし、24GBは一般的には低スペックやないやろ
日本語LLM的には最低ラインかもしれんが

0052名無しさん＠ピンキー

2025/03/24(月) 15:09:31.08ID:???

そもそも一般的な基準なら低スペは2060とかや
12GB乗ってるグラボは一般ならミドル
ここの基準はハイスペが抜けすぎててどこまでを低スペって言ってるかわからん

0053名無しさん＠ピンキー

2025/03/24(月) 15:29:08.61ID:???

LLMに人生相談したいんだけどそういうのもできる？

0054名無しさん＠ピンキー

2025/03/24(月) 15:35:35.48ID:???

GPUメモリ12gbやけどqwq32bのIQ4xsを試した時
まあ我慢できなくもない速度出てたからチャットなら使おうと思えば使えると思うで

0055名無しさん＠ピンキー

2025/03/24(月) 15:43:33.10ID:???

>>53
割とLLMの得意分野だと思う
相談する側もAI相手なら恥ずかしがらずありのまま話せるだろうし

0056名無しさん＠ピンキー

2025/03/24(月) 15:57:16.41ID:???

>>53
認知行動療法みたいなことはできる
ネガティブな思考がぐるぐるしてるとき
客観的な意見いれるとか
よかった探しとか

GPTでやっとるけど救われる
ローカルでやるにはワイの技術がまだ足らん……

0057名無しさん＠ピンキー

2025/03/24(月) 16:17:16.34ID:???

>>51
いや元が「低スペモデルは玩具すぎて飽きるから低スペニキがいなくなった」って話だったからさ
その低スペモデルが仮に14Bくらいだとして、正直14Bと32Bじゃできることの幅自体は大して変わらん気がする

0058名無しさん＠ピンキー

2025/03/24(月) 16:49:39.07ID:???

リアル相談はGPTにしまくってる
気に食わない回答があっても突き詰めてとことんできるしね

webでできる事はローカルではやらんからなぁ…

0059名無しさん＠ピンキー

2025/03/24(月) 18:34:35.18ID:???

以前のこのスレはGPUに全部載せることにはこだわらずCPUでバリバリ(ノロノロ)動かすニキがほとんどだったがの
70Bはさすがに遅い、30Bくらいが性能と速度のバランスがいいなんて会話をしてたものだ
いつの間にかGPUに全部載せる前提になってんだな
そりゃもちろんその方がいいんだけどさ

0060名無しさん＠ピンキー

2025/03/24(月) 18:39:15.64ID:???

小説勢よりもチャット派の方にボリューム層が移ったんかな

0061名無しさん＠ピンキー

2025/03/24(月) 19:21:57.86ID:???

小説書く人とチャットする人どっちが多いかって言ったらチャットだろうな
創作人口はいつだって少ない

0062名無しさん＠ピンキー

2025/03/24(月) 19:25:14.06ID:???

>>55
>>56
>>58
そっかサンクス

カウンセリングの代わりをさせたくて

0063名無しさん＠ピンキー

2025/03/24(月) 19:36:40.90ID:???

高性能で格安な新興WebサービスがローカルLLMの上位互換になったからでしょ
ローカルLLMは遅いのを我慢してまでやるもんじゃなくなった

0064名無しさん＠ピンキー

2025/03/24(月) 19:48:22.51ID:???

昔はローカルLLMがWebサービスより高性能だったみたいな口ぶりだけどいつの話？

0065名無しさん＠ピンキー

2025/03/24(月) 19:49:16.55ID:???

そんな時代は無い

0066名無しさん＠ピンキー

2025/03/24(月) 20:05:09.18ID:???

性能じゃなく格安なのが大事なんだけど
ChatGPTしかなかった頃はまだローカルLLMの方が安かったが
今じゃエロとセキュリティくらいしかローカルの優位性がない

0067名無しさん＠ピンキー

2025/03/24(月) 20:15:26.59ID:RF3tR2lV

GPUに収める前提の話が増えたのLightChatAssistantみたいなまともに動くものが出てきたからじゃないか？
webサービス並みのものを求めてローカルLLMを始める人は少ないだろうし求めてる水準に達すればあとは速さをって

0068名無しさん＠ピンキー

2025/03/24(月) 20:16:58.40ID:RF3tR2lV

そいやRadeon直近の国内販売シェア45%に達したとか聞いたな
AI関連含めてNVIDIAと競争できるようになってほしいもんだか

0069名無しさん＠ピンキー

2025/03/24(月) 20:19:14.49ID:???

LLMをローカルで仕上げるには
・限られた中で最大効率を目指すチューナー気質
・語彙、描写力など文章における教養
・パラメータを作って管理するTRPGのゲームマスター気質
・申し訳をすりぬけるトライアンドエラーできるハッカー気質
がないとローカルは無理だと感じる
湾岸ミッドナイトみたいな世界観やけど
これ面白いと感じられない人はそもそもAIには向いとらん気がするが
LLMはその極みな気がするわ

そういやここってID非表示なんやね
発言追うの大変やけどこれ普通なんかしら
いまんとこイキってグロ画像貼る奴おらんからええとは思うけども
絵のほうで一人おるだけでエライ目にあったで

0070名無しさん＠ピンキー

2025/03/24(月) 20:20:56.76ID:???

>>66
いや格安も何もchatGPTは有料プランもあるだけで無料で使えるし昔も無料で使えたやろ

0071名無しさん＠ピンキー

2025/03/24(月) 20:27:26.66ID:???

>>68
AMDはrocmとか言うウンチ環境なので駄目です
nvidaiのCUDAが地道に頑張ってきたのにAMDは未だにWindowsに対応してない(WSLで動かす)
GPUの性能以前にやる気がねえ

0072名無しさん＠ピンキー

2025/03/24(月) 20:28:06.08ID:???

ローカルはセンシティブなことやらせるためだけに利用している

0073名無しさん＠ピンキー

2025/03/24(月) 20:28:22.08ID:???

元々このスレがそうだったように実用性よりも弄り回して評価するのが楽しい人を別にすれば
音声や画像と繋げていろいろやりたい人や自分の好きなようにカスタマイズしたい人だろうな
デカいVRAMを求めてるお人はまず間違いなくその筋や
普通のPCで実用性を求めるならそりゃwebサービスに行けとなる

0074名無しさん＠ピンキー

2025/03/24(月) 20:30:41.52ID:RF3tR2lV

>>69
>ID非表示なんやね

なんU時代の☆1~7と避難所☆1~3まではワッチョイ付きだったけど☆4から急に無くなったのよね

0075名無しさん＠ピンキー

2025/03/24(月) 20:30:48.84ID:???

ワイは推しを「何か。＋代歩のタスクランチャー＋LLM」にしたいんや
なので頑張って食らいついていきたいンゴ

0076名無しさん＠ピンキー

2025/03/24(月) 20:39:53.17ID:???

>>74
ワイUのときはROMっとっただけで、いじるようになったのは最近の新参やけど
Uはスクリプトに蹂躙されてログ追うのもキツイし
絵のほうでも半ネームドが出てきて荒れて
技術ニキほど寡黙になっていくんが辛くてのう

ふと思い出したんや
ワイはワッチョイ有りでもなんでもええで

0077名無しさん＠ピンキー

2025/03/24(月) 20:47:59.73ID:???

ローカルモデルの問題は日本語応答による性能ロスが看過しがたいくらい大きいことだから、日本語応答性能をベンチマークにしたらローカルLLMって意味ある？になるのは避けようがないような
英語応答で問題ない領域を攻める必要があるんじゃないの

0078名無しさん＠ピンキー

2025/03/24(月) 20:51:25.71ID:mmyDiBpb

ワイは今のとこエロが全ての原動力になってるわ
イリュージョンが世界に目を向けてソフト路線になって改造もNGになったのは日本の損失やと思ってる
3DモデリングとかVRの技術はAIと組み合わせて昇華して欲しかった

0079名無しさん＠ピンキー

2025/03/24(月) 20:58:46.18ID:???

14Bや32Bモデルはベンチマーク性能は劇的に上がってるけど日本語性能はうんちだからな
モデルを小さくする以上何かが切り捨てられるのは避けられないから日本人のローカル勢は決して救済されない運命

0080名無しさん＠ピンキー

2025/03/24(月) 21:04:37.76ID:???

楽天とかrinnaもだめ？

0081名無しさん＠ピンキー

2025/03/24(月) 21:11:14.46ID:???

3DエロゲはVaMが強すぎる
VaM2はAIとの連携も視野に入れてるらしいから早く出て欲しいわ

0082名無しさん＠ピンキー

2025/03/24(月) 21:20:25.33ID:???

>>75
素人考えだけど、伺かだったら
栞でイベントをプロンプト変換→応答が構文になるように仕組んだら一応動きそうには思えるけど、どうなんだろうなあ

モデル側は基本的な構文を大量のデータ、例えばSSTPbottleのログ100万件くらいでQLoRA学習→マージしてスクリプトが使えるようにした後に
作りたいキャラの口調と絵柄パターンを更にQLoRA学習させてLoRA適用すればなんとかなったりするんかね

0083名無しさん＠ピンキー

2025/03/24(月) 21:28:37.70ID:???

Deepseek V3 0324

0084名無しさん＠ピンキー

2025/03/24(月) 22:09:04.91ID:???

動かないとかおま環やろ (なお 685B params)

0085名無しさん＠ピンキー

2025/03/24(月) 23:13:11.25ID:???

v3 0324、日本語も一回り良くなってる気がする

0086名無しさん＠ピンキー

2025/03/24(月) 23:30:55.72ID:???

Appleの中のMLXの人
https://x.com/awnihannun/status/1904177084609827054
「4 ビットの新しい Deep Seek V3 0324 は、mlx-lm を搭載した 512GB M3 Ultra で> 20 toks/秒で動作します。」

0087名無しさん＠ピンキー

2025/03/24(月) 23:37:44.32ID:???

>>85
どこか試せるところある？

0088名無しさん＠ピンキー

2025/03/24(月) 23:55:26.59ID:???

>87
https://www.reddit.com/r/LocalLLaMA/comments/1jioxgl/deepseek_v3_minor_update/
こうあるから公式V3は全部入れ替わってるみたい

0089名無しさん＠ピンキー

2025/03/25(火) 00:07:24.50ID:WQlq82lr

https://i.imgur.com/RqdvoiI.png
AGIやろこれ

0090名無しさん＠ピンキー

2025/03/25(火) 00:10:50.07ID:???

前スレ392の音声聴いてからワイも興味持ってモデル探したりしたけどなかなか良い感じのが見つからん…
声質とか抑揚とかすごく好みだったからもし良ければモデルupしてクレメンス

0091名無しさん＠ピンキー

2025/03/25(火) 01:37:52.69ID:???

R1とV3って何が違うんだろ

0092名無しさん＠ピンキー

2025/03/25(火) 07:03:34.45ID:???

>>82
ワイ初心者すぎてニキの言っとることろくに理解できんけども
メモらせてもらったで！
できそう、ってのだけでも今日を生きる希望になるわ

0093名無しさん＠ピンキー

2025/03/25(火) 07:38:47.81ID:???

>>86
20tk/sもでるのか。MoEだから一つ一つは小ぶりというメリットでてるな
Gemma3も27Bx4くらいで出して欲しい

0094名無しさん＠ピンキー

2025/03/25(火) 07:54:46.80ID:ypNY41r1

>>91
chain of thought (CoT)で推論(Reasoning)するか否かやろ

0095名無しさん＠ピンキー

2025/03/25(火) 08:17:49.27ID:???

>>88
openaiに対策されたからclaudeでデータ生成したのかな？

0096名無しさん＠ピンキー

2025/03/25(火) 08:37:38.84ID:BZNQpbdI

DSV3、600Bも700Bもいらんから、
コーディングタスクや小説用のタスクだけ活性化する
エキスパート部分だけ分離して欲しい。

丸ごと動かしても、
マシンリソースの無駄遣いじゃねーか。

0097名無しさん＠ピンキー

2025/03/25(火) 08:50:47.81ID:???

R1はV3に数学の問題を自分で解かせる事後学習をしたモデル、と言われてる
数学が解けるようになると、何故か色々なことが出来るようになったよという

V3改はClaudeというよりはプログラミングコードを大量に学習してる、とかかな？
いま現在求められているのはそういうモデルですし
R1が数学を自分で1から解かせて事後学習をさせたように、今度出すR2はプログラミングを自分で1から解かせて事後学習をしました、と言い出すかもね

0098名無しさん＠ピンキー

2025/03/25(火) 11:43:37.10ID:???

https://joisino.hatenablog.com/entry/physics
コレ面白いな。
線形モデル(LLM的な高度な解釈能力を持たないモデル)にLLMの内部情報を食わせると、理解出来るところと出来ないところに分類できる、線形モデルに理解出来るほど整理されているなら、LLM自身にも理解出来ている情報と見なせる。
このプローブを使ってLLMの頭のなかを分析してみたよって話。

0099名無しさん＠ピンキー

2025/03/25(火) 15:47:01.81ID:???

>>98
ベンチマークは陳腐化していくって話はベンチスコア詐偽とか有るらしいから納得
間違いを認識していても訂正方法を事前学習してないから訂正できないだけで
事前学習で訂正方法を学習させれば訂正出来るようになるって話は面白いな

0100名無しさん＠ピンキー

2025/03/25(火) 15:50:39.15ID:???

>>98
よくまとまってるね。紹介ありがとう

0101名無しさん＠ピンキー

2025/03/25(火) 16:00:52.74ID:???

結局人間の脳みたくなってるっていうね

0102名無しさん＠ピンキー

2025/03/25(火) 16:05:21.67ID:???

DeepSeekV3がチャットアリーナでR1や推論無しSonnet3.7の順位を逆転
これはR2の性能は噂通りトップを伺いそうだな、まあどうせ日本語はウンチなんだろうけど

0103名無しさん＠ピンキー

2025/03/25(火) 16:49:03.61ID:???

知識はあるのに上手く取り出せないのが構造上の問題となると
今までとは全然違うモデルが出てくるまでハルシネーションは解決しそうにないな
7Bで英語wiki暗記できるとかヤバいわ

0104名無しさん＠ピンキー

2025/03/25(火) 17:15:25.33ID:ypNY41r1

>>98
正直1ミリも理解できなかったが"LLMは途中で間違いに気づいている"ってのは面白かったわ
推論途中で「おっ、ワイ間違えてるやんけ」と気づいて訂正してくれたら
しょうもないミスだいぶ減って快適になりそうやね

0105名無しさん＠ピンキー

2025/03/25(火) 17:17:17.72ID:???

新しいV3触ったけど日本語性能は100B程度のCommand A以下だと思う

0106名無しさん＠ピンキー

2025/03/25(火) 17:26:29.62ID:???

画像生成用の自然言語プロンプトを組むのにLLM導入を考えています
用途としては「海辺に一人の女の子」等の最低限の指示からシチュエーションを膨らませて200~400トークン程度の英文プロンプトを作ってもらおうかと思ってます
要はLLMで自然言語プロンプトをランダム生成してもらいたいということです

今の環境はグラボ4060ti16GB 本体メモリ64GB Python Git導入済です
導入に使えるストレージはSSD1TB HDD2TBの余裕はあります
LLM環境は一からの構築になるのでよろしくお願いします

0107名無しさん＠ピンキー

2025/03/25(火) 18:17:57.76ID:???

[break]トークンを打って考え直すワザを学習時に見せとけば自分で訂正できるようになる、というのは面白いところだよね
既存のモデルがスッとv1.1を出してくる可能性ある

0108名無しさん＠ピンキー

2025/03/25(火) 18:45:38.69ID:???

DeepSeekはChatGPTみたいに言語関係なく常に自国政府に忖度してるんじゃなくて
聞かれた言語に合わせて答えるように調整されてるんだよな
そのせいで日本語で聞くと日本語の乏しい情報ばっか参照するから余計にしょぼくなる

0109名無しさん＠ピンキー

2025/03/25(火) 19:27:12.43ID:???

>>98
これはすげー面白いね、お勧めだわ

0110名無しさん＠ピンキー

2025/03/25(火) 20:32:11.19ID:???

>>106
まずは、導入が簡単なLM Studioを試してはどうでしょ
https://lmstudio.ai/

このツール上からLLMを検索して入れる事が出来るし、ローカルでチャットも出来る
danbooru語とかの単語を幾つかチャットで与えて、それらの単語から自然言語を書かせたり出来る
規制の掛かってるLLMはチャットで脱獄させればエロいのもいけるし
プロンプトをバッチ処理で大量に自動生成したいって用途でもなければこれで良いかなと

0111名無しさん＠ピンキー

2025/03/25(火) 20:33:20.72ID:???

このスレ急に知的な流れになるから怖い
普段変態なのに

0112名無しさん＠ピンキー

2025/03/25(火) 22:42:28.93ID:???

>>98
最初だけ読んだけど、面白いね。これはちゃんと腰据えて読んだ方が良さそうって思った
それはそれとして、「インターネットのコーパスで学習したモデル＝攻殻機動隊の人形使い」
とイメージが被るせいでそれが自滅的なノイズになって読みづらい

0113名無しさん＠ピンキー

2025/03/25(火) 23:33:53.87ID:???

頭悪いエロ漫画みたいな表現してくれるモデルに出会えとらん
gemma3はそんなに喘いでくれない

0114名無しさん＠ピンキー

2025/03/26(水) 00:14:04.69ID:Fdx3Lv+2

>>90
簡単にモデル学習できるのがSBV2の強みだから自分で作成するのお勧めやで～
SBV2のGitに全部書いてあるし、Youtubeにチュートリアルあるはずやで！

0115名無しさん＠ピンキー

2025/03/26(水) 00:39:18.60ID:???

>>113
ローカルじゃ試してもダメだったから厳しそうだけどGrok 3なら頭悪いエロ漫画みたいな表現してって言うとやってくれた

0116名無しさん＠ピンキー

2025/03/26(水) 01:02:54.12ID:???

>>114
最近良いグラボ買えたから沼に浸かってみるで！
声優とか音声素材とか全然詳しくないから誰の声使えばああいうモデルが出来上がるか皆目見当もつかんけどな！

0117名無しさん＠ピンキー

2025/03/26(水) 01:32:02.14ID:???

>>98
関連記事にあるものも面白くて読み応えあるなあ
以前話題になった敵対的ノイズの話とか認識がひっくり返された

0118名無しさん＠ピンキー

2025/03/26(水) 03:04:32.85ID:???

>>110
ありがとうございます
LM Studio試してみます

0119名無しさん＠ピンキー

2025/03/26(水) 03:33:03.99ID:???

>>106
それならTIPOでいいんじゃないの？
a1111の拡張機能とComfyUIのカスタムノードがあって
LLMを使用して自然言語とタグの両方を生成できる

0120名無しさん＠ピンキー

2025/03/26(水) 07:44:56.58ID:???

>>115
頭悪いエロ漫画の表現ってどんな？
作例プリーズ

0121名無しさん＠ピンキー

2025/03/26(水) 07:53:36.60ID:???

今までAIのべりすとを使ってて今月になってからEasyNovelAssistantを導入した新参なんやけど
のべりすとでいう「セリフを優先して出力」「地の文を優先して出力」の指示はどうやってすればええの？
それぞれの描写に適したモデルに都度切り替えてくしか無い感じか？

0122名無しさん＠ピンキー

2025/03/26(水) 08:39:53.09ID:???

>>121
セリフ中心の文章にしてくれって指示したらできんかな
〜してる会話を書いてくれって指示すると
会話のみのシナリオになる

0123名無しさん＠ピンキー

2025/03/26(水) 08:43:46.28ID:???

>> 106
EasyReforge のTIPO使った方が早くないか？
あれもLLMとことるんやで

0124名無しさん＠ピンキー

2025/03/26(水) 08:47:08.87ID:???

>>116
BGMのない朗読をYoutubeから探して学習するとこから始めてみては。思ったより簡単だと思う
スレチすまん

0125名無しさん＠ピンキー

2025/03/26(水) 09:19:31.73ID:???

変態という名
>>98
こういう研究て日本でやってないの？🤔

0126名無しさん＠ピンキー

2025/03/26(水) 10:03:55.58ID:???

エロ漫画みたいな頭の悪いセリフと言えばBerghof-ERP-7Bとかやな
他のモデルでも「性格:変態」「語尾に♡」とか設定するとセリフが頭悪くなる傾向にある

0127名無しさん＠ピンキー

2025/03/26(水) 10:11:06.53ID:???

geminiが3/25以降常にthinkするモデルに差し替わったらしい
chatarenaでいきなりトップに出とるね

今後thinkモデルが当たり前になるんだろうか
token量増えるからあまり好きじゃないんよね
ロールプレイにもあまり向いてない気がするし

0128名無しさん＠ピンキー

2025/03/26(水) 10:44:09.82ID:???

画像生成でTIPOを入れてる時期が俺にもありました
いつの間にかSTを入れてRPチャットをやろうとしている

0129名無しさん＠ピンキー

2025/03/26(水) 10:47:27.90ID:???

>>126
何にも指定してないのにアナルに突っ込んだ時だけおほっ♡とか言うの日本のエロ同人に対する解像度高すぎで草

0130名無しさん＠ピンキー

2025/03/26(水) 10:50:58.72ID:???

非推論モデルの知見を捨てて推論モデルだけを研究とはならないだろうし大丈夫じゃないか？
最近出たdeepseek v3は非推論だし

0131名無しさん＠ピンキー

2025/03/26(水) 11:11:14.32ID:???

>>127
ロールプレイはそうかもしれんけど、一般的な用途は多少のデメリットがあっても賢くないと使いにくいよ
直近のQwQ-32B、Gemma 3 27B、Mistral Small 3.1 24Bで比較しても
QwQ-32Bが一番プロンプトの理解力が高くて、指示に従ってくれる

0132名無しさん＠ピンキー

2025/03/26(水) 12:20:11.20ID:???

グラボメモリが12gだとMistral Small 3.1 24Bしか選択肢ないけどそれでもめちゃくちゃ賢い

0133名無しさん＠ピンキー

2025/03/26(水) 14:54:11.44ID:???

token増える問題は確かにだけど2.5proはthoughtも出力も優秀だから食うだけの実力はあると思う

0134名無しさん＠ピンキー

2025/03/26(水) 14:54:29.78ID:???

llmで画像生成補助の話ならなんUへ行ったほうが識者が多そうだが
いまchatgptの画像生成で盛り上がってるし

0135名無しさん＠ピンキー

2025/03/26(水) 15:29:53.66ID:gZuqN0s2

>>いまchatgptの画像生成で盛り上がってる
なんかあったんか？

0136名無しさん＠ピンキー

2025/03/26(水) 16:46:41.43ID:???

ちょっとﾜﾛﾀ
https://files.catbox.moe/on9l3v.jpg

0137名無しさん＠ピンキー

2025/03/26(水) 16:49:27.11ID:???

nvidiaがProject G-Assistの一般提供を開始してるな
nvidiaのローカルLLMがゲームプレイをアシストします。という話だったのが、こっそり方向転換してプラグイン形式でローカルLLMに機能を追加できますと言い出してる

ローカルLLMが文章、音声を手元でCLIなコマンドに変換して、MCPなりで他のLLM
に投げてくれる。と言うならだいぶ使い道あるよね

あとこいつGPUドライバが知ってる情報をある程度、あるいは全部読める可能性ある

0138名無しさん＠ピンキー

2025/03/26(水) 17:06:31.90ID:???

ネックなのはUIだけだから、緑色したキャラクターが画面下からにゅって出てきて応答するUIを作るだけで、デスクトップコンパニオン戦争で勝てる可能性ある
のだのだ言い出すとか...

0139名無しさん＠ピンキー

2025/03/26(水) 19:21:31.77ID:???

伺か？

0140名無しさん＠ピンキー

2025/03/26(水) 19:26:07.08ID:???

イルカを忘れるな

0141名無しさん＠ピンキー

2025/03/26(水) 19:39:30.95ID:???

Live2DもAIで錬成出来るようになればいいのに
あとはアバターアプリをLLMと繋げば令和の伺かが完成する

■ このスレッドは過去ログ倉庫に格納されています