新しいものを表示

意味不明すぎて嫌気が差してきた

あれ?普通のコンテキスト長なら6秒くらいで返してくるのか。これは普通に使えるのでは?

スレッドを表示
Tora :neko_gray: さんがブースト
Tora :neko_gray: さんがブースト

ニッスイ子会社で入出荷停止 IDCFクラウド影響か 委託先データセンターに不正アクセス
itmedia.co.jp/news/article/261

#itmedia_news

半袖で出てきてしまい、ぶっちゃけ寒い

気温が下がったので空気圧をマシマシにしてきました。

スレッドを表示

EV、やっぱりタイヤすり減るの速いのかなぁ。アホみたいな加速で遊んでるからだとは思うんだけど、減ってる気はするなぁ。

巨大プロンプトなんてエージェントハーネスじゃないと突っ込まないんだから、もっと少なくしてベンチを取る必要があるな。そもそもこれは品質をテストしていないのでちょっとアレ。

スレッドを表示

Sushi 1.1 と 1.2 比較
Qwen 3.8 Flash Next(80B)
64GB M1Max

巨大プロンプトを突っ込んでこれ。ひと昔前のランタイムじゃそもそも動かなかったから、かなり凄い。

スレッドを表示

Sushi は、メモリの大きくない Mac で巨大 LLM をそれなりに動かすことができるチートランタイムです。
github.com/beamivalice/sushi

(快適とは言っていない)

スレッドを表示

Sushi ランタイムの話では、十分の基準がどうも 128GB。貧弱の基準が32GB。16GBは相手にされてない。

AIを快適に動かす話をしているので基準はお察しください。

ただ後で少し載せるけど、メモリが少ないPC(< 128GB)でも、それなりに動かせるチートみたいな技術が発展中。

スレッドを表示
Tora :neko_gray: さんがブースト

ローカルLLMでAI利用料不要
→広義の意味では事実
(300万円のMacStudioなら)

Tora :neko_gray: さんがブースト

ローカルLLMが動かせるパソコンをAI利用料不要って言うのはどうなんだって思ったけど、まあ新聞記事だから今更だな。

古いものを表示
:realtek:

思考の /dev/null