新しいものを表示

動くことと、実用的な速度で動くことは別なのです。

スレッドを表示

結果を書くと巨大コンテキストが流れてくる環境で(その辺のPCでの)ローカルLLMはなかなか難しいッス。そんなに待てないよ。

スレッドを表示

いつからオレはAIにAIのベンチを取らせるとかいう悪い遊びを思いついてしまったのだろう…

なにこれ?って思ったら、

これは **ホテル・旅館向けの「サイトコントローラー」**です。かなり重要な位置にいるシステムですね。

だって。

---

手間いらずの「TEMAIRAZU」シリーズへの不正アクセスについてまとめてみた - piyolog -
piyolog.hatenadiary.jp/entry/2

忘れてた。返品作業しなきゃ。

うーわ、悲惨

---

Pyron (@GabrielPyron) on X
ポルトガル語からの翻訳

SEGAやゲームの権利を持つ他の保有者のライセンスなしで、SteamでWonderboyの再コンパイル版を売っているようです。

彼らは詐欺師の新しいレベルに達しました、そして最悪なのは、すでに10k以上のコピーを売ってしまったことです。

x.com/GabrielPyron/status/2104

おかしいなぁ。X で LLM の情報収集したいのに、変な自慢話ばっかり流れてくるようになった。「なんで年上に教えてやらないといけないの」「会社なんかどうでもいい」って。じゃあ起業すればええやん。

ベンチ取るの遅いから並列化してよって言ったら「既にしてます💢 」って怒られた。そうだよね…

スレッドを表示

Android 通話スクリーニングで応対したら100%切るからすぐ分かるね。あれ録音してるしね。

スレッドを表示

Google が迷惑電話と断定したので
080-9201-9834
070-4210-4813

いやそれでも旧世代だと Prefill だけで10分とかかかってたから驚異的に速いわ…

スレッドを表示

Qwen Next 凄いな。巨大プロンプトでもキャッシュが効くぞ。(キャッシュが効くというだけで遅いマシンだとやっぱり速くはない。) 

80BモデルのB1で部分再利用が発動: cached=32,768/52,094トークン(62%)→ TTFT 58.3秒(コールド122.8秒の-53%)。80BはKVキャッシュのトークンあたりサイズが小さい(ハイブリッド線形注意のQwen3-Nextアーキテクチャ)ため、共通プレフィックスがキャッシュ単位に収まり、radix部分一致が実動作しました。一方gpt-oss-20bでは同じB1がフルprefillだったのと対照的です。

スレッドを表示

面白すぎるけどそれでこそエンジニアって感じするw

Tora :neko_gray: さんがブースト

イカすクラスタを作りたかっただけなのになんで僕は板金加工について調べてるんだろうな?

ふーん。大した事ないな。もっと巨大プロンプトでテストさせるか。

スレッドを表示

本当はそんなどうでもいいモデルじゃなくて Qwen Next をテストして欲しい。(オレの指示の仕方が悪い。)

スレッドを表示

もう Z.ai のトークンが余って余って仕方がないから、3 台の Mac を使ってどれが一番速いか HermesAgent (Z.ai / GLM 5.3 Flash)にテストさせるっていうのをやってる。

とにかく部品点数の少ない方法でなんとかしろ

スレッドを表示
古いものを表示
:realtek:

思考の /dev/null