新しいものを表示

お世話になっております(お世話してやっております)

結局 OOM で死なないように気を使いながら Rapid-MLX 使ってる。これしかないのかなぁ。

スレッドを表示

LLMフレームワークって結局どれが一番いいんだろう。

Rapid-MLX
速い。Out of Memory 対策がない。野心的だが安全寄りではない。

vllm-mlx
期待外れ。速くはない。誰だよこんなの勧めたの。

OptiQ Serve
メモリ保護が厚く、情報の使いまわし(キャッシュ制御)に長けているようだが決して速くはない。

単数形と複数形をきっちり分けるのは良いけど

Parts(パーツ)
Part_types(パーツの種類)

って混乱しそう…。戻していい?

スレッドを表示

これ単数と複数をきっちり理解せずに人間が直したら動かなくなるヤツだ

スレッドを表示

なんかAIにリファクタリングさせたコード、変数の中の単語の単数形と複数形がきっちり名前分けされていて感心する(するな)

オレの●●●が火を噴くぜ!

ってこと!?(違)

Tora :neko_gray: さんがブースト
Tora :neko_gray: さんがブースト

いずれにせよ超好待遇とかでもない限り、行きたいって思う人はほぼ居ないのでは。

警察ってドラマだと、モニター10台くらい並べて防犯ビデオの録画を10時間くらい見せられてるけど、あれ本当にあるんだったらなんて前時代的なって感想しか出てこない。

自衛隊とかさ、駐屯地公開日に見に行ったら「絶対こんな仕事嫌だな」って思っちゃった。食堂に「幹部専用」って書いてあるんだぜ。嫌なら初めから建物分けろや。

柔道は別にいいが(よくないが)、帰れないような仕事に安易に就きたくはない

!?!?!?

Windows Recall(画面全録機能)を Mac でってこと!?

---

ChatGPTがMacの全操作を記憶して起こること AIの競争は「文脈」「ナレッジ」に【西田宗千佳のイマトミライ】-Impress Watch -
watch.impress.co.jp/docs/serie

今の Arrows って、かつての Xperia のマーケットを食ってそうだな。野暮ったくない表面、伝統的な裏面、高すぎない価格。

---

薄型狭額縁で「世界最高の頑丈さ」!超カッコよくなった「arrows Alpha2」、8月27日発売 - すまほん!! -
smhn.info/202608-arrows-alpha2

うちの環境の場合、Prefill 地獄でモタつくから、それをなんとかしたい

ChatGPT要約

結論から言うと、LLM-jp-4-33BはQwen3.8-27Bにかなり肉薄しており、日本語中心なら十分「選択肢になる」水準ですが、実運用上の速度・効率ではQwen3.8-27Bがかなり有利、という内容です。

スレッドを表示

国産?

---

【ローカルLLM】国産LLM「LLM-jp-4-33B」と「Qwen3.8-27B」の推論性能比較(RTX 5070 Ti + RTX 3070 Ti) - Qiita -
qiita.com/h-nabata/items/b8048

5時ってこんなに暗かったっけ。

古いものを表示
:realtek:

思考の /dev/null