Recent posts
すごい!AIキショ料理画像がちゃんと再現されてるテク初めて見たかも

話題のキモ画像、ChatGPTで生成後の画像に対する修正を繰り返すと再現できた!! あれってのノイズの結果だったのか、規則性を増やして情報量を減らしたがる癖があるのかな




最近はさすがに「DeepSeekこわい〜」とか言ってるスットコドッコイも消えたかな。あ、日本政府はいまだに「中華AIこわい〜」つってわざわざFuguから中華AI外すんだっけ。それで米国AIが爆値上げしたり遮断されたりしたらどうすんの?リスク分散しなきゃだよ。米国AIリスクに怯えるハメになる日本政府とすでにDGXSparkローカルLLMで一生安心してる個人との格差ね

仮にOpenAIやAnthropicサブスクのサブスクが吹き飛んでAIが定額で使えなくなっても、200万円でDGX Sparkを2台買うか、420万円でRTX 6000 Proを2枚買えば「自宅でDeepseek V4 Flashが動くという真実」があるので心の平成を保っていられる
FreeTokenでRTX5090とメモリ128GBでDeepSeekV4Flashが28tpsでDGXSparkより速いって。たしかに感心するけど僕は2bit量子化はちょっと実用しないかな

RAM:DDR5-5600 128GB GPU:RTX 5090 32GB モデル:DeepSeek-V4-Flash Q2_K(約97.6GB) FreeToken/MoEキャッシュ839 Prefill:約179~200 tok/s 生成:約28 tok/s でした(たぶん??) 全RAM常駐でも23t/sだったけど、DGXSparkより速度でてるらしいので技術ってすごいなあと思いました
米国AmazonでDGXSpark互換機が70万円って話はSSD1TB版の話であって4TB版だと95万円で日本での100万円と大差ない。まあ4TBのSSDなんて8万円くらいで売ってるから1TB版買ってSSD差し替えりゃいいと思うけど
AIデータセンターのせいでAIデータセンター費用高騰。アホくさ

*エヌビディアが顧客に15%超の値上げ通知、AI半導体含む製品=Bloomberg *NVIDIA CUSTOMERS NOTIFIED ABOUT AI-RELATED PRICE HIKES ABOVE 15%: BBG
まあ投資するリスクもあれば投資しないリスクもある。ここ4年間でインフレによって円の購買力は14%減ったという。銀行預金は実質的に14%目減りしたという事です。預金のリスクも大概や

100年の平均利率はたしか7%なのにここ数年18%の利率になってるってことは、いつもより皆が熱狂してるってことでもあります。 あと世界恐慌の時には株価は半減し、そのあと価格が戻るまでには20年かかったので、そのくらいのリスクは覚悟が必要です。
Notionにメモ書きしました 26/08/23 全世界株式インデックスファンドについて思う事 https://six-loganberry-ba7.notion.site/26-08-23-3c5f7e7600e980968307d14b8edc04c7
ComfyUIのH3トークナイザが修正。今までよりプロンプトの効きが良くなるかも https://www.reddit.com/r/StableDiffusion/comments/1vvrlxg/new_comfyui_update_may_change_how_minimax_h3/
会社の中で自分だけAIバリバリやって加速しても周りは付いてこれなくてむしろいい迷惑という話らしい。まあそんなもん。チンタラ仕事してても給料もらえてる内はラッキーかもね。全員AI加速が前提の世界になったらしんどいぞ。3倍仕事したって給料3倍になる訳じゃなし

生々しい話。AIは個人としては生産性を上げるが、組織としての生産性が上がらない理由がちゃんと言語化されてる。 「製造業から見れば、あの業界の議論は他人事ではなく、数年後の自分たちの姿である。」 https://zenn.dev/factory_dx_eng/articles/ai-productivity-team-divide #zenn
なーんだ、FreeTokenでRTX5090でDeepSeekV4Flash動かすにはメインメモリも192GB必要だって。DDR5メモリを192GB買うと70万円コース。RTXPro6000でGLM5.2を動かすならメモリ512GB必要でサーバ用のマザボ、メモリになるので333万円コースらしい。それだとDGXSparkガン積みするのとコスト変わらなくなってきてませんか?

FreeTokenを使えば、5090やA6000でもDeepSeek-V4-Flash 284Bが動く??というので、調べてみたけど、RAMがデカくないとだめらしい。 Codexによると、 RAM:最低でも192GB級、できれば256GB というのが条件らしく(よく考えたらそりゃそうか)、ウチの環境では諦めました。
FreeTokenショックの影響かなにか知らないが、海外のどっかでDGXSparkが400ドル値下げに。このグラフ見りゃ分かるけどDGXSparkのメモリ帯域幅はショボすぎ。LLM推論の場合、みんな帯域幅欲しさにGPU買ってるまであるので低速ではこまる。この程度の帯域幅ならDDR5のメインメモリ(8チャンネル)でも出せる

@TheAidenWagner from @TheAhmadOsman

HDRIのような360°パノラマ画像をH3に入力する事でロケーションの背景全体を伝える事ができるかもという話 https://www.reddit.com/r/StableDiffusion/comments/1vvpowd/psa_minimax_h3_can_turn_360_panorama_images_into/
Anthropicは自分がトップAI企業のくせにアンチAI団体に大量に献金して「AIはヤバい!人間はAIに仕事奪われる!」ってアンチAI宣伝させまくってるらしい。いつもながら意味不明

Time to boycott Claude.
米国の有名な元NFL選手のジェイソンケルシーがビール会社と飲料水会社の宣伝として、「AIデータセンターは水が一杯必要で大変らしいからみんなでボトルに小便入れて送ってあげようぜ!」とジョークで呼びかけ。これ自体はくだらないマーケティングでどうでもいいんだが、問題は彼のような国民的タレントがファッション的にアンチAI的な事やっても支持されるくらいには米国民はAI企業とデータセンターをメチャ嫌いまくってるというシグナルだろうという話 https://t.co/204sHs02g9
FreeTokenによってRTX5090でDeepSeekV4Flashが25tps、RTXPro6000でGLM5.3が15tps出ちゃうらしい。えらい事になったな

Your gaming PC can now serve frontier models at interactive speed using official checkpoints without extreme quantization! Qwen3.6 35B → 8GB RTX 4060 laptop @ 39 tok/s DeepSeek-V4-Flash 284B → RTX 5090 desktop @ 22-25 tok/s GLM-5.2 753B → RTX PRO 6000 workstation @ 15 tok/s Run your claude code or codex now with frontier model for $0 Meet FreeToken 🧵
H3のSLAAttentionのノード試してみたけどたしかにこれは効く!長尺、高画質ほど効くらしいので0.9MP、15秒尺で試したらSLA使わなかった場合は421秒に対してSLA使ったら300秒!3割くらい速くなった。動画品質は劣化したかは分からんけどちょっとだけ変わる。ちなみにSLAとSageAttentionPatchは併用できないっぽいので代わりにCKAttentionと併用した
無金利ローンでDGXSpark買って即転売してオルカンにぶち込むだけで元手かからずに儲かりそう

なんと無金利なので痛くも痒くもないです
AI動画だとしても観れちゃうなあ。以前からググガガがかわいいだけで観れてたけど尺も増えて内容もオモロくてホンマすごくなってきてる

フィビチュピとフィビチュピの友達がゲームの世界へ行く
DGXSparkが全一wwwおめでとうwwwキオクシア全一の流れを思い出す

DGX Sparkが価格comのデスクトップPCランキングで1位に。これが売れているのか、それともほかが売れてないのか

H3とQwen3.8-27BがすごすぎてローカルLLM熱過熱するのも分かるけどだからといってDGXSparkはそれは違う。まあ動くは動くけどね…遅すぎるけど

