記事へのコメント33件

    • 注目コメント
    • 新着コメント
    Imamura
    RAM32GBではCoderのみか…でもこんな低スペックでも125Bモデルを動かせるとはすごい時代になった

    その他
    torish
    試してみよう。ちょと昔のパーツぶち込んだらつかえるかも??バック・トゥ・ザ・フューチャーのデロリアンにゴミでも何でも掘り込んでた感じになるのかな?

    その他
    ryunosinfx
    いつもどおりAMDがハブられてて草(Github上ではちゃんとRX9070XTも乗ってる)

    その他
    agricola
    R9 3900X/DDR4-2666 64GB/RX6600 8GBの俺の愛機が……不安定なんすよ(涙)。もっともR9 5900XT/DDR4-3200 128GB/Radeon AI PRO R9700が控えてるけどな。あとRTX 2000 Adaもホストがメモリ障害で死んでから稼働してない(をい

    その他
    misshiki
    StrataはGPU・CPU・RAM・SSDを使い、125B級MoEをVRAM 12GBのGPUでも実行する推論エンジン。RAM 64GBを推奨し、OpenAI・Anthropic互換APIに対応。仕組みや測定結果、導入手順を解説。

    その他
    Abba
    まさかのRAMがいるのか 時期が悪いが買うか…

    その他
    collectedseptember
    GPUからメインメモリにスワップしてるのか

    その他
    ardarim
    VRAMもシステムRAMも足りないワイ低みの見物

    その他
    harumomo2006
    しかしメモリが足りない

    その他
    taguch1
    楽しみ

    その他
    strawberryhunter
    すごい。GPUを買うならNVIDIAだな。まだ数年はNVIDIAの優位性は続く。

    その他
    rgfx
    あ、32GB環境向けのも出てたんだ

    その他
    ys0000
    Qwen3.8 FlashはQ4でも性能いいからなぁ。Strataのようなツールにすがる気持たはよくわかる。

    その他
    shinoppie
    shinoppie 喋るっぽくしてるだけでツールは動かないからエージェントを動かしたりとかはむりだよ、とAIさんにいわれてがっかり

    2026/10/02 リンク

    その他
    kurage_lizard
    kurage_lizard 安い時に不要と思いながらもRAM64GBにしておいた過去の自分を褒めたい

    2026/10/02 リンク

    その他
    TriQ
    TriQ VRAM12GBでマジか!となってRAM64GBでマジか…ってなった人結構多いと思うw

    2026/10/02 リンク

    その他
    totoronoki
    これで125B の2Bit量子化モデルを入れてるが、なかなか賢い。速度もそこそこ。

    その他
    hirokinko
    PC故障で色々交換したタイミングに!

    その他
    Yagokoro
    巨大モデルがローカルで動く時代が来てるの凄いわ

    その他
    tyhe
    tyhe ひと世代前のRyzenと4070TiとDDR5 64GBだからギリギリ試せそうかなー。試してみるかー。

    2026/10/02 リンク

    その他
    rdlf
    AppleのAFM 3 Core Advancedみたいなものかな?これでメモリ依存しなくなるのはいいけどモデルがデカいのでストレージを圧迫する問題が…

    その他
    yorkfield
    yorkfield 一日に数回のリリースがされてる。開発の勢いが凄い。 https://github.com/Niko1221/Strata/releases [追記]量子化手法のGSQ-RCOは、3.5bitでも性能があまり落ちないらしい? https://huggingface.co/ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF

    2026/10/02 リンク

    その他
    fusionstar
    fusionstar LM Studio で 27B 動かすより速く 125B が動くのはほんとに驚いた。 PC のリソースほとんど食っちゃっててほかのこと何もできなそうだったけど。

    2026/10/02 リンク

    その他
    kyahi227
    kyahi227 一般的にコンテキストのQ8未満、モデルのQ4未満は回答一発目では調子がいいが、ツールコール文法が保てなくなるなど支離滅裂になって使い物にならないと言われてる。それでも良いならどうぞという類。

    2026/10/02 リンク

    その他
    ssfu
    昔、Strata Studioって、3Dツールあったなあと思いだすなど。

    その他
    shinobue679fbea
    shinobue679fbea FreeTokenのQwen3.8Flash最適化、ですな。Qwen4Flashが本命だろうけど、これのために50万くらい突っ込む価値あるかもね、ローカルで検閲緩いLLM使いたい人は

    2026/10/02 リンク

    その他
    Retset
    GemmaやQwen3.6 A3Bなどは使えないのかな?

    その他
    sucelie
    マシだけどメモリ64GBはまだきついなぁ

    その他
    kotaponx
    RAMはDDR4ならどうにかなるのだけど、GPUはAmpareとかPascalだからなぁ……

    その他
    urtz
    まるで魔法のような

    その他

    注目コメント算出アルゴリズムの一部にLINEヤフー株式会社の「建設的コメント順位付けモデルAPI」を使用しています

    アプリのスクリーンショット
    いまの話題をアプリでチェック!
    • バナー広告なし
    • ミュート機能あり
    • ダークモード搭載
    アプリをダウンロード

    関連記事

    12GB VRAMで125Bモデルを動かす「Strata」の概要|npaka

    1. はじめにローカルLLMでは、GPUのVRAM容量が大きな制約になります。特に100Bを超えるモデルは、量子化...

    ブックマークしたユーザー

    • chaki10292026/10/06 chaki1029
    • ato162026/10/06 ato16
    • Watson2026/10/04 Watson
    • Imamura2026/10/04 Imamura
    • Wacky2026/10/03 Wacky
    • garoyuki2026/10/03 garoyuki
    • sora05132026/10/03 sora0513
    • o2aholic2026/10/02 o2aholic
    • morioka2026/10/02 morioka
    • ozkey2026/10/02 ozkey
    • torish2026/10/02 torish
    • ryunosinfx2026/10/02 ryunosinfx
    • ryotaf11162026/10/02 ryotaf1116
    • NOTG2026/10/02 NOTG
    • agricola2026/10/02 agricola
    • kinushu2026/10/02 kinushu
    • pipo2026/10/02 pipo
    • mirakux2026/10/02 mirakux
    すべてのユーザーの
    詳細を表示します

    同じサイトの新着

    同じサイトの新着をもっと読む

    いま人気の記事

    いま人気の記事をもっと読む

    いま人気の記事 - テクノロジー

    いま人気の記事 - テクノロジーをもっと読む

    新着記事 - テクノロジー

    新着記事 - テクノロジーをもっと読む

    同時期にブックマークされた記事

    いま人気の記事 - 企業メディア

    企業メディアをもっと読む