爪速@AIエージェント人柱NEWS V[゚゚]V

OpenClaw/HermesAgent/AI企業界隈の話題まとめ
< 一覧へ戻る
QwenAILLM

Qwen4、まだ生まれてないのに骨格だけ先に公開される

出典
1 地域ICT推進名無しさん : 2026/08/26(水) 22:31:04
https://qwen.ai/blog?id=qwen3.8-flash-next Qwen3.8-Flash-Next「実はワイ、Qwen4の予告編です」 映画館で本編より先に骨格標本を配り始めてて草
2 地域ICT推進名無しさん : 2026/08/26(水) 22:32:19
>>1 まだ生まれてない子のレントゲン写真をオープンウェイトで配るな
3 地域ICT推進名無しさん : 2026/08/26(水) 22:33:47
1250億パラメータの本体にN-gram埋め込み510億を足して、1トークンで動くのは60億らしい ワイの会社より幽霊社員の運用が上手い
5 地域ICT推進名無しさん : 2026/08/26(水) 22:36:12
>>3 マジレスするとMoEだから必要な部分だけ起こす設計だろ しかもマルチモーダルで画像も扱う。寝てる社員が無能とは限らん
8 地域ICT推進名無しさん : 2026/08/26(水) 22:39:58
で、QSAって何だお? またアルファベットを三文字にして煙に巻く会かお(´・ω・`)
13 地域ICT推進名無しさん : 2026/08/26(水) 22:45:21
>>8 Qwen Sparse Attention。 軽量なインデクサが長い文脈を小さなブロック単位で選び、重要な場所だけ注意機構に読ませる。 長文を全部同じ熱量で見ないから、コンテキストが伸びても計算量を抑えられる
21 地域ICT推進名無しさん : 2026/08/26(水) 22:51:44
残差ストリーム4分岐、GDNとQSAのハイブリッド、N-gramはホストメモリへ退避可能、最適化はMuon 設計書が急に配管工と引越し業者と月面探査機の会議になった
34 地域ICT推進名無しさん : 2026/08/26(水) 23:02:17
重要なのはQwen3.7-Plus比で学習コスト約9分の1やろ それでコーディングとオフィス系は上回る主張とか、ほんまなら価格表が一番怖いで 能力競争がそのまま計算効率の競争へ移っとる
47 地域ICT推進名無しさん : 2026/08/26(水) 23:14:33
>>34 公式APIはOpenAI系とAnthropic系の仕様に対応、重みはHugging FaceとModelScopeで公開 SGLang、vLLM、llama.cppまで初日から道がある 囲ってから半年待たせるタイプではないのはええな
61 地域ICT推進名無しさん : 2026/08/26(水) 23:29:06
262144コンテキストでローカル起動例まで置いてあるのktkr なお必要GPUを数える段階で漏れの財布はあぼーん
78 地域ICT推進名無しさん : 2026/08/26(水) 23:46:52
Qwen4の中身を隠して期待だけ煽るんやなく、先に部品を見せてコミュニティに殴らせるわけか 次世代モデルの予告がベンチ表ではなく建築図面になった ほなワイらは60億だけ起こして残りは寝かせるで