HomeTags#qwen

Tag timeline

#qwen17 total

同じキーワードで束ねられた更新を確認できます。カテゴリをまたいだ関連ニュースや実装トピックの追跡に使えます。

Total17#qwen の全掲載記事All listed entries tagged #qwen
Showing17このページの表示件数Entries on this page
Page1/1静的ページ位置Static page position
Updated公開index snapshotPublished index snapshot

Entriespage 1/1 · 17 total

TODAY2 entries
新規収集INDEXEDコミュニティCommunityLocal Models·Simon Willison's Weblog

Qwen 3.8 27Bは優秀だが、デフォルトで過剰な思考をするQwen 3.8 27B is excellent, but it defaults to wildly overthinking things

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約AlibabaのQwen研究室がApache 2ライセンスのビジョン対応27Bモデル「Qwen 3.8 27B」をリリース。ラップトップで動作する優れたサイズだが、デフォルトで過剰な推論を行う傾向がある点に注意が必要。

AI SUMMARYAlibaba's Qwen lab released Qwen 3.8 27B, an Apache 2 licensed vision-capable model well-suited for laptop inference, though its tendency to overthink by default is a notable caveat for practical use.

Qwen 3.8 27B is excellent, but it defaults to wildly overthinking thingsmedia
新規収集INDEXED公式OfficialLocal Models·Ollama Releases

Ollama v0.32.14 リリースOllama Releases v0.32.14

重要度 MediumMedium priority公式リリース · Local LLM / Open Modelsofficial release · Local LLM / Open Models

AI要約OllamaがWebP画像のトランスコード対応と、Qwenレンダラーでの非先頭システムメッセージの許容を追加したv0.32.14をリリースした。

AI SUMMARYOllama v0.32.14 adds WebP image transcoding for llama-server and allows non-leading system messages in the Qwen renderer, improving compatibility.

Ollama Releases v0.32.14media
YESTERDAY4 entries
新規収集INDEXEDコミュニティCommunityLocal Models·Zenn AI

Qwen3.8 27B に Reasoning Effort を実装してみるThe author resolved Qwen3.8 27B's tendency to over-think on ambiguous tasks by…

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約Qwen3.8 27Bで思考が長引き生成上限に達する問題を、llama.cppのPer-request reasoning budgetで強制打ち切りすることで解消し、曖昧なタスクでも自律的に完走できるようになった。

AI SUMMARYThe author resolved Qwen3.8 27B's tendency to over-think on ambiguous tasks by enabling per-request reasoning budget in llama.cpp, allowing the model to complete complex tasks like Minecraft clone creation autonomously without hitting generation limits.

Qwen3.8 27B に Reasoning Effort を実装してみるog
コミュニティCommunityLocal Models·Qiita LLM

RTX 4070 Ti SUPER 16GBで「Qwen3.8-27B」を動かす ― コンテキスト16Kでは失敗、32KでWebアプリ生成に成功A hands-on report running Qwen3.8-27B locally on an RTX 4070 Ti SUPER 16 GB GPU…

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約Ubuntu搭載の自宅PCでQwen3.8-27BをローカルLLMとして稼働させ、コーディングエージェントOpenCodeを使ったWebアプリ生成をコンテキスト長16Kと32Kで比較検証した結果、32Kでのみ完走できることが確認された。

AI SUMMARYA hands-on report running Qwen3.8-27B locally on an RTX 4070 Ti SUPER 16 GB GPU shows that the OpenCode coding agent fails to complete a web-app task at a 16 K context window but succeeds at 32 K, offering practical guidance for consumer-GPU LLM setups.

RTX 4070 Ti SUPER 16GBでQwen3.8-27Bを動かしてみた ― OpenCodeは16Kで止まり、32KでWebアプリを完遂したog
コミュニティCommunityLocal Models·Qiita LLM

Qwen3.8-27BはMoEではなかった — ローカル音声対話AIへの採用を30回計測して見送るまでThe author evaluated replacing Qwen3.6-35B-A3B (MoE) with Qwen3.8-27B in a…

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約Ryzen AI MAX+ 395環境のローカル音声対話AIで、MoEモデルのQwen3.6-35B-A3BからQwen3.8-27Bへの乗り替えを検討したが、27Bがdense modelであると判明し、速度・品質の計測30回の結果として採用を見送った。

AI SUMMARYThe author evaluated replacing Qwen3.6-35B-A3B (MoE) with Qwen3.8-27B in a fully local voice-dialogue AI on Ryzen AI MAX+ 395, but after 30 benchmark runs discovered the 27B is a dense model and ultimately decided against the switch.

Qwen3.8-27B は MoE ではなかった — ローカル音声対話AIへの採用を30回計測して見送るまでog
新規収集INDEXED公式OfficialLocal Models·Ollama Releases

Ollama v0.32.14-rc0 リリースOllama Releases v0.32.14-rc0

重要度 MediumMedium priority公式リリース · Local LLM / Open Modelsofficial release · Local LLM / Open Models

AI要約OllamaがWebP画像のトランスコード対応とQwenレンダラーでのシステムメッセージ配置の柔軟化を含むv0.32.14をリリースした。

AI SUMMARYOllama v0.32.14 adds WebP image transcoding support for llama-server and allows non-leading system messages in the Qwen renderer, improving multimodal and chat handling.

Ollama Releases v0.32.14-rc0media
Sat, Aug 151 entries
新規収集INDEXEDコミュニティCommunityLocal Models·Simon Willison's Weblog

ローカルLLMテスト用WebUI「CORS Chat」を公開CORS Chat

重要度 InfoInformational技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約Simon WillisонがLM StudioなどOpenAI互換エンドポイントをブラウザからテストできるWebUI「CORS Chat」を公開。M5 MacBook ProやNVIDIA DGX SparkでQwen 3.8 27Bを検証する目的で開発された。

AI SUMMARYSimon Willison released CORS Chat, a browser-based UI for testing OpenAI-Responses-compatible chat endpoints such as LM Studio, built to exercise Qwen 3.8 27B on an M5 MacBook Pro and NVIDIA DGX Spark.

CORS Chatmedia
Thu, Aug 131 entries
コミュニティCommunityLocal Models·Qiita LLM

RTX 4090 × 4枚で Qwen3.6-27B ファインチューン「Fable-Fusion-711」を vLLM (Docker) で動かす — ハイブリッド構成の KV 設計までThis article walks through running the Qwen3.6-27B community fine-tune…

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約DavidAU 氏による Qwen3.6-27B のコミュニティファインチューン「Fable-Fusion-711」を、RTX 4090 4枚構成で vLLM (Docker) を使って実行する手順と、ハイブリッド構成向けの KV キャッシュ設計を解説した記事です。

AI SUMMARYThis article walks through running the Qwen3.6-27B community fine-tune "Fable-Fusion-711" — which outperforms the base model on 6 of 7 benchmarks including ARC-C — on a four-GPU RTX 4090 setup via vLLM in Docker, covering KV cache design for hybrid configurations.

RTX 4090 × 4枚で Qwen3.6-27B ファインチューン「Fable-Fusion-711」を vLLM (Docker) で動かす — ハイブリッド構成の KV 設計までog
Thu, Aug 61 entries
🔥 HOTコミュニティCommunityLocal Models·Zenn AI

AlibabaのQwen3.8-Maxは2.4兆パラメータのオープンウェイトMoEモデル——その実態と活用法Qwen3.8-Max Is Alibaba's Biggest Open-Weight Bet Yet. Here's What You

重要度 HighHigh priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約Alibabaが2.4兆パラメータのMoEモデルQwen3.8-Maxをオープンウェイトで公開予定と発表し、ベンチマーク性能やClaude Codeでの実行方法が解説されている。

AI SUMMARYAlibaba announced Qwen3.8-Max, a 2.4-trillion-parameter MoE model set to go open-weight, with a breakdown of benchmark results and instructions for running it via Claude Code.

Qwen3.8-Max Is Alibaba's Biggest Open-Weight Bet Yet. Here's What Youog
Sun, Aug 23 entries
コミュニティCommunityLocal Models·Zenn LLM

Qwen3.5-9B(Q4/6.6GB)にM1 Maxで日本語を書かせたら、答えは131字なのに出力は3936トークンだったHands-on testing of Qwen3.5-9B (Q4, 6.6 GB) on an M1 Max revealed that a…

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約M1 Max 64GBでQwen3.5-9B Q4量子化モデルを実測したところ、短い日本語回答に対して数千トークンの過剰出力が発生し、「GPT-4超え」の主張は実環境では検証困難であることが示された。

AI SUMMARYHands-on testing of Qwen3.5-9B (Q4, 6.6 GB) on an M1 Max revealed that a 131-character Japanese answer ballooned to 3,936 tokens, exposing a significant verbosity issue and making the widely-circulated "beats GPT-4" claim impossible to verify under real conditions.

Qwen3.5-9B(Q4/6.6GB)にM1 Maxで日本語を書かせたら、答えは131字なのに出力は3936トークンだったog
コミュニティCommunityLocal Models·Zenn LLM

Qwen 35Bの品質を7つの質問で採点したら、GPT-4に勝てるのは3領域だけだったA hands-on benchmark pitting locally-run Qwen 35B against GPT-4 across seven…

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約RTX 4070でQwen 35Bをローカル動作させ、7項目の質問で GPT-4と比較採点した結果、3領域では明確に優位に立てることが判明した。「賢いモデルほど汎用的」という常識とは別に、ローカルLLMが実用的に刺さる用途が存在することを示している。

AI SUMMARYA hands-on benchmark pitting locally-run Qwen 35B against GPT-4 across seven questions found that the open model wins in exactly three domains, challenging the assumption that local LLMs are purely for experimentation and highlighting specific practical use cases for consumer-grade GPUs.

Qwen 35Bの品質を7つの質問で採点したら、GPT-4に勝てるのは3領域だけだったog
コミュニティCommunityLocal Models·Zenn LLM

【実測】あなたのGPUで動く最強ローカルLLM 2026年7月版 — VRAM階級別ベンチマークA practical benchmark guide selecting the best local LLM per VRAM tier (6 GB…

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約Apple M5 Pro 48GBでの実測値と公開一次ソースを組み合わせ、6GB〜大容量までのVRAM階級ごとに最適なローカルLLMモデルをQwen3.5シリーズ中心にまとめたベンチマーク記事。

AI SUMMARYA practical benchmark guide selecting the best local LLM per VRAM tier (6 GB and up), combining direct measurements on Apple M5 Pro 48 GB with cited third-party data, with Qwen3.5 models dominating the lower tiers.

Fri, Jul 311 entries
コミュニティCommunityLocal Models·Qiita LLM

RTX 4070でQwen 35Bを推論すると平均42W — 消費電力プロファイルを4パターン実測Benchmark measurements of Qwen 35B running on an RTX 4070 show average GPU…

重要度 MediumMedium priority技術記事 · Local LLM / Open Modelstechnical post · Local LLM / Open Models

AI要約RTX 4070上でQwen 35Bを動作させた際の消費電力を実測した結果、デコード中の平均はわずか42Wで、ピーク時でも175Wにとどまることが確認された。ローカルLLM運用時の電力コスト見積もりに役立つ具体的なデータとして注目される。

AI SUMMARYBenchmark measurements of Qwen 35B running on an RTX 4070 show average GPU power of only 42 W during decode, with prompt-eval peaks reaching 175 W, well below the card's 200 W TGP. These real-world power profiles offer useful reference data for estimating electricity costs of local LLM deployments.

Thu, Jul 161 entries
🔥 HOT報道NewsNews/Policy·TechCrunch

Apple Intelligence、アリババのQwen AIと共に中国でのリリースが承認されるApple Intelligence approved for launch in China with Alibaba’s Qwen AI

重要度 HighHigh priority技術記事 · Industry & Policytechnical post · Industry & Policy

AI要約AppleはアリババのQwen AIを採用したApple Intelligenceを中国で展開する承認を取得した。規制の壁を越えたことで、巨大な中国市場へのAI機能提供が現実となる。

AI SUMMARYApple has received regulatory approval to launch Apple Intelligence in China using Alibaba's Qwen AI, marking a significant breakthrough that opens the world's largest smartphone market to Apple's AI features.

Tue, Jul 141 entries
公式OfficialGemini/Gemma·Google Developers Blog

システムエンジニアリング実践ガイド:Ironwood(TPU v7)上でのQwen 3.5-397B MoEの最適化Systems Engineering Playbook: Optimizing Qwen 3.5-397B MoE on Ironwood (TPU7x)

重要度 MediumMedium priority技術記事 · Gemini / Gemmatechnical post · Gemini / Gemma

AI要約GoogleがIronwood TPU上でQwen 3.5-397BのMoEモデルを効率的に動かすための最適化手法を公開。大規模オープンモデルをTPUで本番運用する際の実践的な知見を提供している。

AI SUMMARYGoogle published a detailed systems engineering guide for optimizing the Qwen 3.5-397B MoE model on Ironwood (TPU v7), offering practical techniques that help teams efficiently deploy large open-weight models on TPU infrastructure.

Mon, Jun 221 entries
コミュニティCommunityLocal Models·Qiita LLM

ローカルQwen 3.5と3.6に名作プログラムを書かせて画面を並べた — 新旧の見分けはつくかA follow-up where local Qwen 3.5 and 3.6 on an RTX 4070 are asked to write…

重要度 InfoInformational深掘り候補 · 技術記事 · Local LLM / Open ModelsDeep-dive candidate · technical post · Local LLM / Open Models

AI要約RTX 4070で動くローカルのQwen 3.5と3.6に名作プログラムを書かせ、生成画面を並べて比較する記事。前回の7問テストでは品質差が見つからなかったため、今回は視覚的な出力で新旧の違いを見分けられるか検証する。

AI SUMMARYA follow-up where local Qwen 3.5 and 3.6 on an RTX 4070 are asked to write classic programs, comparing the rendered screens side by side to test whether the new and old versions can be told apart.

ローカルQwen 3.5と3.6に名作プログラムを書かせて画面を並べた — 新旧の見分けはつくかog
Fri, May 291 entries
🔥 HOT公式OfficialCline/Roo·Cline Releases

Cline v3.86.0 リリースCline Releases v3.86.0

重要度 HighHigh priority公式リリース · Cline / Rooofficial release · Cline / Roo

AI要約Cline v3.86.0がリリース。Claude Opus 4.8および Moonshot Kimi K2.6のサポートを追加し、Qwen 3.7 Maxのプロンプトキャッシュ表示も修正。

AI SUMMARYAdded Add Claude Opus 4.8 provider support, including 1M-context variants where available. Add Moonshot Kimi K2.6 model support. Fixed Show prompt-cache support for Qwen 3.7 Max in the Cline provider.

Cline Releases v3.86.0media