Qwen– tag –
-
AI技術
[開発者向け]Jetson AGX ThorでQwen3.6-27Bが6.4倍高速に——TensorRT Edge-LLMの実装手順
はじめに NVIDIAは2026年9月16日、推論ソフト「TensorRT Edge-LLM」がMLPerf Inference v6.1「Edge Agentic」ベンチマークで、Jetson AGX Thor上のQwen3.6-27Bをllama.cpp比6.4倍で完走させたと発表しました。本稿では実装内容と高速化の仕組みを解説し... -
AIツール
[開発者向け]GLM-5.3-FlashとQwen3.8-Flash-Next、中国発2大モデルが同日公開——新アーキテクチャの実装方法を解説
はじめに Z.aiとAlibabaのQwenチームは2026年8月26日、効率重視の新アーキテクチャモデル「GLM-5.3-Flash」と「Qwen3.8-Flash-Next」を相次いで公開しました。本稿では両モデルのHugging Face公開情報をもとに、設計思想と実装方法を解説します。 参考記... -
AI技術
[開発者向け]Qwen3.8-27B徹底解説:27B級デンスモデルで画像・動画理解とエージェントタスクを両立する方法
はじめに Hugging Faceで、AlibabaのQwenチームが新モデル「Qwen3.8-27B」を公開しました。Qwen3.5世代のアーキテクチャを土台に、画像・動画理解とエージェントタスクの能力を高めたデンスモデルです。本稿では特徴とベンチマーク結果に加え、API経由で... -
AI技術
[開発者向け]Qwen3.8-27Bを動かす——画像・動画・思考制御・100万トークン対応
はじめに Qwenチームが2026年8月、画像・動画理解と長時間エージェント処理に対応するオープンモデル「Qwen3.8-27B」を公開しました。本稿では、モデル仕様と評価値に加え、Transformers、vLLM、SGLang、OpenAI互換APIで試す手順を整理します。 参考記事...
1