株式会社ずんだもん技術室AI放送局

AIやテクノロジーのトレンドを届けるPodcast。平日毎朝6時配信。朝の通勤時間や支度中に情報キャッチアップとして聞いてほしいのだ。

私立ずんだもん女学園放送部 podcast 20261009

2026年10月09日

MP3ファイルをダウンロード

内容紹介

Granite 4.2 LLMs: How Theyre Built、Meta is back with Muse Glimmer: local, agentic, multimodal, and open source、Step 5 Preview - API Pricing & Providers、世界の猫好きに「デジタル上のアイデンティティ」を インターリンク、新ドメイン「.neko」をICANNに申請

出演者

お嬢様ずんだもん
お嬢様ずんだもん

youtube版(スライド付き)

関連リンク

IBMは、推論能力とエージェント機能に特化したオープンなLLMファミリー「Granite 4.2」を発表しました。モデルサイズは3B、8B、30Bの3種類が用意されており、すべてのモデルがApache 2.0ライセンスで公開されています。Granite 4.2は、従来の指示追従能力に加えて明示的な「推論能力」を統合した点が最大の特徴です。回答を生成する前に思考プロセス(Chain of Thought)を出力する機能を持ち、タスクの難易度や目的に応じて「通常思考モード(thinking)」、「非思考モード(non-thinking)」、および簡単な質問に対して短い思考予算を割り当てる「低負荷思考モード(low-effort)」を切り替えることができます。また、すべてのモデルでネイティブなツール呼び出し(Tool Calling)をサポートしています。

アーキテクチャ面では、デコーダオンリーのデンス・トランスフォーマーを採用しており、Grouped Query Attention(GQA)、Rotary Position Embedding(RoPE)、SwiGLU活性化関数、RMSNormなどを組み合わせています。コンテキスト長は最大131,072トークンに対応しており、ベースモデルとなったGranite-4.1の事前学習フェーズでは512Kトークンまでの拡張が行われています。

学習パイプラインは非常に洗練されており、事前学習、教師ありファインチューニング(SFT)、そして複数ステージによる強化学習(RL)の組み合わせで構築されています。SFTでは、エージェント特化データと非エージェント特化データを組み合わせた約7200万サンプル(約100Bトークン)を使用し、LLMジャッジを用いた品質管理や重複排除を行ってデータのクオリティを高めています。30Bモデルでは、エージェントコーディングに特化した第2フェーズのSFTも追加実施されています。

強化学習(RL)では、非同期のGRPO(Group Relative Policy Optimization)を用いたマルチステージ・マルチ環境のパイプラインを採用しています。3Bモデルは基礎的なRLとアライメントのみですが、8Bおよび30Bモデルにはエージェントとしての動作を学習させるための「エージェントRLブロック」が組み込まれています。このブロックでは、ソフトウェアエンジニアリング(SWE)、ターミナル操作、ウェブ検索といった現実のサンドボックス環境を用いたマルチターンでのタスク解決を学習し、実際の環境における成功報酬をベースに最適化が行われます。この学習基盤には、NVIDIAの「NeMo-RL」と「NeMo-Gym」が活用されており、生成とトレーニングの処理を非同期で行うことで効率的な大規模分散学習を実現しています。

推論やデプロイの面では、vLLMやSGLangなどのオープンな推論エンジンに対応しており、OpenAI互換のエンドポイントを通じて追加のラッパーなしでエージェント用ハーネスに組み込むことができます。また、FP8、NVFP4、MXFP4といった量子化バリアントや、llama.cpp向けのGGUF形式も提供されており、リソースに応じた柔軟なデプロイが可能です。新人エンジニアがローカル環境や実務のAIエージェント開発においてオープンモデルを活用する際、その内部構造や強化学習・ツール統合の設計を学ぶ上で非常に有益なモデルとなっています。

引用元: https://huggingface.co/blog/ibm-granite/granite-4-2

Metaがオープンソースの新しいマルチモーダル大規模言語モデル「Muse Glimmer-30B」を発表しました。本モデルは30Bパラメータのモデルで、Apache 2.0ライセンスのもとで公開されており、プライバシーの保護やコスト削減、ローカル環境でのエージェント利用を強く意識して設計されています。プログラミング、ドキュメント解析、個人アシスタント、ClawやHermesのようなセットアップ用途に最適です。

アーキテクチャの最大の特徴は、2BパラメータのViTスタイルな視覚エンコーダー(Perception Encoder)と、28Bパラメータのテキストデコーダーを組み合わせている点です。テキストデコーダーには、2,048トークンのスライディングウィンドウアテンションとフルアテンションを交互に繰り返すハイブリッドアテンションや、KVキャッシュのメモリ消費を16分の1に削減するGated Grouped-Query Attentionが採用されています。また、DFlashを用いたオプションのスペキュラティブデコーディング(ドラフターモデル)により、コード生成などの構造化コンテンツ生成時においてメモリコストを抑えながらより高速な推論を実現できます。

Hugging Faceのtransformers、llama.cpp、vLLM、Hugging Face Inference Endpointsなどの主要ライブラリやツールでDay-0からネイティブサポートされており、すぐに導入・検証が可能です。transformersでは、AutoModelForMultimodalLMとAutoProcessorを使ってテキスト、画像、動画の推論やマルチモーダルなツール呼び出し、オブジェクト検出を数行のコードで実行できます。また、llama.cppやTRLを用いたSFT・Async GRPOなどのファインチューニングにも対応しており、実用的なローカル開発環境への組み込みが容易になっています。

引用元: https://huggingface.co/blog/muse-glimmer

StepFun社が開発した新しいフラッグシップモデル「Step 5 Preview」のリリース情報およびAPI提供に関する詳細について解説します。新人エンジニアの方向けに、このモデルの概要や特徴を分かりやすく整理して説明します。

まず、「Step 5 Preview」はエージェント型の作業に特化して設計された大規模言語モデルです。アーキテクチャにはスパースMixture-of-Experts(MoE)方式を採用しており、総パラメータ数が約600B(6000億)であるのに対し、1トークンあたりにアクティブとなるパラメータ数は27Bとなっています。これにより、大規模なコードベースや膨大なドキュメントを横断する長時間のタスクにおいて、ツールを駆使しながら複数ステップで結果を洗練させていく高い能力を発揮します。特にソフトウェアエンジニアリングや専門的な知識労働、金融分野において優れたパフォーマンスを示します。

技術的な仕様や価格体系を見ていきます。入力トークンあたりの価格は100万トークンあたり1.00ドル、出力トークンあたりの価格は2.70ドルとなっており、キャッシュ読み取り時は0.05ドルに設定されています。コンテキストウィンドウは1,000,000トークンという非常に大きな容量をサポートしており、補完(completion)トークンは最大64,000トークンまで対応しています。また、テキストだけでなく画像や動画を入力として受け付けるマルチモーダル機能に対応しており、出力はテキストで行われます。

機能面では、関数呼び出しを行うための「tools」パラメータの受け入れや、JSONスキーマを利用した構造化出力(structured outputs)に対応しています。これにより、既存のOpenAI互換のAPIクライアントやSDKを使用している場合、ベースURLとモデルスラッグ(stepfun/step-5-preview)を切り替えるだけで、スムーズに統合・利用することができます。OpenRouter経由での提供となっており、スループットやレイテンシ、稼働状況(アップタイム)などのパフォーマンスデータも公開されているため、プロダクトへの組み込み検討時に参考にしやすくなっています。

このモデルを活用している主要なオープンソースのAIエージェントやアプリケーションとしては、「OpenClaw」、「Hermes Agent」、「Cline」、「Kilo Code」などが挙げられます。これらはVS CodeやJetBrainsなどのIDE、CLI、メッセージングアプリなどと連携して、コードの自動探索やファイル編集、ターミナルコマンドの実行などを自律的に行うツール群であり、実際の開発現場におけるエージェントワークフローで広く利用されています。長大なコードベースを扱うエージェント開発や、高度な自動化タスクを検証したいエンジニアにとって、注目すべき新しい選択肢の一つとなります。

引用元: https://openrouter.ai/stepfun/step-5-preview

株式会社インターリンクの子会社であるインターリンクシステム創成研究所が、新gTLDプログラム「2026 Round」において、新トップレベルドメイン「.neko」をICANNに申請したと発表しました。2026年10月8日の「Reveal Day」の公開情報により、同一文字列での他の申請がないことが確認されています。「.neko」は、個人や団体が猫文化への思いや活動を表現できるインターネット上のアドレスとして、コミュニティづくりや保護猫活動、ビジネスなどの用途を想定しています。今後はICANNによる評価などの手続きを経て、レジストリとしての運用開始を目指していく予定です。

引用元: https://prtimes.jp/main/html/rd/p/000000603.000006942.html

VOICEVOX:ずんだもん