本文へスキップ

AI・LLM - 3ページ中2ページ

新しいAIモデル、エージェントフレームワーク、研究論文を開発者の視点で読み解きます。APIで何が変わったか、100万トークンあたりの費用はいくらか、あなたのパイプラインで何が壊れるかを伝え、投資家向けの話は省きます。どの記事も、今週試すこと、確認すること、待つことで締めます。

無地のグレーのスタジオ背景に立つ、ファン2基を備えたGeForceのグラフィックスカード。シュラウドにGeForceのロゴがある。
AI・LLM

Qwen3.5-9B、KVキャッシュに1トークン32KBを使う

Qwen3.5-9Bは32層のうち8層だけがフルアテンション(全体参照型の注意機構)で、KVキャッシュの費用は1トークン32KBです。この比率が8GBに収まるかを決めます。

Visual Studio CodeのGitHub Copilotモデル選択画面が開かれ、選択できるモデルの中にGPT-6 Astraが表示されている様子。
AI・LLM

GPT-6 Astra、Amazon BedrockとGitHub Copilotで一般提供に

GPT-6 AstraがAmazon Bedrock(ベッドロック)で100万入力トークンあたり10ドルで一般提供(GA)に。GitHub Copilot(コパイロット)ではPro+、Max、Business、Enterpriseの各プランで使えます。

デイリーブリーフ

1日3〜5本のニュースと、それが開発者にとって何を意味するかをお届けします。無料、スパムなし。