12
5月 2026
テクノロジー
LLM推論を最大8倍速くする Speculative Decodingの仕組み
LLMの応答が1トークンずつしか出てこない——そのボトルネッ…
12
5月 2026
テクノロジー
LLMコストを膨らますtokenmaxxingとは Starburstの対策
AIを本番環境で使うほど、トークンの請求額が予算を超えていく…
12
5月 2026
テクノロジー
OpenAIがテック番組TBPNを買収 AI企業がメディアを持つ理由
2026年4月2日、AI業界に異例の動きがあった。OpenA…
12
5月 2026
テクノロジー
OpenAIがテック番組TBPNを買収 AI企業がメディアを持つ理由
2026年4月2日、AI業界に異例の動きがあった。OpenA…
11
5月 2026
テクノロジー
llama.cppのMTP対応でQwen3.6の推論速度が2倍超に
ローカルLLMの推論速度がボトルネックになっていませんか。同…
11
5月 2026
テクノロジー
スパースLLMで推論30%高速化 Sakana AI+NVIDIAが新手法
LLMの推論コストは、モデル規模が大きくなるほど無視できなく…
11
5月 2026
テクノロジー
KarpathyのLLM Wiki AIが育てる知識ベースの作り方
RAGには根本的な欠点がある。質問するたびに、LLMは同じ知…
11
5月 2026
テクノロジー
AMD MI350P発表 既存ラックへCDNA4 AIを持ち込む
AMDが2026年5月、企業向けAI推論アクセラレーター「A…
11
5月 2026
テクノロジー
MCPのツール定義を遅延読み込みに変えるとトークンが98.7%減る
AIエージェントに接続するMCPサーバーが増えるほど、コスト…
09
5月 2026
テクノロジー
AlphaEvolveがTPU設計に組み込まれた Geminiエージェント1年間の全成果
AIが書いたコードが、自ら設計したチップの上で動いている。 …