本文へスキップ
LLM X/Twitter Mar 23, 2026 1 min read

Cloudflareは2026年3月20日、Kimi K2.5をWorkers AIで提供し、agentを自社platform上でend-to-endに実行できるようにしたと発表した。リンク先のCloudflare blogは、256K context、multi-turn tool calling、vision、structured outputsに加え、ある内部agent workloadでコストを77%削減したと説明している。

LLM X/Twitter Mar 22, 2026 1 min read

Cloudflareは2026年3月20日、Kimi K2.5をWorkers AIに載せ、Cloudflare Developer Platform上でend-to-end agentを構築・運用できると発表した。公式ブログでは256k context、multi-turn tool calling、vision inputs、structured outputsに加え、1日7B tokensを処理する内部security review agentで77%のコスト削減を示している。

LLM Reddit Mar 19, 2026 1 min read

2026年3月18日にLocalLLaMAで注目を集めたMamba-3は、Carnegie Mellon University、Princeton、Cartesia AI、Together AIの研究者が公開したstate space modelだ。設計目標をtraining speedからinference efficiencyへ移し、1.5B scaleでMamba-2やGated DeltaNet、Llama-3.2-1Bを上回るprefill+decode latencyを主張している。

LLM Hacker News Mar 19, 2026 1 min read

2026年3月15日のGreenBoostに関するHacker News投稿は124 points、25 commentsに達した。このopen-source Linux projectはkernel moduleとCUDA shimを組み合わせ、model memoryをVRAM、DDR4、NVMeに階層化することで、inference appを変えずにより大きなlocal LLMを動かそうとしている。