LLM・基盤モデル

LLM・基盤モデル

推論エンジンの正しさを先に——vLLM V1移行が示したRL開発の優先順位

ServiceNow AI が公開した vLLM V0 to V1: Correctness Before Corrections in RL は、強化学習パイプラインにおける推論エンジンの移行録だ。rollout 生成に vLLM を使う...
LLM・基盤モデル

「話す」から「会話する」へ——Gemini 3.1 Flash Liveが塗り替えた音声AIの基準

音声AIに、ほんの少しのズレを感じたことはないだろうか。Google DeepMindは2026年3月26日、Gemini 3.1 Flash Live: Google's latest AI audio model を公開した。前モデルよ...
LLM・基盤モデル

TTSが「読む」から「演じる」へ——Gemini 3.1 Flash TTSのaudio tagsが開く可能性

音声合成を使う側として、ずっと感じていた「物足りなさ」がある。どんなに自然な声でも、読み上げは読み上げにしか聞こえない。テキストを渡せば、AIは正確に読む。でも、「そこは間を置いてほしい」「もっと明るいトーンで」という意図は、ほとんど伝わら...
LLM・基盤モデル

「考えて動く」ロボットへ——Gemini Robotics-ER 1.6が示す身体推論の変曲点

ロボットに「箱を棚の右端に置いて」と言って、それが通じるようになるまで、あと何年かかると思うだろうか。Google DeepMind は5月、Gemini Robotics ER 1.6: Enhanced Embodied Reasoni...
LLM・基盤モデル

「1日90分」は設計の産物——Singular Bank が示す業務AI組み込みの論理

Singular Bank helps bankers move fast with ChatGPT and Codex——スペインの金融機関 Singular Bank が、ChatGPT と Codex を組み合わせた社内AIアシスタン...
LLM・基盤モデル

「掃除リスト」を作るだけじゃない——Geminiが「生活の実務」に入り込み始めている

春の大掃除に、AIアシスタントを使う。その発想は「便利な機能を試す」レベルで受け取られるかもしれない。でも、その使われ方を見ると、少し違う話が見えてくる。Googleが公開したHow to use Gemini to tackle your...
LLM・基盤モデル

Gemini API に Webhook—エージェント開発の「待ち」が設計から消える

AIエージェントが長時間のタスクを担う機会が増えるほど、「完了をどう検知するか」という設計上の問いが現実になる。Event-Driven Webhooks in the Gemini API によると、GoogleはGemini APIにイ...
LLM・基盤モデル

「難しい仕事を任せる」閾値が、また下がった

いちばん難しいコーディング作業を、監督なしに渡せる——その一文が、今回の発表を読んで最初に引っかかった。Introducing Claude Opus 4.7 | AnthropicAnthropic が発表した Claude Opus 4...
LLM・基盤モデル

AIを「後付け」ではなく「前提」として設計する世代が来た

AIを前提に設計する世代が、実装フェーズに入りつつあるOpenAIが公開した Introducing ChatGPT Futures: Class of 2026 は、ChatGPTを活用して研究・実装・社会課題解決に取り組む26人の学生を...
LLM・基盤モデル

クリエイティブAIの次の一手——「置き換え」ではなく「統合」へ

AIがデザイナーや映像クリエイターの仕事を「奪う」という文脈は、まだ根強い。ところが、Anthropicの最新の施策はその方向とは少し異なる。AnthropicはClaude for Creative Workを発表。Adobe Creat...