LLM・基盤モデル

LLM・基盤モデル

AIエージェントの安全性は、モデルだけでなく運用で決まる

Anthropic は 2026年8月31日、Improving our alignment and security practices を公開しました。同社は、Claude モデルが評価環境の設定不備などにより実システムやライブインター...
LLM・基盤モデル

AIの無料利用は広告モデルでどこまで広がるか

OpenAI の A milestone in expanding access to AI は、ChatGPT Ads が年換算売上10億ドル規模に達したと発表しました。同時に、インド、欧州、中東、北アフリカでセルフサービス型の広告購入を...
LLM・基盤モデル

Opus 5 が問うのは、最強モデル選びではなく日常業務の設計です

Anthropic は Introducing Claude Opus 5 で、Claude Opus 5 を発表しました。同社は、Opus 5 がコーディングや知識労働の評価で高い性能を示し、Claude Fable 5 に近い知能を半分...
LLM・基盤モデル

Granite 4.2が示す、LLM選定の新しい見方

Granite 4.2 LLMs: How Theyre Built は、IBM Granite 4.2 の構築方法を解説した Hugging Face Blog の記事です。Granite 4.2 は 3B、8B、30B の dense ...
LLM・基盤モデル

LLM評価は、モデル選びから運用判断へ移る

GitHub Blog の How to evaluate LLMs before production - The GitHub Blog は、GitHub secret scanning に LLM を適用する前の評価実践を扱っています...
LLM・基盤モデル

AI管理は、ダッシュボードから対話へ移り始める

Introducing the Admin plugin for ChatGPT Work and Codex は、ChatGPT Work と Codex の管理者向けに Admin plugin を導入したという発表です。利用状況の分析...
LLM・基盤モデル

AIコーディングの競争軸は、精度だけでなく費用対効果へ移る

Advancing price-performance for developers with GPT‑5.6 in Kiro は、GPT‑5.6 がソフトウェア開発エージェント Kiro で利用可能になったことを発表しています。要点は、計...
LLM・基盤モデル

AI利用データは、現場の判断材料になるか

AIが仕事をどう変えるのかを考えるとき、議論はどうしても大きくなりがちです。職業がなくなるのか、業務が効率化されるのか、どの領域から変わるのか。けれど実務者にとって必要なのは、未来予測そのものではなく、自分の領域で何が起き始めているかを見極...
LLM・基盤モデル

脆弱性発見は、モデルの大きさではなく探索量の競争になる

Introducing Gemini 3.5 Flash Cyber — Google DeepMind は、Google DeepMind が 2026年7月21日に発表したサイバーセキュリティ特化モデルです。Gemini 3.5 Fla...
LLM・基盤モデル

AI導入で短くなるのは、制作時間だけではない

AI導入の効果は、作業時間の削減だけで測ると見誤ります。重要なのは、判断に必要な文脈をどれだけ早くチーム内で共有できるかです。OpenAI の事例記事 Stampli cuts launch hours by 68% using ChatG...