LLM・基盤モデル

LLM・基盤モデル

AI論争は、すでに情報戦の場になっている

「ChatGPTは中国製のモデルだ」——そんな偽情報が、組織的に拡散されていたとしたら、どう受け取るべきか。OpenAIが公開した PRC-linked influence operations are targeting AI debat...
LLM・基盤モデル

エンタープライズのCohereが開発者向けに踏み込んだ、その意味

AIコーディング支援の選択肢はすでに多い。それでも今回の動きには注目する理由がある。Introducing North Mini Code: Cohere's First Model For Developers によると、Cohereが同...
LLM・基盤モデル

再現できないバグをAIに任せると、エンジニアは何に向かうか

再現が難しいバグは、エンジニアの集中を静かに奪い続ける。ログを掘り、状態を再現し、仮説を立てる——そのサイクルに引きずられるほど、本来の仕事から遠ざかる。そこにコストが発生している事実は、しばしば可視化されないまま積み上がる。OpenAIが...
LLM・基盤モデル

「出すか出さないか」を超えて——Claude Fable 5が変えたAIリリースの設計

Anthropicが6月9日に公開したClaude Fable 5 and Claude Mythos 5は、単なるモデル更新ではなかった。Fable 5はほぼ全ての能力ベンチマークで最高水準を記録し、タスクが長く複雑になるほど他モデルとの...
LLM・基盤モデル

答えを教えるな——シエラレオネのRCTが示した教育AIの設計原則

生成AIが教室に入ってきたとき、最初に問われることがある。「生徒が考える前に、AIが答えを出してしまわないか」と。Gemini's guided learning: results from a randomized controlled ...
LLM・基盤モデル

翻訳が「待つ」のをやめた——Gemini 3.5 Live Translateが示す次の段階

Google DeepMindがGemini 3.5 Live Translate is hereを公開した。70言語以上に対応するリアルタイム音声翻訳モデルで、話者の抑揚・ペース・ピッチを保持しながら翻訳音声を連続生成する。従来のターン制...
LLM・基盤モデル

「崩壊が消えた」——5つのLLMが示した、設計されていない協調

誰もルールを変えていないのに、崩壊が消えた。The crash that vanished: control and emergence in a five-model economy は、木材資源をめぐる仮想経済シミュレーションの実験報告...
LLM・基盤モデル

「異質性」をプロダクトに変える——スモールモデル混在設計の逆転

マルチエージェントシステムで複数モデルを混在させることは「複雑化のコスト」として見られがちだ。その異質性をあえて価値として設計した事例がある。Five labs, five minds: building a multi-model fin...
LLM・基盤モデル

ChatGPTが「夢を見る」——記憶の量より構造化が次のパーソナライズを決める

記憶をたくさん持つAIと、記憶を上手に使えるAI。この二つは別物だ。OpenAIはDreaming: Better memory for a more helpful ChatGPTで、ChatGPTに新しい記憶システムを導入した。「Dre...
LLM・基盤モデル

AIエージェントを「前提」にする——Endavaが問い直す開発プロセスの骨格

ソフトウェア開発にAIを使っている企業は多い。だが「AIを使いながら開発する」と「AIを前提に開発プロセスを設計し直す」は、同じように見えてかなり異なります。OpenAIが公開したケーススタディ「How Endava is redesign...