「コスト」の検索結果: ユーザー 0件・記事 30件
リード GitHubが2026年9月2日、「Copilot Agent」のエンタープライズ向け正式提供(GA)を発表した。バックログに積まれたIssueを受け取り、コードの設計・実装・テスト・PR作成まで自律的に完了する。月額39ドルの新プランが追加され、大規模組織での本番導入が現実的な選択肢になった。 何が起きているのか GitHub公式ブログの発表によると、Copilot Agentは以下の工...
リード AWSが自社開発LLM「Nova Pro 2.0」を2026年8月21日に正式公開した。入力トークン単価を前世代比68%削減しながらMMLU 91.7点を記録し、128Kコンテキスト・動画30分対応のマルチモーダル処理を標準装備する。Amazon Bedrock経由で同日から全リージョン提供が始まり、既存AWSインフラを持つ企業には即座にコスト構造の見直し機会が生じている。 何が起きている...
リード Runway(本社:米ニューヨーク)は2026年8月22日、動画生成AI「Gen-4 Turbo」を正式公開した。前モデル「Gen-4」比で生成コストを85%削減しつつ、4K解像度・最大120fpsの出力に対応。「1分の映像を生成するクレジット消費が10分の1以下になった」という報告がXで相次いでいる。映像プロダクションにおける試作コストと外注費の構造そのものが問われる段階に入った。 何が...
リード Metaは2026年8月13日、「Llama 4 Scout」の商用API(Llama API)提供を正式スタートした。入力1Mトークンあたり$0.11——GPT-4oの約30%の価格水準——かつ最大512kトークンのコンテキストウィンドウとマルチモーダル入力を備えたモデルが有償APIで使えるようになったことで、OSSモデルが「性能で劣るが安い」という旧来の定式を崩しつつある。 何が起きて...
リード DeepSeekが「V4」を2026年8月15日に正式公開した。総671Bながら推論時の活性化パラメータを67Bに絞るMixture-of-Experts(MoE)設計を採用し、MMLU・HumanEvalでGPT-4oと同等水準のスコアを記録しながらAPIコストをV3比約70%削減している。MoEアーキテクチャがMITライセンスで公開されたのは実質初となり、オープンソースLLM競争の軸が...
リード OpenAIは2026年7月16日、推論特化モデル「o4-mini High」をTier1以上の全APIユーザーへ開放した。入力コストは$0.30/1Mトークン(o3比▲70%)、出力は$1.20/1Mトークン。AIME 2025正答率92.3%、SWE-bench Verified 68.1%を維持しつつ単価を大幅に圧縮した。「推論は高価」という前提が、今日から変わる。 何が起きているの...
リード ソフトバンクが生成AIを使い、宣材動画を約10分で制作するサービスを開始したと日本経済新聞が2026年5月17日付で報じた。撮影・編集・ナレーション収録を含めると平均2〜5営業日を要してきた工程が1桁分の時間に圧縮される。単なる効率化ではなく、映像制作の「誰が・何日で・いくらで作るか」という問い自体が書き換えられる段階に入った。 何が起きているのか 日本経済新聞の報道によると、ソフトバンク...
リード DeepSeekが2026年8月29日、推論特化モデル「R3」を正式公開した。AMATH(高度数学推論)ベンチマークでOpenAI「o3」を0.8ポイント上回り、SWE-bench Verifiedでも72.4%という新記録を更新。MITライセンスでモデルウェイトを同時公開しており、API単価はo3比で約8分の1とされる。「オープン・安価・ベンチ首位」の三条件が重なったのは初めてで、企業の...
リード NVIDIAが2026年7月7日(現地時間)、次世代GPU「Blackwell Ultra B300」の量産出荷開始をアナウンスした。LLM推論スループットは前世代H200比で最大3倍——この数字が意味するのは、クラウド事業者のコスト構造が再び大きく書き換わるという事実だ。 何が起きているのか NVIDIA公式ブログおよびInvestor Day資料によると、B300はHBM3e 192G...
リード Microsoftは2026年7月18日、軽量言語モデル「Phi-4-mini Instruct」(38億パラメータ)をAzure IoT Edge環境に全面統合すると発表した。クラウドAPIへの往復レイテンシが不要になり、産業現場での推論コストが従来比で最大85%削減できるとしている。エッジAI実装を阻んできた「コスト・遅延・ネットワーク依存」の三重障壁が同時に崩れる局面と見られる。 何...
リード OpenAIが2026年8月10日、推論特化モデル「o4-mini」を正式公開した。前世代o3-miniと比較して入力1Mトークンあたりのコストを約65%削減しながら、AMC/AIME 2025数学競技で正答率89.4%を達成。「安いと精度が落ちる」というトレードオフが崩れつつあり、API経由でビジネス展開するスタートアップの設計判断に即座に影響する。 何が起きているのか OpenAIは日...
リード 2026年8月、EU AI法(AI Act)の中核条項である「高リスクAIシステム」への包括的義務が施行される。残り約60日。欧州委員会の公式試算では1社あたりの適合コストは最大300万ユーロ(約5億円)に達するとされ、医療・採用・信用審査領域にAIを展開するグローバル企業の対応判断が正念場を迎えた。 何が起きているのか EU AI法は2024年8月に発効し、段階的な施行スケジュールを取っ...
リード NVIDIAのBlackwell Ultraアーキテクチャ最上位GPU「B300」が2026年7月14日から本格的な量産出荷フェーズに入った。前世代H100比でAI推論スループットが3.5倍、電力効率が2.1倍を達成。これを受けてAWS・Azure・Google Cloudの3社が、AI推論APIの料金改定を今後90日以内に実施すると相次いで予告しており、LLMコスト構造の分岐点になるとみ...
リード Anthropicは2026年9月4日、「Claude 5 Sonnet」を正式公開した。Claude 5 Haikuで確立した低価格路線を維持しながら、精度とコンテキスト長を大幅に引き上げた「中核モデル」の位置づけ。APIは公開初日から全ティアに解放されており、o3-pro・Gemini 2.5 Ultraが鎬を削るエンタープライズ市場への直接的な挑戦状となった。 何が起きているのか A...
リード OpenAIが6月27日23時(日本時間)、推論特化モデル「o4-mini」をAPIおよびChatGPTへ予告なし展開した。前世代「o3-mini」比でトークン単価を約70%圧縮しながら、数学ベンチマークAIME 2025で93.4%、コーディング評価SWE-bench Verifiedで68.7%を記録。"高精度か低コストか"の二択が崩れ、エージェントを数千〜数万並列で走らせる設計が現実...
リード AnthropicがClaude Sonnet 5を2026年6月30日に正式公開した。「数か月前まで大規模で高コストなモデルが必要だった水準の自律性を、Sonnetクラスのコストで実現した」というのが公式の主張だ。標準API価格は入力$3・出力$15/百万トークン(9月1日以降)。エージェントをプロダクション規模で動かす際のコスト計算が根本から書き換わる可能性がある。 何が起きているのか...
リード DeepSeekが推論特化モデル「R2」を2026年8月9日22:00(UTC+8)に正式公開した。入力トークン単価$0.014/Mは現行GPT-4o比で約89%安く、同時に主要ベンチマーク(AIME 2025: 92.3%、SWE-bench Verified: 61.8%)でGPT-5水準に並ぶと発表している。オープンウェイト配布・商用利用解放の組み合わせは、2025年1月のR1公開時...
リード LLM推論コストの崩落が「使えるが高い」から「使わない理由がない」へとラインを越えた。GPT-4クラスの能力を持つモデルの入力コストは2024年初頭の約$30/1Mトークンから、2026年前半時点では$0.15〜0.30/1M トークン台まで低下。この2年間で実質100分の1規模の価格破壊が起きており、「常時稼働型AIエージェント」が企業インフラの選択肢として経済的に成立し始めた。 何が起...
リード GPT-4クラスの大規模言語モデルを動かすコストが、2023年から2年余りで約100分の1まで圧縮された。単価が限界費用に近づいたことで、企業の問いは「使うかどうか」から「何を任せるか」に移行した。AIが特別プロジェクトからインフラに変わる転換点が、静かに通過しつつある。 何が起きているのか 2023年3月のGPT-4リリース時点で、入力1Mトークンの処理コストはOpenAI公式レートで約...
リード Google DeepMindは2026年5月10日(現地時間)、推論特化モデル「Gemini 2.5 Ultra」をGoogle AI StudioおよびVertex AI経由で一般公開した。MMLU-Proで92.3%、コード生成ベンチマークSWE-bench Verifiedで63.1%を記録しながら、推論トークン単価を前世代「Gemini 2.5 Pro」比で約67%削減。「性能を...
リード Anthropic と OpenAI が 2026年8月18日、Model Context Protocol(MCP)バージョン 2.0 の仕様草案を GitHub 上で共同公開した。ツール呼び出し定義の統一フォーマットと非同期ストリーミング対応が核心。異なるベンダーのAIエージェントが共通プロトコルで直接連携できるようになれば、マルチエージェント構成の「接続コスト」が構造的に下がる分岐点...
リード Microsoftが2026年5月28日(現地時間)に公開したCopilot Studio v3.0は、マルチエージェント間のタスク委譲をノーコードで設定できる「Agent Orchestration」機能を正式搭載した。同社の試算では、同等機能をゼロから構築した場合と比較してTCO(総保有コスト)が最大67%削減できるとされ、これまでAIエージェント導入を見送ってきた従業員数100〜50...