AI年表
生成AIに、いつ何が起きたか
154件 / 18の提供元 / 更新 2026-08-01 直近30日で9件
絞り込む
- 予定JDLA 資格・制度
# E資格 2026年第2回を実施予定(8月28〜30日)
-
- Google エージェント
# Gemini Robotics ER 2 をプレビュー公開
- OpenAI 文章・全般
# OpenAI の Terraform プロバイダを公開
- Microsoft 文章・全般
# Copilotの回答に画像を直接表示できるように
- OpenAI 音声
# 文字起こしモデル GPT Transcribe / GPT Live Transcribe を公開
-
- OpenAI 文章・全般
# 組織・プロジェクト単位の支出上限を追加
-
- Suno 音声
# Web版に曲の長さを選べる Duration Slider を追加
- Microsoft エージェント
# Officeアプリから Model Context Protocol 対応のエージェントを利用可能に
- Microsoft 文章・全般
# 社内共通のプロンプトを全社に公開できる Prompt Gallery を追加
- Anthropic 文章・全般
# 教員向けの Claude for Teachers を発表
-
- OpenAI 音声
# GPT-Realtime-2.1 と mini 版を公開
- Google 文章・全般
# Interactions API の開発者ログに対応
-
- Microsoft エージェント
# エージェントへの指示を時刻指定で予約実行できるように
- Microsoft 文章・全般
# Copilot Notebooks から PowerPoint 資料を作成できるように
集めた資料からそのままスライドを起こせます。資料作成の手順が一段短くなりました。
- Microsoft 資格・制度
# AIが生成したファイルが秘密度ラベルを引き継ぐように
-
-
- Runway 音声
# Seed Audio 1.0 を公開
- Runway エージェント
# Agent 2.0 を公開
- OpenAI 文章・全般
# chat-latest スナップショットを更新
- Google エージェント
# Computer Use ツールをパブリックプレビューで公開
AIが画面を見て操作する機能がGeminiにも入りました。作業そのものを任せる使い方が、各社そろって現実味を帯びています。
- Preferred Networks 文章・全般
# PLaMo 3.0 Prime を正式リリース(コンテキストを64k→256kに拡張)
国産モデルが扱える文章量が4倍になりました。日本語の指示への追従を売りにしており、業務での実用を狙った世代です。
- Google 画像
# Imagen 4 と Veo の一部モデルの提供終了を予告
- Suno 音声
# ステム分離を改善(約100種類の楽器に対応)
- Anthropic 文章・全般
# Claude Fable 5 と Claude Mythos 5 を公開
どちらも100万トークンの文脈を標準で扱えます。長い資料や会話をまたいだ作業が現実的になりました。
- OpenAI 検索
# Web検索が画像の結果に対応
- OpenAI 文章・全般
# Amazon Bedrock で GPT-5.4/5.5 の提供を開始
-
- Runway 動画
# Aleph 2.0 と Edit Studio を公開
-
- OpenAI 画像
# DALL·E のスナップショットと Realtime API ベータを廃止
- OpenAI 音声
# GPT-Realtime-2・Translate・Whisper を公開
- Google 検索
# File Search が画像を含むマルチモーダル検索に対応
- Google 文章・全般
# Webhooks に対応(バッチ処理の効率化)
-
- Google 文章・全般
# gemini-embedding-2 を一般提供
- OpenAI 画像
# GPT Image 2 を公開し、割引の対象に追加
-
- Google 音声
# Gemini 3.1 Flash TTS のプレビューを公開
- Runway 動画
# Seedance 2.0 を公開
- Google 文章・全般
# Flex と Priority の推論ティアを導入(コスト重視・速度重視を選べる)
-
- Suno 音声
# 音楽生成 v5.5 を公開(Voices・Custom Models・My Taste)
声やモデルを自分用に持てる形になりました。使い捨ての生成から、自分の音を育てる方向へ動いています。
- Google 音声
# gemini-3.1-flash-live のプレビューを公開(リアルタイム音声対話)
- Google 音声
# 音楽生成モデル Lyria 3 を公開(48kHzステレオ)
- Sakana AI 文章・全般
# Namazuシリーズ(α版)と Sakana Chat を公開
海外の公開モデルを日本での使い方に合わせて調整したものです。日本語の自然さだけでなく、話題の扱い方まで国内向けに寄せています。
- Perplexity 検索
# Gemini 2.5 Flash の提供終了を予告
- Google エージェント
# 組み込みツールとカスタム関数呼び出しの組み合わせに対応
- OpenAI 文章・全般
# GPT-5.4 mini と nano を公開
- JDLA 資格・制度
# 2026年第1回E資格の結果を発表(受験1,317名・合格911名・合格率69.17%)
分野別の平均得点率も公表されました。開発環境79.46%に対し機械学習59.91%で、受験者が落としているのは理論寄りの分野だと分かります。
- OpenAI 動画
# Sora 2 を拡張(キャラクター参照・20秒生成・1080p)
- Runway 動画
# Runway Characters を公開
-
- OpenAI 文章・全般
# Responses API の WebSocket モードと gpt-realtime-1.5 を公開
- JDLA 資格・制度
# E資格 2026年第1回を実施(2月20〜22日)
- Runway 動画
# 他社モデル(Kling 3.0・Sora 2 Pro ほか)を Runway 上で利用可能に
1つのサービスの中から複数社の動画モデルを選べる形になりました。「どのサービスを契約するか」より「どのモデルを選ぶか」に軸が移っています。
-
-
- Suno 音声
# Suno Studio 1.2 を公開(Remove FX・Warp Markers など)
-
- GUGA 資格・制度
# 生成AIパスポートの「資格更新テスト」を開始(6,600円)
資格自体は無期限ですが、シラバス改訂時には更新テストの費用がかかります。「一度取れば終わり」ではなくなりました。
-
- Runway 動画
# Gen-4.5 の Image to Video に対応
- Suno 音声
# Mashup と Sample の機能を公開
- Google 文章・全般
# Cloud Storage と事前署名URLに対応
- Runway 音声
# テキスト音声変換などの新しいオーディオ機能を追加
- Perplexity 検索
# sonar-reasoning の提供を終了
-
-
- OpenAI コード
# gpt-5.1-codex-max を公開
-
-
- Anthropic 文章・全般
# Microsoft Foundry で Claude の提供を開始
-
- OpenAI 文章・全般
# gpt-oss-safeguard-120b / 20b を公開
- Anthropic 文章・全般
# Claude Sonnet 3.5 を提供終了(Sonnet 3.7 は終了予告)
- Adobe 画像
# Firefly Image Model 5 を公開し、音声生成・動画編集をベータ提供
画像だけでなく、ナレーションや音楽、動画編集まで同じ場所に入りました。用途ごとにサービスを渡り歩く必要が減ります。
- Runway 動画
# Workflows を公開
-
- Google 検索
# Googleマップを根拠にした回答を正式提供
-
- Google 動画
# Veo 3.1 / 3.1 Fast のプレビューを公開
- Preferred Networks エージェント
# PLaMo 2.1 Prime を提供開始(ツールの自動連携に対応)
-
-
- Anthropic エージェント
# 会話をまたいで覚えておく「メモリ」機能をベータ公開
- Google 文章・全般
# Gemini 2.5 Flash / Flash-Lite の新プレビューを公開
- Suno 音声
# Suno Studio(生成オーディオの制作環境)を提供開始
-
- Google 動画
# 動画生成の Veo 3 / 3 Fast を正式提供
- OpenAI 音声
# Realtime API を正式公開
- Runway 音声
# Voices(音声機能)を公開
- Google 画像
# 画像生成の Imagen 4(Ultra / Standard / Fast)を正式提供
-
-
- Anthropic 文章・全般
# Claude Opus 4.1 を公開
- Runway 動画
# Aleph を公開
- Google 文章・全般
# Gemini 2.5 Flash-Lite を正式提供
- Google 文章・全般
# まとめて処理する Batch Mode を公開
- Suno 音声
# 音楽生成 v4.5+ を公開
-
-
- Anthropic 文章・全般
# ファイルを預けて何度も参照できる Files API をベータ公開
-
- Suno 音声
# 音楽生成 v4.5 を公開
- Adobe 画像
# Firefly Image Model 4 と Firefly Video Model を一般提供
商用利用を前提に作られた画像・動画AIが正式版になりました。仕事の成果物に使う前提なら、権利まわりの安心はここが強みです。
- Google 文章・全般
# gemini-2.5-flash のプレビューを公開
- Meta 文章・全般
# Llama 4(Scout・Maverick)を公開
公開モデルの主力が世代を上げました。Scoutは1000万トークンの文脈を掲げており、長い資料を扱う競争が公開モデル側にも及んでいます。
-
- Google 画像
# Gemini 2.0 Flash が画像生成に対応
- Google 文章・全般
# Gemini 2.0 Flash-Lite を正式提供
-
-
-
- Google 文章・全般
# Gemini 2.0 Flash Thinking Mode のプレビューを公開
- Anthropic 文章・全般
# まとめて処理する Message Batches API を標準料金の50%で提供
-
- Google 文章・全般
# OpenAI互換ライブラリに対応
- Anthropic 文章・全般
# Claude 1 と Instant を提供終了
-
- Google 検索
# Google検索を根拠にした回答に対応
- Anthropic エージェント
# パソコン画面を操作する「computer use」をAPIに追加
AIが画面を見てクリック・入力する使い方が現実に入ってきました。作業の代行という発想が生まれた地点です。
- Google 文章・全般
# gemini-1.5-pro-002 / flash-002 を正式提供
- Google 文章・全般
# Gemini 1.5 Pro の200万トークン文脈を正式提供
- ELYZA 文章・全般
# Llama-3-ELYZA-JP を公開(80億パラメータ版は商用利用可)
日本語の性能で海外の上位モデルに並ぶと公表された国産モデルです。日本語で使うなら国産という選択肢が現実味を帯びました。
-
- Google 文章・全般
# コンテキストキャッシュに対応
- Anthropic 文章・全般
# ツール利用(tool use)を正式提供
-
-
- Google 文章・全般
# Gemini 1.5 Flash のプレビューを公開
- Google 文章・全般
# Gemini 1.5 Pro のプレビューとファイルAPIを公開
- Sakana AI 文章・全般
# 進化的モデルマージによる日本語モデル EvoLLM-JP・EvoVLM-JP・EvoSDXL-JP を公開
既存の公開モデルを組み合わせて新しいモデルを作る手法です。ゼロから学習させずに日本語向けを作れる道が示されました。
- Google 文章・全般
# Gemini 1.0 Pro のチューニングに対応
-
- Google 文章・全般
# Bard を「Gemini」に改称し、Gemini Advanced(Ultra 1.0)を提供開始
名前が変わった日です。「Bardが見つからない」ときは、この改称を思い出してください。有料プランは月額19.99ドル(2,900円・税込)で始まりました。
- Google 文章・全般
# Bard に Gemini Pro を搭載(まず英語で提供)
発表されたばかりのGeminiが、実際に使える製品に載りました。発表と提供のあいだに時差があるのは、この分野の常です。
- Google 文章・全般
# Gemini を発表(Ultra・Pro・Nano の3サイズ)
文章・画像・音声・動画をまたいで扱うことを前提にした設計です。用途ごとに大きさを選ぶ考え方が広まりました。
- Anthropic 文章・全般
# Claude 2.1 を公開(20万トークンのコンテキスト)
500ページ規模の資料を一度に渡せるようになりました。長い文書を要約・検索する使い方が現実的になった節目です。
- NTT 文章・全般
# 独自の大規模言語モデル「tsuzumi」を発表(2024年3月の商用提供を予定)
軽量で日本語に強いことを掲げた国産LLMです。日本語の精度と、社内に置いて使える軽さを重視する流れが見えます。
- Preferred Networks 文章・全般
# 日英2言語の大規模言語モデル PLaMo-13B を商用可のライセンスで公開
国産モデルが誰でも使える形で出た日です。海外モデル一択ではない、という選択肢がここから始まります。
- Google 文章・全般
# Bard に画像アップロードと回答調整を追加、Bard Extensions を公開(英語)
- Anthropic 文章・全般
# Claude 2 を公開し、claude.ai を一般公開
一度に10万トークンまで読めるようになりました。本や長い資料をまるごと渡す使い方は、ここから始まります。
- サイバーエージェント 文章・全般
# 最大68億パラメータの日本語LLMを商用可のライセンスで一般公開
国内企業が日本語モデルを誰でも使える形で出し始めた時期です。海外モデルを待つだけでない流れがここから生まれます。
-
- Anthropic 文章・全般
# Claude と Claude Instant を公開
Claudeが世に出た日です。高性能版と、軽くて速い版の2種類という構成は、いまのモデル体系にもつながっています。
-
-
- OpenAI 文章・全般
# ChatGPT を公開(GPT-3.5ベース)
ここから生成AIが一般に広まりました。専門知識がなくても、普通の言葉で頼めば文章が返ってくる——この形が世に出た地点です。
2026年8月
JDLA
2026年7月
Anthropic
OpenAI
Suno
2026年6月
2026年5月
Anthropic
Runway
2026年4月
Anthropic
OpenAI
Runway
2026年3月
OpenAI
Runway
Perplexity
Sakana AI
総務省・経済産業省
2026年2月
Anthropic
JDLA
Perplexity
GUGA
2026年1月
Runway
Suno
2025年12月
2025年11月
2025年10月
2025年9月
Anthropic
Suno
2025年8月
2025年7月
2025年6月
2025年5月
Anthropic
Suno
2025年4月
Meta
2025年3月
2025年2月
Anthropic
2025年1月
DeepSeek
2024年12月
Anthropic
2024年11月
2024年10月
Anthropic
2024年9月
2024年6月
Anthropic
ELYZA
2024年5月
Anthropic
2024年4月
2024年3月
Anthropic
Sakana AI
2024年2月
2023年12月
2023年11月
Anthropic
2023年9月
Preferred Networks
2023年7月
Anthropic
2023年5月
サイバーエージェント
2023年3月
Anthropic
OpenAI
2023年2月
2022年11月
OpenAI
該当する出来事がありません。キーワードや絞り込みを変えてみてください。
