AGI終末時計

AGI終末時計

Doomsday Clock

AGIとは、汎用型人工知能のことで、人間と同じように思考して、

人間が実現可能なあらゆる知的作業を理解・学習・実行することが可能な人工知能のことです。

AGIとは、汎用型人工知能のことで、人間と同じように思考して、人間が実現可能なあらゆる知的作業を理解・学習・実行することが可能な人工知能のことです。

AGI終末時計は、
生成AI業界を牽引する著名人の予測をもとに作成いたしました。
今後は、皆様からのご意見を元に客観的な視点をもって随時更新されていきます。

AGIの誕生まで残り──3年。

「AGI終末時計」は、現在のAIの進歩を可視化することで、

AGIの到来にどこまで近づいているかをお伝えします。

それまでの過程で私達の働き方がどのように変わり、
AIに置き換わっていくのでしょうか?

カウントダウンするだけでは意味がない。

今私たちに必要なことは──未来に追いつくこと。

AGI終末時計では、AIによる仕事の置き換えやAIを使った働き方について、
業務別
業界別(未実装)
職業別(未実装)
といった観点から表示していきます。

AGI終末時計は、

生成AI業界を牽引する著名人の予測をもとに作成いたしました。

今後は、皆様からのご意見を元に客観的な視点をもって随時更新されていきます。

AGIの誕生まで残り──3年。

「AGI終末時計」は、現在のAIの進歩を可視化することで、

AGIの到来にどこまで近づいているかをお伝えします。

それまでの過程で私達の働き方がどのように変わり、

AIに置き換わっていくのでしょうか?

カウントダウンするだけでは意味がない。

今私たちに必要なことは──未来に追いつくこと。

AGI終末時計では、AIによる仕事の置き換えやAIを使った働き方について、

業務別、業界別(未実装)、職業別(未実装)、

といった観点から表示していきます。

AGI到達レベル

AIビックテックのAGI到達レベルは、2023年11月に発表されたGoogle Deepmindの「Levels of AGI: Operationalizing Progress on the Path to AGI」という論文内に記載されていた、Levels of AGIという表を参考に作成しています。

弊社ではレベル4をAGI達成と解釈し、それを100%とした時の現在の数値を記載しています。

Google Deepmind Levels of AGI(2024年6月時点)

スクロールできます
パフォーマンス×一般性狭義
(明確に範囲が定められたタスク)
広義
(身体を伴わないタスク)
レベル0:AIでない“狭義の非AI:
電卓ソフトウェア
コンパイラ”
“広義の非AI: 人間参加型計算
例:
Amazon Mechanical Turk”
“レベル1:発展途上
未熟な人間と同等か
それよりも若干優れている”
“発展途上の狭義のAI:
GOFAI (Boden, 2014)
simple rule-based systems
e.g.
SHRDLU (Winograd, 1971)”
“発展途上のAGI
ChatGPT(OpenAI, 2023)
Bard(Anil et al., 2023)
Llama2(Touvron et al,2023)
Gemini(Pichai and Hassabis, 2023)”
“レベル2:有能
熟練者の内、少なくともその中央値に達している”
“有能な狭義のAI:
有害性検出器
例:
Jigsaw (Das et al., 2022)
スマートスピーカー
例:
Siri (Apple), Alexa (Amazon)
Googleアシスタント (Google)
VQAシステム
例:
PaLI (Chen et al, 2023)
Watson (IBM)
特定のタスクのための最先端LLMS
例:
短いエッセイの執筆
シンプルなコーディング”
“有能なAGI:
未達成”
“レベル3:専門家
熟練者の内、少なくともその上位10%に達している”
“専門家レベルの狭義のAI: スペリング
文法チェッカー
例:
Grammarly (Grammarly, 2023)
画像生成モデル
例:
Imagen (Saharia et al., 2022)
DALL-E 2 (Ramesh et al., 2022)”
“専門家レベルのAGI:
未達成”
“レベル4:名人
熟練者の内、少なくともその上位1%に達している”
“名人レベルの狭義AI:
Deep Blue (Campbell et al., 2002),
AlphaGo (Silver et al., 2016, 2017)”
“名人レベルのAGI:
未達成”
“レベル5:超人
全人類より優れている”
“超人レベルの狭義AI:
AlphaFold (Jumper et al., 2021)
AlphaZero (Silver et al., 2018)
StockFish (Stockfish, 2023)”
“人工超知能 (ASI):
未達成”
AGIパラメータ(2026年08月28日更新)

AIビックテックのAGI到達レベル変遷

スクロールできます
更新日概要
2026年8月28日2026年8月28日、Googleは動画生成・編集に特化した最新モデル「Gemini Omni 1.1 Flash」を発表。
直近10秒の映像を分析して最大40秒まで動画を延長する「シーン拡張」や、開始・終了フレームを指定して滑らかな遷移を生成する機能を備え、
720p生成映像を1080pや4Kへアップスケールすることも可能なマルチモーダルモデルである。
2026年8月27日2026年8月27日、Googleは新たな音声認識モデル「Gemini 3.5 Transcribe」を発表。
85以上の言語に対応し、非ストリーミングで単語誤り率2.6%を達成する高精度な文字起こしモデルであり、
フィラー語の除去や話者識別(最大3名)にも対応している。
2026年8月26日2026年8月26日、AnthropicはチャットとClaude Coworkの記憶を統合する新機能「Claude’s Memory」を発表。
会話中の情報をトピック別に自動保存し、チャットとCoworkの両インターフェースで同じコンテキストを共有できる長期記憶システムであり、
Free・Pro・Maxプランで追加費用なく利用可能である。
2026年8月21日2026年8月21日、OpenAIはCodexとChatGPTにライブWeb検索機能を統合するプラグイン「Exa in Codex & ChatGPT」を発表。
100億以上のWebページや3億5,000万件超の研究論文にアクセスし、外部ツールへの切り替えなしで検索・ページ読み込み・複数ステップの自律調査を行えるプラグインであり、
引用付きで回答を生成することも可能である。
2026年8月18日2026年8月18日、AnthropicはClaude Codeの新スキル「/design skill」をリサーチプレビューとして公開。
ターミナルやDesktopアプリから複数のUIデザイン案を生成し、選択したデザインをそのまま実装へ移行できる機能であり、
Pro・Max・Team・Enterpriseプランで追加料金なく利用できる。
2026年8月14日2026年8月14日、OpenAIはコーディングエージェント「Codex」の利用上限をその場で解除できる「リセット権」の購入導線を一部ユーザー向けに提供開始。
5時間枠や週次枠を使い切ってもリセットを1回消費すれば即座に上限が回復する有償サービスであり、
従来無料配布されていたリセット権に加え購入も可能になった。
2026年8月14日2026年8月14日、Googleはコーディングとエージェント向けの最新モデル「Gemini 3.7 Flash」を発表。
テキスト・画像・音声・動画を入力として受け付け、100万トークンのコンテキストウィンドウで大規模文書処理やコード生成を一度のリクエストで完結できるモデルであり、
推論の深さを3段階で調整できるthinking_levelパラメータを備えている。
2026年8月13日2026年8月13日、xAIは長時間のエージェントタスクやコーディング向けの最新モデル「Grok 4.6」を発表。
50万トークンのコンテキストウィンドウを備え、複数ステップのタスク中に自己検証を行うことで、先代のGrok 4.5から推論・コーディング・エージェント性能が向上したモデルであり、
GPT-5.6 Sol Maxに匹敵する知能を大幅に低いコストで実現している。
2026年8月12日2026年8月12日、OpenAIはClaude CodeやClaude Cowork、Cursorの設定・プロジェクトをChatGPTデスクトップアプリとCodex CLIへ移行できる公式インポート機能を発表。
インストラクションファイルやスキル、MCPサーバー設定、直近30日分のチャット履歴など8カテゴリのデータを自動検出して一括移行できる機能であり、
移行元のエージェント環境には一切変更を加えない非破壊設計を採用している。
2026年8月10日2026年8月10日、Alibaba CloudのQwenチームはテキストベースのAIコーディングエージェントに画像・動画・3D・CAD処理能力を追加するオープンソース拡張ライブラリ「Qwen-MM-Plugins」を公開。
Claude CodeやCodex、Qwen Codeなど主要なエージェントハーネスに対応し、画像認識やBlender 3Dモデリングなど6種類のケイパビリティをモジュール単位で導入できるツールセットであり、
Apache License 2.0のオープンソースとして無料で提供されている。
2026年8月8日2026年8月8日、Anthropicは複数の独立したClaude Codeセッション同士がテキストメッセージを自動で送受信できる「クロスセッションメッセージング機能」を発表。
開発者が指示するとClaudeが自律的に情報を共有し、受け取ったセッションがその情報をもとに作業を調整できる機能であり、
会話履歴やファイルではなくテキストサマリーのみを送受信する設計になっている。
2026年8月7日2026年8月7日、OpenAI・Amazon・Microsoft・Cursor・Vercelが共同でAIエージェント拡張のオープン規格「Agent Plugins」を策定。
Agent SkillsとMCPサーバーを1つのパッケージにまとめ、ChatGPTやCopilot、Cursorなど複数クライアントで共通利用できる規格であり、
v1.0.0時点でChatGPT・VS Code・Cursor・GitHub Copilot・Kiroが対応を表明している。
2026年8月3日2026年8月3日、Alibabaは2.4兆パラメータのMoEモデル「Qwen3.8-Max」を公開。
100万トークンのコンテキストウィンドウで長大なドキュメント処理に対応し、テキスト・画像・動画のマルチモーダル入力にネイティブ対応するモデルであり、
自律的なソフトウェア開発や複雑な長期プロジェクトの自動実行を可能にしている。
2026年7月31日2026年7月31日、ByteDanceは音声と映像を同時生成する「Audio-Video Joint Generation」機能を備えた最新動画生成モデル「Seedance 2.5」をリリース。
最大50件のマルチモーダル参照素材(画像・動画クリップ・音声)に対応し、ネイティブ4K出力と局所領域編集機能を備えた動画生成モデルであり、
1回の生成で30秒間の連続動画を作成することが可能である。
2026年7月29日2026年7月29日、OpenAIはコードの脆弱性を発見・検証・修正するオープンソースのコマンドラインツール「Codex Security CLI」を公開。
リポジトリをスキャンして脆弱性を検出し、サンドボックス環境で再現性を検証したうえでパッチ案を自動生成するツールであり、
CI/CDパイプラインへの組み込みやGitフックでの自動実行にも対応している。
2026年7月29日2026年7月29日、OpenAIは音声文字起こしに特化した新モデル「GPT-Live-Transcribe」と「GPT-Transcribe」を公開。
GPT-Live-Transcribeはリアルタイム音声を低遅延で逐次テキスト化するストリーミングモデル、GPT-Transcribeは録音済みファイル向けの高精度バッチ文字起こしモデルであり、
従来のWhisperやgpt-4o-transcribeに代わる推奨モデルと位置づけられている。
2025年11月27日2025年11月27日、Alibabaは新たな画像生成モデル「Z-Image-Turbo」をリリース。
Z-Image-Turboは、「Z-Image」をベースにした高速推論モデルであり、
写真級のリアリティと中英バイリンガルの正確な文字描画を両立することが可能である。
2025年11月24日2025年11月24日、OpenAIは新しい機能「ChatGPTショッピングリサーチ」を発表。
ChatGPTショッピングリサーチは、商品調査をAIが自動で代行する新機能である。
2025年11月21日2025年11月21日、Google DeepMindは最新の画像生成AI「Nano Banana Pro(ナノバナナプロ)」を発表。
Nano Banana Proは、「Nano Banana」(Gemini 2.5 Flash Image)を大きく上回る性能を持つ
画像生成・編集モデルである。
2025年11月20日2025年11月20日、xAIは新たなAIモデル「Grok 4.1 Fast」を発表。
Grok 4.1 Fastは、200万トークンのコンテキストウィンドウを備えているのが特徴で、
顧客サポートや財務などの実務で使えるようトレーニングされている。
2025年11月20日2025年11月20日、OpenAIは新しいAIコーディングモデル「GPT-5.1-Codex-Max」を発表。
GPT-5.1-Codex-Maxは、OpenAIの最新基盤推論モデルをベースにした
エージェント型コーディングAIである。
2025年11月18日2025年11月18日、Googleは新たなAIサービス「Google Antigravity」を発表。
Google Antigravityは、Googleが公開した新しい「エージェント指向のIDE」である。
2025年11月18日2025年11月18日、Googleはソフトウェア開発における重要な課題を解決するために
設計されたツール「Code Wiki」を発表。
Code Wikiは、ソースコードを読み取り、処理の流れやAPIの情報を自動で整理し
「開発チーム向けのWiki」を生成してくれるツールである。
2025年11月13日2025年11月13日、Googleから新たなAIエージェント「SIMA 2」を発表。
SIMA 2は、Google DeepMindが開発したAIエージェントであり、
3D仮想空間において人のパートナーとして行動・推論・学習ができる。
2025年11月13日2025年11月13日、OpenAIは「GPT-5.1」をリリース。
GPT-5.1は、GPT-5シリーズに属する2つの新モデル「GPT-5.1 Instant」と
「GPT-5.1 Thinking」から構成されている。
2025年11月12日2025年11月12日、ChatGPTに新しく「グループチャット」機能が追加。
グループチャットは、複数の人とAIを同じ対話空間に招き、友人との旅行計画から
職場の議論まで、共同でアイデアを出し合える場である。
2025年11月7日2025年11月7日、AlibabaはQwen3-Maxシリーズにおいて、推論性能を極限まで高めたモデル
Qwen3-Max-Thinking」をリリース。
Qwen3-Max-Thinkingは、すでに登場していたQwen3-Max-Instructをベースに、
論理的思考や数学的推論を中心に強化したモデルであり、「考えることに特化したAI」
として位置づけられている。
2025年10月30日2025年10月30日、OpenAIは自律型サイバーセキュリティエージェントの「Aardvark」をリリース。
Aardvarkは、コードリポジトリを継続的に監視し、脆弱性を「発見→検証→優先度付け→修正提案」
まで一貫して行えるため、自律型セキュリティエージェントとして定義されている。
2025年10月29日2025年10月23日、OpenAIは新たなオープンソース安全推論モデル「gpt-oss-safeguard」をリリース。
gpt-oss-safeguardは、「gpt-oss」シリーズをベースにファインチューニングされたもので、
開発者が独自のコンテンツポリシーをモデルに与え、
入力テキストの安全性を判定できる点が特徴である。
2025年10月27日2025年10月27日、xAIから次世代の知識プラットフォーム「Grokipedia」が発表された。
Grokipedia(グロキペディア)とは、Elon Musk氏が率いるAI企業 xAI によって開発された、
「生成AIを活用した独自の百科事典サービス」である。
2025年10月23日2025年10月23日、OpenAIから新たな機能「Company Knowledge」がリリース。
Company Knowledgeは、社内で使うGoogleドライブやSlack、SharePointなど
色々なサービスに分かれてしまった資料やメッセージを、
ChatGPT上で一度に探して答えを見つけることができる新しい仕組みである。
2025年10月22日2025年10月22日、OpenAIから新たなサービス「ChatGPT Atlas」がリリース。
ChatGPT Atlasは、AI搭載の新しいWebブラウザで、従来のように「ChatGPTを開いて質問する」
のではなく、どのWebページ上でもChatGPTがユーザーの操作を理解し、即座にサポートする
という体験を実現している。
2025年10月16日2025年10月16日、Anthropicから新たなAIサービスが「Agent Skills」がリリース。
Agent Skillsは、Claudeに特定の知識・手順・スクリプトをまとめて
読み込ませることができる機能である。
2025年10月16日2025年10月16日、Anthropicから新たな大規模言語モデル「Claude Haiku 4.5」が公開。
Claude Haiku 4.5は、Anthropic社が2025年10月16日に発表した
Claude 4.5シリーズの最新モデルである。
2025年10月9日2025年10月9日、Google Cloudが企業向けのプラットフォームとして
Gemini Enterprise」を発表。
Gemini Enterpriseとは、AIエージェントや各種ツールを連携する総合プラットフォームで、
Googleは「職場のAIへの入口」と表現している。
2025年10月7日2025年10月7日、xAIから新たなAIツール「Imagine v0.9」を発表。
Imagine v0.9(通称:Grok Imagine)は、テキストや画像を入力するだけで、
短いAI動画を自動生成できる次世代の映像生成ツールである。
2025年10月7日2025年10月7日に開催されたOpenAI DevDayで、OpenAIから新たなサービス
Apps Inside ChatGPT」がリリースされた。
Apps Inside ChatGPTは、ユーザーがチャット中に自然な流れでアプリを
呼び出し、操作できる機能である。
2025年10月7日2025年10月7日に開催されたOpenAI DevDayで、OpenAIはUIでワークフローを
構築しながらAIエージェントを作成できる「AgentKit」を発表。
AgentKitは、マルチエージェント型のAI開発を支援する統合ツール群で、
視覚的なワークフロー作成ツールや埋め込み型チャットUI、安全性フィルター、
評価フレームワークなどを含んでいる。
2025年10月7日2025年10月7日、Googleから新たなAIモデル「Gemini 2.5 Computer Use」が登場。
Gemini 2.5 Computer Useは、「Gemini 2.5 Pro」を基盤に構築され、
ユーザーインターフェース(UI)を直接操作できるAIエージェントである。
2025年10月6日2025年10月6日にGoogle DeepMindが新しいAIエージェント「CodeMender」を発表。
CodeMenderは、大規模言語モデルを活用して、ソフトウェアのセキュリティ向上を自動化する
画期的な取り組みとして注目を集めている。
2025年9月30日2025年9月30日、OpenAIから新たな動画・音声生成モデル「Sora2」が登場。
2024年2月に公開された初代Soraが「GPT-1に相当する」と評されたのに対し、
Sora2は「GPT-3.5に匹敵する進化」と位置づけられている。
Sora2は従来の動画・音声生成モデルに比べて物理的な正確さとリアリティが大幅に向上しており、
シーン内での失敗や偶然の出来事も自然に描けるのが特徴である。
2025年9月30日2025年9月30日、AnthropicはClaudeシリーズの最新モデル「Claude Sonnet 4.5」をリリースした。
Claude Sonnet 4.5は、特にコーディングと複雑なエージェント構築に優れたAIである。
公式発表では「世界最高のコーディングモデルであり、複雑なエージェント構築で最強、
コンピュータ操作も得意」と謳われていて、推論力や数学能力でも大きく性能が向上している。
2025年9月25日2025年9月25日、ChatGPTに新たなAIアシスタント「ChatGPT Pulse」を発表。
ChatGPT Pulseは、ChatGPTシリーズの中でも「最新情報を効率よく集め、
自分に合った形で整理できる」ことに強みを持つサービスである。
一般的なChatGPTと比べて大きな特徴は、ニュースや業界の動きを素早くキャッチできる点にある。
2025年9月24日2025年9月24日、GoogleがChrome DevTools MCPサーバーを公開。
Chrome DevTools MCPサーバーは、AIエージェントが実際のChromeブラウザを
操作・調査できるようにするMCP(Model Context Protocol)サーバーである。
MCPは、大規模言語モデルと外部ツールを接続するオープン標準で、
このサーバーを介してエージェントはChrome DevToolsの機能を
そのまま利用することができるようになる。
2025年9月23日2025年9月24日、GoogleがChrome DevTools MCPサーバーを公開。
Chrome DevTools MCPサーバーは、AIエージェントが実際のChromeブラウザを操作・調査できるよう
にするMCP(Model Context Protocol)サーバーである。MCPは、大規模言語モデルと外部ツールを
接続するオープン標準で、このサーバーを介してエージェントはChrome DevToolsの機能をそのまま利用
することができるようになる。
2025年9月23日2025年9月23日、Alibaba社は次世代のテキスト音声合成(TTS)モデル「Qwen3-TTS-Flash」をリリース。
Qwen3-TTS-Flashは17種類の音声プリセットを備えており、英語・日本語・中国語・フランス語などの
10言語に加え、北京語や上海語、広東語など多様な中国方言もサポートする
マルチリンガル・マルチダイアレクト対応モデルである。
2025年9月23日2025年9月23日、Alibabaから新たなオムニモーダルLLM「Qwen3-Omni」がリリース。
Qwen3-OmniはAlibaba Cloudが開発したエンドツーエンド型のオムニモーダルモデル。
テキスト・音声・画像・動画を入力として処理できるだけでなく、レスポンスをテキストと
自然音声の両方で即時に返すことが可能となっている。
2025年9月20日2025年9月20日、XAIから新たなAIモデル「Grok 4 Fast」がリリースされた。
このGrok 4 Fastは、「とても速くて手頃」なのが大きな特徴である。
複雑な質問にもすぐに答えてくれるため、待ち時間のストレスがない。
料金もこれまでのGrokより安くなっているので、個人でも会社でも気軽に使うことができる。
2025年9月19日2025年9月19日、AlibabaのTongyi Wanxiangチームは、オープンソースの
キャラクター動画生成モデル「Wan2.2-Animate」を公開。
Wan2.2-Animateは、静止画と動画を入力として、静止画の人物が動画の動きや表情を忠実に再現する
「モーション模倣」、および動画中のキャラクターを静止画の人物に置き換える
「キャラクタ置換」を実現するモデルである。
2025年9月16日2025年9月16日、OpenAIはGPT-5をプログラミング用途向けに高度に最適化したモデル
GPT-5-Codex」をリリース。
GPT-5-Codexは、実際のソフトウェア開発で必要なタスク
(新規プロジェクト構築、機能・テスト追加、デバッグ、大規模なリファクタリング、
コードレビューなど)に重点を置いて訓練されており、人間のコーディングスタイルに近いコードを
生成し、与えられた指示に厳密に従ってテストを繰り返す能力を持っている。
2025年9月12日2025年9月12日、Googleが新たなオープンLLMを発表。
VaultGemmaは、Google ResearchとGoogle DeepMindが共同開発した世界最大規模の
「差分プライバシー(DP)付き」大規模言語モデル。パラメータ数は約10億で、
オープンウェイトで提供され、Hugging FaceやKaggleでも利用可能である。
2025年9月12日2025年9月12日、AlibabaのQwenチームは次世代大規模言語モデル「Qwen3-Next-80B-A3B」を発表。
昨今、AI研究においてはパラメータ数や文脈長の拡大が続いていますが、
これに応える形で「Qwen3-Next」アーキテクチャが導入されました。
本モデルは、800億パラメータを持ちながら、実際の推論ではわずか30億パラメータしか
活性化しない超効率設計が特徴となっている。48→51に変更。
2025年9月9日2025年9月9日、新たな画像生成AIがByteDanceから登場。
Seedream 4.0は、TikTokの運営元であるByteDanceが2025年9月に発表した最新の画像生成AI。
これまでのSeedream 3.0(画像生成)とSeedEdit 3.0(画像編集)が一つになり、
生成から編集まで一気通貫で利用できるのが大きな特徴である。
2025年9月9日2025年9月9日、Alibabaから新たなモデルが登場。
Qwen3-ASR-Flashは、従来のASRモデルと比較して幅広い言語対応と高い認識精度を持つ
音声認識モデル。
対応言語は中国語(四川語、閩南語、呉語などの主要方言を含む)、
英語(米国英語、英国英語などの地域アクセントも含む)、さらに日本語、韓国語、フランス語、
ドイツ語、ロシア語、イタリア語、スペイン語、ポルトガル語の合計11言語である。
2025年9月6日2025年9月6日、Alibabaが最新の大規模言語モデル「Qwen3-Max-Preview」を公開。
本モデルは単なる世代交代ではなく、1兆パラメータを超える圧倒的な規模と
262,144トークンという驚異的なコンテキスト長を兼ね備えた最新の大規模言語モデルとなっている。
従来のQwenシリーズが持つ多言語対応力や推論性能をさらに強化し、
ClaudeやGemini、DeepSeekといった競合モデルを上回る性能を有している。
2025年9月4日2025年9月4日、Google DeepMindが新たなオープンソースのテキスト埋め込みモデルを発表。

EmbeddingGemma-300mは、GoogleがGemma 3アーキテクチャを基盤に開発した
テキスト埋め込み専用モデル。入力された文や文書を、意味を保持したベクトルに変換することで、
情報検索・分類・クラスタリングなどのタスクを高精度に処理可能。
2025年8月29日2025年8月29日、MicrosoftのAI部門「Microsoft AI(通称MAI)」は音声生成AI「MAI-Voice-1」と
その基盤モデル「MAI-1-preview」を公開。

MAI-Voice-1は、テキストから驚くほど自然な音声を超高速で生成できる音声AIモデルであり、
一方のMAI-1-previewはMicrosoft初の大規模言語モデル(LLM)で、
ユーザーからの指示に従って有用な回答を返すことに特化している。
2025年8月28日2025年8月28日、xAIから新たなエージェント型コーディング特化のAIモデルがリリースされた。

今回リリースされたGrok Code Fast 1は高速かつ低コストで、コーディングをサポートしてくれる。
Grok Code Fast 1は全く新しいモデルであり、軽量モデルアーキテクチャをベースにゼロから
設計されている。
2025年8月27日2025年8月27日、Google DeepMindは新たな画像生成AIモデル「Gemini 2.5 Flash Image」を発表。
このモデルはテキストで指示を与えるだけで、高品質な画像の生成や既存画像の編集を行える
最先端のAIである。
従来モデルの低遅延かつ低コストな強みはそのままに、画像の合成や細部の編集、
キャラクターの一貫性維持などクリエイティブな制御能力が大幅に向上している。

開発コードネーム「nano-banana」として、事前の評価サイトで話題を呼んでいたこのモデルは、
正式名称とともに公開され、生成AI界隈で大きな注目を集めている。
2025年8月27日2025年8月27日、Anthropic社がClaude for Chromeのプレビュー版をリリースしたと発表した。

Claude for Chromeとは、ブラウザの操作をAIエージェントが代行してくれるChromeの拡張機能である。

カレンダーの管理やメールの返信といったタスクを自動化できるため、
これまで手作業で実施していたルーティン業務から解放されるかもしれない。
2025年8月26日2025年8月26日、Microsoftから新たなTTSモデルがリリースされた。

今回リリースされたVibeVoice-1.5Bは長尺・マルチスピーカー音声生成が可能。
本モデルの開発背景として、従来のTTSが短い発話や単一話者に強かったのに対し、
本モデルはポッドキャストやオーディオブックのような長時間の会話音声を
自然に合成することを目的に開発されている。
2025年8月14日2025年8月14日、Googleは新たなオープンモデル「Gemma 3 270M」を発表。
Gemma 3ファミリーの一員であるこのモデルは、その名の通り、
約2億7千万パラメーターという極めて小型な規模ながら、高い性能と柔軟性を備えているのが
特長である。
2025年8月8日2025年8月8日、OpenAIが「GPT-5」を正式発表!
前世代のGPT-4oやo3の良さを引き継ぎながら、
「いつ素早く答え、いつ深く考えるか」を自動で切り替える統合設計が最大の特徴。
2025年8月6日2025年8月6日、OpenAIが1,170億(実稼働51億)パラメータの「gpt-oss-120b」と、
より軽量な200億パラメータの「gpt-oss-20b」の2本立てでリリースされており、
従来はクローズド環境に置かれがちだった高性能なLLMを、
誰でもダウンロードして検証・改変・再配布できるようになっている。
2025年8月6日、AnthropicはClaude Opus 4.1をリリースした。
前バージョンClaude Opus 4からさらなる性能向上を果たし、
特に複雑な推論・マルチファイルのコードリファクタリング、
実用的なエージェントタスクへの対応力が向上。
2025年8月5日2025年8月、Google DeepMindからAIモデル「Genie 3」が発表された。
テキストでの指示だけで、リアルタイムに操作可能な仮想世界を自動生成できるこのツールは、
まるでゲームのようなインタラクティブな体験を可能にし、
教育・研究・シミュレーションなど幅広い分野での活用が期待されている。
2025年8月5日、Alibabaから新たな画像生成AIが登場。
今回リリースされた「Qwen Image」は特に文字描画に長けており、
ただ単純に画像に文字が入っているレベルではなく、
「人がデザインしたかのように整って見えるテキスト・構成・スタイル」の画像を生成可能。
2025年7月29日ChatGPTに新しく「Study Mode(学習モード)」が追加された。
この機能は、ただ正解を提示するのではなく、
ヒントや対話を通じて「考える力」を育てる学習支援ツール。
対話を通じて学べる家庭教師のように、
学生一人ひとりの理解に寄り添うことが可能に。
MicrosoftがWebブラウザ「Edge」に新機能「Copilot Mode(コパイロットモード)」を導入!
AIがユーザーのニーズを先読みしてサポートする能動的なブラウジング体験へと進化させる試み。
2025年7月25日アリババ・クラウドは多言語翻訳に特化した最新モデル「Qwen3‑MT」をリリース。
wen3ファミリーの技術をそのまま受け継ぎつつ、
翻訳タスク専用に数兆規模の多言語・対訳トークンで追加学習が行われたモデル。
2025年7月23日アリババ CloudのQwenチームは、
コード生成特化型の巨大言語モデル 「Qwen3‑Coder」 をリリース。
Qwen3ファミリーの中でもエンジニアリングに特化した
オープンエージェントコーディングモデル。
2025年7月14日2025年7月14日、AWSからAIエージェント搭載のIDEが公開。
新たに公開された「Kiro」はコード補完に留まらず、
要件定義から設計・実装・テスト・デプロイまでを
AIエージェントと共に進めることが可能。
2025年7月10日2025年7月10日にxAI社が、Grokの最新モデルであるGrok4を発表。
先代のGrok3から大幅に進化を遂げ、ベンチマークの結果を見る限り
ChatGPTやGemeni、Claudeなどといった主要の生成AIツールよりもハイスコアを記録。
2025年6月25日Googleは最新の大規模言語モデルGemini 2.5 Proを直接呼び出せるツール「Gemini CLI」を公開。
VS Code拡張のGemini Code Assistと同じエージェント基盤でありながら、
より軽量かつスクリプトからも自在に呼び出せる点が特徴。
2025年6月18日2025年6月18日、「Gemini 2.5 Flash-Lite」が登場。
Gemini 2.5モデルの中で最も高速に動作し、最もコストに優れたモデル。
最大100万トークンの長文入力に対応し、テキスト・画像・音声・動画といったマルチモーダルにも対応。
2025年6月11日2025年6月11日、OpenAIは推論特化型モデル「o3」の最上位版となる 「o3‑pro」 をリリース!
200 kトークンという巨大なコンテキストを保持しながら、
数理・科学・コーディング領域で従来モデルを上回る精度を実現。
OpenAIは「最も信頼できる汎用AI」と位置付けており、
教育・研究・ビジネスの現場で“考える作業”そのものを肩代わりする存在として注目を集めている。
2025年6月6日2025年6月6日、Alibabaから新たなAIモデル「Qwen3-Embedding」が登場!
テキスト埋め込みモデルで、多言語対応。
従来のLLMと異なり、明示的なタスク記述に対応したLLM。
2025年6月3日2025年6月3日、Googleから「Gemini Fullstack LangGraph」が公開!
Geminiモデルの高精度な推論力とLangGraphの柔軟なエージェント制御が可能で
検索クエリの自動生成からウェブ調査、ギャップ分析、
回答生成までを一気通貫で実装しているのが特徴。 
公開からわずか数日でGitHub 2,000star超えを記録しており、
LLMエンジニアの間で話題を呼んでいる。
2025年5月23日Anthropicから「Claude Opus 4」が登場!
コーディング性能が高いLLMであり、
さらに複雑な問題解決に優れており、複数のエージェントに採用されている。
Cursor社や楽天が高い評価をしている。
同日「Claude Sonnet 4」が登場!
「高速性」と「深い推論力」のバランスを兼ね備えたモデル。
前世代のSonnet 3.7の「ハイブリッド推論」をさらに発展させ、
用途に応じて即座に高速レスポンスを返したり、じっくりと思考を深めたりと自在に調整可能。
2025年5月21日AI技術を中心に多数の新機能が発表された。
Gemini 2.5 Proの強化や、対話型検索が可能な「Google検索のAIモード」などが注目を集めたほか、
新たなLLMやAIアシスタント機能の進化も披露された。
Gemma 3n」が登場。
軽量・高性能なオープンソースAIモデルであり、
スマートフォンやタブレットなどのオンデバイス実行に最適化。
Gemini Nanoと同じ基盤技術を使用し、
「日常のデバイス上で動作するリアルタイムAI体験の実現」を目指して設計されたAIモデル。
Gemini Diffusionという「テキスト用拡散モデル」という新機軸を採用した研究モデルが公開。
従来の大規模言語モデル(LLM)がトークンを一語ずつ逐次的に出力するのに対し、
“ノイズを洗練させる”拡散過程を経て、複数トークンをブロック単位で同時に生成する。
動画生成AIのVeo3が登場!
音声付きの動画がプロンプト1つで生成できるように進化していて、
編集・リップシンク不要で会話調のショート動画などが作成可能に。
コーディング用AIエージェント「Jules」がリリース。
ソースコードの生成からデバッグ、プルリクエストまでの高度な自動化が可能。
OpenAIが繰り出す「Codex」の直接的なライバル。
2025年5月17日2025年5月17日、OpenAIから「Codex」が登場!
ChatGPTのサイドバーやターミナル、API経由で動作し、
コード生成からテスト、自動リファクタリングまでを一気通貫でサポート。
従来のコード補完ツールと異なり、仮想マシン内でコマンドを実行しながら結果を説明してくれるため、
開発プロセスの透明性と安全性が大幅に向上。
2025年5月2日Claudeに新機能「Integrations」を実装。
Web版&デスクトップ版Claudeと外部ツールを
「MCPサーバーのインストールなし」で実現してくれるように。
Claudeと外部ツールをシームレスに連携することが可能。
2025年4月30日Alibaba Cloudから最新大規模言語モデルファミリー「Qwen 3」がリリース!
前世代のQwen 2.5の推論・多言語性能に加え、
思考プロセスを“見せる/隠す”モードを自在に切り替えられるハイブリッド設計を採用し、
パフォーマンスとコスト効率を大幅に向上。
Microsoftから新たなSLM「Phi-4-reasoning」が登場。
推論に特化したSLM (Small Language Model) であり、
特に数学、科学推論、アルゴリズムの問題解決、コーディングといった分野で高い性能を発揮。
大規模言語モデルに匹敵する性能を軽量な構成で実現することを目的にしている。
2025年4月18日Googleから新たな大規模言語モデル「Gemini 2.5 Flash」がリリース。
速応答とコスト効率を維持しつつ高度な推論能力を備えた「ハイブリッド推論モデル」で、
従来モデル(Gemini 2.0 Flash)の優れた基盤の上に構築されており、
初めて「思考(thinking)」モードをオン/オフできる設計が採用。
2025年4月17日OpenAIから「o3」が登場。
GPT-4までの従来モデルと比べ、
「より長く考えてから回答する」ことを特徴とする「oシリーズ」の第3世代モデル。
ChatGPT環境において、ツールのフル活用が可能で、
ウェブ検索・コード実行(Python)・ファイルや画像の解析・画像生成といったあらゆるツールを
自律的に組み合わせて問題解決ができるように。
同日、推論能力やコスト効率にも優れたハイバランスモデル「o4-mini」が公開。
軽量でありながらも、推論能力が向上しているモデル。
軽量ながらもマルチモーダル対応であり、手書きの文字や画像内の情報も理解可能。
ターミナル上からコマンドラインで操作することができる、
コーディングエージェント「Codex CLI」も公開。
マルチモーダル対応であり、スクリーンショットや手書きのUIスケッチからコードが生成でき、
すべての処理はユーザーのローカル環境内で行われる。
2025年4月9日Googleが、Agent2Agentというオープンプロトコルを発表。
異なるベンダーやフレームワークで構成されたAIエージェント同士を
シームレスに連携し、一括で作業を行えるようにするプロトコル。
50社以上のテクノロジーパートナー主要なサービスプロバイダーが参加しており、
今後更なる機能の拡大が期待されている。
2025年3月26日Googleから試験版の「Gemini 2.5 Pro」が公開。
これまでで最も知的と位置づけられた次世代モデルであり、
回答生成前に内部で「思考」する能力を備えた大規模言語モデル。
前モデルのGemini 1.5やGemini 2.0 Proから大幅に進化しており、
数学・科学・コードの各種ベンチマークで競合を凌駕する結果に。
2025年3月24日Microsoftから「Playwright MCP」が登場。
LLMがWebブラウザを操作できるようにするためのツール。
高速かつ軽量で従来のスクリーンショットに頼らない新たな手法を用いているとのこと。
2025年3月21日2025年3月21日、OpenAIが次世代音声認識モデル
GPT-4o Transcribe」「GPT-4o Mini Transcribe」を公開。
「GPT-4o Transcribe」は、従来のWhisperモデルを上回る性能を持ち、
テキストベースのAIエージェントを音声対話へと拡張するような仕組み。
「GPT-4o Mini Transcribe」はGPT-4o Transcribeの軽量高速版であり、
モデルサイズを小型化し、推論速度を向上させている。
同日、OpenAIから新たな音声合成モデル「GPT-4o Mini TTS」も公開。
従来の音声合成モデルに比べ、
テキストをより自然な音声に変換するための軽量かつ高性能モデル。
話し方を指示できるのが大きな特徴で、音声出力の対応言語は多言語対応になっており、
英語はもちろん、スペイン語や日本語、フランス語、中国語などに対応している。
2025年3月12日2025年3月12日、OpenAIから新たなマルチエージェントワークフロー「Agents SDK」と
従来の「Chat Completions API」と「Assistants API」の統合「Responses API」が登場。
Agents SDKは、「swarm」をベースに改良されたAIエージェント開発フレームワークで、
高度なAIエージェント構築の支援、複雑なタスクの自動化を容易にすることを目的としている。
Webサーチやファイルサーチ、
コンピューター操作といったツールも組み込まれ、誰でも標準利用可能に。
2025年3月12日、Googleから「Gemma 3」が公開された。
リリースされたモデルは1B、4B、12B、27Bの4モデルで、1B以外はマルチモーダル対応(画像)。
Gemma 2と比べると、全てのベンチマークでスコアが向上しているが、
Gemini 2.0 FlashとProで比較してみると、性能がやや劣るよう。
2025年2月27日2025年2月27日、OpenAIはGPT-4oの後継にあたる「GPT-4.5」を公開。
思考力と会話の自然さが向上したGPT-4.5では、
従来モデルよりもわかりやすく、適切な回答が行えるようになった。
2025年2月27日、Microsoftから新しい言語モデル「Phi-4-mini」が公開。
Phi-4-miniは3.8億パラメータを持つコンパクトなモデル。
従来の大型モデルに匹敵する性能を発揮。
小型かつ高速なモデル設計のため、エッジデバイスやオンデバイス実行での利用が可能に。
2025年2月27日、Microsoftから新しい言語モデル「Phi-4-multimodal」が公開。
Phi-4-multimodalはテキストのみならず画像や音声などの入力が可能なマルチモーダルモデル。
テキストだけではなく、画像や音声などの組み合わせによる推論が可能になっていて、
音声+テキストや画像+音声などといった推論が可能に。
2025年2月20日2025年2月20日、「PaliGemma 2」をベースとした「PaliGemma 2 mix」を公開。
追加の学習なしで汎用的な画像と言語の処理能力を発揮する実用的なモデルであり、
マルチモーダル入力も可能。
物体検出やOCRに活用できる。
2025年2月25日2025年2月25日、AnthropicからClaudeの新たなモデル「Claude 3.7 Sonnet」が公開。
安全性と性能を兼ね備えたハイブリッド型の推論モデル。
従来のモデルにはない新たな「拡張思考モード」を搭載し、
複雑な問題に対しても回答できるように。
2025年2月6日2025年2月6日、Googleは「Gemini 2.0シリーズ」を拡張。
Gemini 2.0に「Pro」モデルと「Flash-Lite」モデルが追加された。
Gemini 2.0 Proは、これまでのモデルに比べコーディング性能が向上。
200万トークンのコンテキストウィンドウをもち、
大量の情報を一度に処理することも可能に。
Gemini 2.0 Flash-Liteは低コスト版として開発され、
処理コストは100万トークンあたり約0.019ドル。
2025年2月2日2025年2月2日、ChatGPTの新機能であるdeep researchを公開。
検索、分析し、高精度なレポートを自動生成するエージェント機能を搭載。
2025年1月31日2025年1月31日OpenAIから「o3-mini」が登場。
従来の「o1-mini」と比較して応答速度が24%向上し、より正確な回答を提供。
推論モデルと検索機能が統合された初期のモデルとなった。
2025年1月29日2025年1月29日、QwenグループからVLM「Qwen2.5-Max」が登場。3日連続のリリースとなった。
事前トレーニングは20兆トークンで、
DeepSeek V3、GPT-4o、Claude-3.5-SonnetなどのLLMと比較し、
DeepSeek V3を上回る性能を発揮。
2025年1月28日2025年1月28日、QwenグループからVLM「Qwen2.5-VL」が公開された。
画像とテキストだけではなく1時間を超える動画を解析し、特定のイベントを識別することが可能。
エージェント機能が搭載され、AndroidのUI操作やタスク実行ができるようになった。
2025年1月27日2025年1月27日、Qwenグループから「Qwen2.5-1M」が登場。
他の大規模言語モデルと比較して、同等またはそれ以上の性能を持ちながら、
計算コストが低く、効率的に動作するように。
2025年1月23日2025年1月23日、OpenAIからWebブラウザを直接操作して
タスクをこなすことができるAIエージェントが公開。
画面に表示されるボタンやメニュー、テキストなどのGUIで操作できるように。
2025年1月21日ソフトバンク、OpenAI、オラクル、MGX、Arm、Microsoft、NVIDIAなど大手企業を中心に
全世界に莫大な経済的利益をもたらす取り組み。
AI技術の安全性と倫理的側面への配慮は不可欠であり、
これらの企業は透明性のある運用で、新しい時代を築いていくことが期待されている。
2025年1月14日OpenAIは、2025年1月14日に、リマインダー機能である「タスク」を
有料プラン加入ユーザー向けにベータ版として提供開始。
指定した時間に指定したタスクをこなすことができるので、
ChatGPTを使って毎日繰り返し行う作業や、時間になったら最新のニュースを通知してくれる様に。

AGIパラメータ

AIの能力を評価する指標には

  • チェスなどの対戦ゲームで広く使用されている評価システム「Elo」
  • 言語理解の能力を評価するためのベンチマーク「MMLU」
  • Google Deepmindの「Levels of AGI: Operationalizing Progress on the Path to AGI」

などがありますが、
これらを生成AIに適用し、みなさまにわかりやすく表現するのは難しいため、弊社で独自の指標を用意しました。

AGIパラメータの定義

スクロールできます
仕事消滅レベル仕事消滅度実行者実行領域概要
レベル00%適用外AIは一切介入せず、人間が全ての作業を行い完成品ができる。
レベル11~25%限定的人間が指示を出し、ブレスト等を通じてAIがアイデアを出すが、人間の行動のみで完成品ができる。
レベル226~50%限定的人間が指示を出し、人間が主体で作ったものをAIが添削して、それを繰り返し、最後に人間が軽く添削して完成品ができる。
レベル351~75%限定的人間が指示を出し、AIが主体で作ったものを人間が確認して完成品ができる。
レベル476~99%AI限定的指示出しから作業過程ではAIだけが行動し、完成品の最終確認は人間が行う。
レベル5100%AI際限なし人間は一切介入せず、AIのみで完成品ができる。

AGIパラメータ

スクロールできます
仕事内容仕事消滅レベル仕事消滅度リードプロジェクト代替範囲
メール作成レベル123%Claude for Chrome文脈に応じたメール文面のたたき台をAIが提案できるようになったが、送信可否の判断や細かいニュアンス調整は人が行う必要がある。
資料作成レベル228%Google AI PlusAIが資料のたたき台を作成し、人が主体になって内容を練り上げる形が中心。ゼロから完成品まで任せるにはまだ人の手直しが欠かせない。
文書作成レベル121%GPT-5.3 Instant文章生成のアイデア出しや構成案の提示は得意になったが、事実確認や仕上げの品質担保は人が担う場面が多い。
コーディングレベル375%Exa in Codex & ChatGPT自然言語からの高度な自律コーディングや大規模リファクタリング、エージェント型の開発作業まで任せられるようになったが、要件定義や最終レビューは依然として人が担う。
コピーライティングレベル121%Grok Imagine APIキャッチコピーや広告文の複数案出しは得意だが、ブランドトーンや微妙な言葉選びの最終判断は人が行う。
正確な情報のリサーチレベル250%Exa in Codex & ChatGPTWeb検索と要約を組み合わせた調査レポートの下書きをAIが作成できるようになったが、情報の正確性検証や優先順位付けは人がリードする必要がある。
多言語翻訳レベル227%Gemini 3.5 Live Translate50以上の言語でテキスト・音声・画像を横断した翻訳が可能になったが、ネイティブレベルの自然さや文化的ニュアンスの再現は人の確認が必要。
クリエイティブ作成レベル124%Qwen-Image-2.0-Proデザイン案の複数提示やラフ生成は可能になったが、ブランドガイドラインに沿った完成度の高い最終成果物は人の調整が欠かせない。
3Dオブジェクトの作成レベル125%Qwen-MM-Plugins画像からの3Dモデル生成に加え、BlenderやCADツールをAIエージェントが直接操作できる事例が登場し始めたが、実用品質にはまだ人の手直しが必要。
絵画の作成レベル243%Qwen-Image-3.0高精細な画像生成・編集AIが相次いで登場しているが、細部の一貫性やブランド要件に沿った完成度は人による選定・調整が前提となる。
人間らしい会話内容の表現レベル240%Claude’s memory自然な対話や長期記憶を組み合わせた会話AIが増えているが、複雑な感情理解や一貫した人格表現はまだ発展途上。
人間らしい会話スピードの実現レベル124%Gemini 3.1 Flash Live低遅延なリアルタイム音声対話の基盤モデルが増えてきたが、人間同士の会話に近い間合いの実現はまだ発展途上。
人間が作るのと遜色ない音楽の作成レベル120%Suno AI作詞から作曲まで一定水準で行えるが、人間が作るのと遜色ないと言えるクオリティにはまだ差がある。
リアルタイム音声翻訳レベル121%Gemini 3.5 Live Translateリアルタイムでの音声翻訳が可能なモデルが登場しているが、イントネーションや自然さの面でまだ改善の余地がある。
動画編集レベル121%Gemini Omni 1.1 FlashAIによる動画編集支援が広がっているが、人間が意図や指示を細かく与える必要があり、自律的な仕上げにはまだ届かない。
動画の作成レベル233%Gemini Omni 1.1 Flash高品質な動画をテキストや画像から生成できるようになったが、長尺かつ一貫性のある作品に仕上げるには人の編集・選定が必要。
連続したタスクの実行レベル374%Gemini 3.7 Flash複数ステップにまたがる自律的なタスク遂行や長時間のエージェント運用が実用段階に入ったが、最終確認や軌道修正は人が担う。
仕事消滅度(2026年08月28日更新)

AGI終末時計について

終末時計が、世界の平和を祈る注意喚起であるように、
AGI終末時計も、AIによる支配を目指すものではありません。

むしろ日本らしいロボットアニメやドラえもんのような、
AIとの共創カルチャーを目指し、
子どもたちがAI-Nativeな時代で楽しく過ごせるように。

私たち大人が「未来に追いつく指標作り」をヴィジョンとして運営していきます。

このAGI終末時計は、皆様からのご意見を元に客観的な視点をもって随時更新されていくことを前提としています。
AGI度数やAGIレベル、そしてそれぞれの数値について皆さんのご意見や批判を受け付けております。
ご意見がある際はX(Twitter)にて #AGI終末時計 とつけてポストしてください。
弊社で確認させていただきます。

【運営元のWEELについて】

運営元のWEELについて

WEELはただの情報発信ではなく、未来予測をする拠点としてメディアを位置付けてきました。

活動は多岐にわたり、

  • OpenAIやGAFAMの生成AI競争の記事化
  • 次のトレンドを予測して、GitHubで生成AIのOSSをレビュー
  • HuggingFaceから面白いLLMを記事化
  • お客様のPC操作を模倣する自律型AIの開発

etc…

これまでの活動で得たノウハウ、最新情報、

そして皆様からのフォードバックとお便りをもって

AGI終末時計を更新し続け、現在のAIの進歩を可視化することで

AGIの到来にどこまで近づいているかお伝えします。