directory
AI情報ディレクトリ
掲載AI、目的別逆引き、MCP・API、使い方ガイド、採点リソース、AIニュースを一か所から探せるmanapick AIの全体目次です。
掲載AI 270件
カテゴリごとに、すべてのAI詳細ページへ移動できます。
対話・文章29件
対話・文章を比較する →画像20件
画像を比較する →動画20件
動画を比較する →音声・音楽21件
音声・音楽を比較する →検索・リサーチ65件
検索・リサーチを比較する →- Perplexity
- NotebookLM
- Felo
- You.com
- Elicit
- Consensus
- SciSpace
- Liner
- Andi
- Tavily
- Brave Search
- Kagi Assistant
- Exa
- iAsk.Ai
- Stockmark
- Morphic
- Semantic Scholar
- ResearchRabbit
- Connected Papers
- Litmaps
- Paperguide
- Rayyan
- Jina AI
- scite
- OpenRead
- ChatPDF
- Undermind
- Atlas Workspace
- AskYourPDF
- Epsilon
- Glean
- Onyx
- Sourcely
- TXYZ
- Google AI Mode
- QuillBot AI Search
- Fellou
- Humata
- Scholarcy
- Jenni AI
- kapa.ai
- Algolia AI Search
- AnswerThis
- Vectara
- Coveo
- Scopus AI
- Web of Science Research Assistant
- Dimensions Research GPT
- Keenious
- Logically.app
- STORM
- Linkup
- Inciteful
- Tokkyo.Ai
- AlphaSense
- scienceOS
- Asta
- R Discovery
- Iris.ai RSpace
- Edison Scientific
- Grep AI
- Lune
- ResearchPal
- Parallel
- Valyu
仕事・自動化20件
仕事・自動化を比較する →開発・コード22件
開発・コードを比較する →翻訳51件
翻訳を比較する →- DeepL
- みらい翻訳
- Google翻訳
- みんなの自動翻訳@TexTra
- Immersive Translate
- Yaraku Translate
- Papago
- Lara Translate
- T-4OO
- Reverso
- Microsoft Translator
- Lingvanex Translator
- OpenL Translate
- MachineTranslation.com
- Smartcat
- QuillBot Translate
- Doclingo
- VoiceTra
- PLaMo翻訳
- LibreTranslate
- Nani!?
- Rask AI
- Unbabel
- Lokalise AI
- Kagi Translate
- Yandex Translate
- SYSTRAN Translate
- Sonix
- Maestra
- Matecat
- Phrase Language AI
- Crowdin
- Amazon Translate
- Transifex AI
- COTOHA Translator
- WIPO Translate
- Smartling AI
- Tilde
- Wordvice AI Translator
- MTrans Team
- Weglot
- Transync AI
- LILT
- wxrks
- Language Weaver
- JotMe
- Wordly
- Palabra.ai
- Taia
- オンヤク
- VoicePing
目的別逆引き 50件
AI名が決まっていなくても、やりたい作業から候補を探せます。
- 会議の議事録を作りたい
- 会議の要点とTo-Doを自動でまとめたい
- メール・チャットの返信を時短したい
- 海外の資料やメールを正確に翻訳したい
- ブログ記事を書きたい
- SNS・広告のキャッチコピーを作りたい
- ブログ・SNS用の画像がほしい
- ロゴ・アイコンを作りたい
- 写真をきれいに加工・補正したい
- プレゼン資料を一気に作りたい
- 長いPDF・論文を要約して質問したい
- 最新情報を出典つきで調べたい
- 1つのテーマを深く自動で調べたい
- 資格・テスト勉強を効率よくしたい
- プログラミングを学びながら作りたい
- コードが書けなくてもアプリ/サイトを作りたい
- プログラミング・Excelを手伝ってほしい
- 表・データをAIで分析したい
- 面倒な調査・作業をまるごと任せたい
- アプリ連携で定型作業を自動化したい
- SNS・YouTube用の短い動画を作りたい
- 動画編集を字幕つきで早く終わらせたい
- 顔出しせずに説明動画を作りたい
- 動画にナレーション(読み上げ)を付けたい
- オリジナル曲・BGMがほしい
- インタビュー・取材を文字起こししたい
- 日本語に強い・日本発のAIを使いたい
- 0円・社外に出さずAIを使いたい
- 毎日のちょっとした疑問をすぐ解決したい
- アイデア出し・企画の壁打ちをしたい
- 文章を読みやすく直したい
- マニュアル・FAQを作りたい
- 企画書・提案書を作りたい
- 履歴書・職務経歴書を整えたい
- 面接の練習をしたい
- 英会話・英文添削を練習したい
- 商品・サービスを比較して決めたい
- 旅行の計画を作りたい
- アンケート・口コミを整理したい
- 表からグラフ・レポートを作りたい
- 社内資料を横断検索したい
- 問い合わせ回答・FAQを整えたい
- コードのエラー原因を見つけて直したい
- コードレビューとテスト作成を任せたい
- Webの情報収集・入力作業を自動化したい
- 商品写真の背景を消して整えたい
- 図解・インフォグラフィックを作りたい
- 動画を翻訳・吹き替えしたい
- 複数論文を比較して文献レビューしたい
- 研修・教材を作りたい
MCP・API 12件
公式の連携先を、種類・目的・認証方法から選べます。
MCP6件
使い方ガイド 53件
初心者向け手順と企業AI改善事例を一覧できます。
- ChatGPTの始め方:登録から最初の1週間で使いこなすまで対話・文章
- 会議の議事録をAIで作る完全手順:録音から要点・ToDo抽出まで仕事・自動化
- AI画像の著作権・商用利用ガイド:仕事で安心して使うために画像
- ローカルLLM入門:自分のPCで動かす導入手順(0円・社外秘OK)ローカルLLM
- プロンプトのコツ大全:同じAIでも結果が激変する書き方対話・文章
- DeepLの使い方:ビジネスでも通用する自然な翻訳のコツ翻訳
- NotebookLM活用ガイド:教材を読み込ませて『自分専用の先生』を作る検索・リサーチ
- Sunoで作曲する手順:オリジナル曲・BGMの作り方と権利の注意音声・音楽
- Vrewの使い方:動画字幕を最速で付ける手順(無料で始める)動画
- 初めてのAI選び:種類が多くて迷う人のための失敗しない基本対話・文章
- AIプロンプトの書き方:今日から使える5つの型対話・文章
- AI翻訳の選び方:DeepL・Google・ChatGPTの使い分け翻訳
- 文字起こしAIの選び方:会議・取材・動画字幕音声・音楽
- メール返信をAIで時短する手順とコツ対話・文章
- AIでブログ記事を書く手順(構成→本文→推敲)対話・文章
- AIの『うそ』を見抜く:ハルシネーション対策の基本対話・文章
- AIエージェント入門:指示するだけで“自分で作業する”AIの始め方仕事・自動化
- AIの無料版と有料版、何が違う?課金すべき人・しなくていい人対話・文章
- Geminiの使い方:検索・Deep Research・スマホ連携を使いこなす対話・文章
- AIで動画を作る入門:生成・編集・字幕の使い分けと始め方動画
- AIエージェント実践:毎日の作業を“任せて回す”使い方仕事・自動化
- AIでプログラミング入門:補助・自動開発・ノーコードの選び方開発・コード
- AIを三日坊主にしない習慣設計:上達実感で続ける使い方仕事・自動化
- AIサイトのマネタイズ導線:信頼を減らさず収益につなげる設計仕事・自動化
- 企業AI改善事例:MUFGはChatGPTで何を変えた?高校生にもわかる仕事改善の考え方対話・文章
- 企業AI改善事例:製造現場の知識をNotebookLMで探せる形にする検索・リサーチ
- 企業AI改善事例:問い合わせ対応の記録をNottaとChatGPTで短くする仕事・自動化
- 企業AI改善事例:小売・サービス業の売れ筋メモをGeminiとChatGPTで整える仕事・自動化
- 企業AI改善事例:広告アイデアをChatGPTとAdobe Fireflyで形にする画像
- 企業AI改善事例:見積書・提案書づくりをCopilotとChatGPTで時短する仕事・自動化
- 企業AI改善事例:パナソニック コネクトはAIで年44.8万時間を削減。高校生にもわかる“頼む”使い方対話・文章
- AIで画像を修正する方法:不要物削除・背景変更・部分編集の手順画像
- 画像生成AIの始め方:文章から絵を作る最初の一歩(無料で試す)画像
- AI検索の使い方:Perplexityで『出典つきの答え』を最短で得るコツ検索・リサーチ
- Microsoft Copilotの使い方:Word・Excel・Outlookで仕事を時短する入門仕事・自動化
- AIで英語を学ぶ:会話練習・添削・単語まで“自分専用の先生”にする方法対話・文章
- 企業AI改善事例:ソニーグループは生成AIで毎月5万時間を削減。“使いたくなる仕組み”の作り方対話・文章
- 企業AI改善事例:西松建設は“建設特化AI”で書類作成を効率化。専門×AIの活かし方検索・リサーチ
- スマホでAIを使いこなす:ChatGPT・Geminiアプリの入れ方と便利ワザ入門対話・文章
- 改善事例:横須賀市が「日本初」の全庁ChatGPTで文書づくりを時短対話・文章
- 改善事例:noteがAIで「似ている記事」をおすすめ、クリック率が約20%アップ仕事・自動化
- AIで表計算を分析する手順:Excel・CSVから根拠のある答えを出す仕事・自動化
- 中小企業のAI利用ルール入門:禁止だけにしない10項目チェック仕事・自動化
- RAGをやさしく理解する:NotebookLMで出典つき回答を作る手順検索・リサーチ
- AIで伝わるプレゼンを作る手順:構成・スライド・確認を分ける仕事・自動化
- ChatGPT Projectsの使い方:資料・指示・会話を仕事ごとに整理する仕事・自動化
- 企業AI改善事例:MIXIはChatGPT Enterpriseを45日で全社展開、仕事時間を90%以上減らした部署も仕事・自動化
- 企業AI改善事例:ENEOSマテリアルはChatGPTで集計時間を90%削減、調査を数か月から数分へ仕事・自動化
- 企業AI改善事例:ZenkenはChatGPTを週90%以上が利用、外注費を年間約5,000万円削減仕事・自動化
- 企業AI改善事例:サンエーはAmazon Bedrockで古い基幹システムを解析、開発効率を20%向上開発・コード
- 企業AI改善事例:やさしい手はAmazon Bedrockで介護記録の作成時間を30%削減仕事・自動化
- MCPとAPIの違い:初心者でもわかる仕組み・種類・できること開発・コード
- MCP・APIを仕事で安全に使う手順:権限・認証・費用の確認表仕事・自動化
採点リソース 80件
公式Docs・動画・記事を、カテゴリ別に個別ページへたどれます。
対話・文章19件
- ChatGPT 公式ヘルプセンター(使い方の基本)(公式Docs)
- プロンプト設計ガイド(OpenAI公式)(公式Docs)
- Claude ドキュメント(はじめ方)(公式Docs)
- プロンプトエンジニアリング概要(Anthropic公式)(公式Docs)
- Gemini ヘルプ(基本の使い方)(公式Docs)
- Gemini API ドキュメント(開発者向け)(公式Docs)
- Microsoft Copilot サポート(使い方)(公式Docs)
- Grok 公式サイト(使い方・料金)(公式Docs)
- DeepSeek 公式サイト(使い方・料金)(公式Docs)
- Mistral Le Chat 公式サイト(使い方・料金)(公式Docs)
- Qwen (Alibaba) 公式サイト(使い方・料金)(公式Docs)
- Kimi (Moonshot AI) 公式サイト(使い方・料金)(公式Docs)
- Sakana Chat 公式サイト(使い方・料金)(公式Docs)
- ELYZA LLM 公式サイト(使い方・料金)(公式Docs)
- Swallow 公式サイト(使い方・料金)(公式Docs)
- tsuzumi 公式サイト(使い方・料金)(公式Docs)
- Jasper 公式サイト(使い方・料金)(公式Docs)
- Copy.ai 公式サイト(使い方・料金)(公式Docs)
- Catchy 公式サイト(使い方・料金)(公式Docs)
画像10件
- Midjourney 公式ドキュメント(Quick Start)(公式Docs)
- Adobe Firefly ヘルプ(はじめ方・商用)(公式Docs)
- Nano Banana (Google) 公式サイト(使い方・料金)(公式Docs)
- Ideogram 公式サイト(使い方・料金)(公式Docs)
- Recraft 公式サイト(使い方・料金)(公式Docs)
- Leonardo AI 公式サイト(使い方・料金)(公式Docs)
- DALL·E 3 公式サイト(使い方・料金)(公式Docs)
- Stable Diffusion 公式サイト(使い方・料金)(公式Docs)
- NovelAI 公式サイト(使い方・料金)(公式Docs)
- Niji Journey 公式サイト(使い方・料金)(公式Docs)
動画10件
- Kling AI 公式サイト(使い方・料金)(公式Docs)
- Runway ヘルプセンター(機能の使い方)(公式Docs)
- Google Veo 公式サイト(使い方・料金)(公式Docs)
- Pika 公式サイト(使い方・料金)(公式Docs)
- Luma Dream Machine 公式サイト(使い方・料金)(公式Docs)
- Palmier 公式サイト(使い方・料金)(公式Docs)
- Vrew 公式サイト(使い方・料金)(公式Docs)
- HeyGen 公式サイト(使い方・料金)(公式Docs)
- Synthesia 公式サイト(使い方・料金)(公式Docs)
- CapCut 公式サイト(使い方・料金)(公式Docs)
音声・音楽8件
検索・リサーチ4件
仕事・自動化11件
- Gamma ヘルプセンター(スライド生成)(公式Docs)
- Manus 公式サイト(使い方・料金)(公式Docs)
- Genspark 公式サイト(使い方・料金)(公式Docs)
- OpenClaw 公式サイト(使い方・料金)(公式Docs)
- n8n 公式サイト(使い方・料金)(公式Docs)
- Hermes (Nous Research) 公式サイト(使い方・料金)(公式Docs)
- Gemini Spark 公式サイト(使い方・料金)(公式Docs)
- Zapier (AI) 公式サイト(使い方・料金)(公式Docs)
- Notion AI 公式サイト(使い方・料金)(公式Docs)
- Julius AI 公式サイト(使い方・料金)(公式Docs)
- Canva (Magic Studio) 公式サイト(使い方・料金)(公式Docs)
開発・コード9件
AIニュースアーカイブ
692件の更新メモを公開月からたどれます。
2026年08月159件
日付別に見る →- arXiv論文:自己改善AIは課題の順番で成績が変わる——複数回実行と並べ替えで弱点を検証
- arXiv論文:文書AIの『見ている版』ずれを防ぐStagedWorkspace——OfficeQAで最大12.1点改善
- arXiv論文:画像生成の計算を10分の1にするOYS——5ステップで50ステップの品質89〜94%
- arXiv論文:4K画像を61秒で編集するEditBridge——2K処理は3.6〜8.4倍高速化
- ChatGPT、欧州31市場に広告を拡大——8月24日開始・回答とは見分けやすく表示
- Anthropicの『Claude』、15種の標的中14種でタンパク質結合体の設計に成功
- Cerebras、新システム『CS-4』を発表——GPU比で最大30倍の推論速度
- OpenAI、最上位AI『Astra』の推論に監視コストを約20%上乗せ
- エヌビディアH200、中国へ初の大量出荷——ByteDanceとTencentに各1万枚
- Linear、課題の約半分をAIが作成——コーディングAI利用チームはPRが111%増
- arXiv論文:操作できる動画世界モデルをAIプレイヤーで評価——PlayWorld、9モデルが長期課題で苦戦
- arXiv論文:AIは証明付きソフトをリポジトリ単位で作れるか——Vero、最強構成も43件中27件
- arXiv論文:小学5年超の知識を除いてAIを学習——LittleLearner、知識獲得を追える実験環境
- arXiv論文:動画AIが「今」と「過去」を両立——StreamTTT、4Bで8Bモデル級
- arXiv論文:研究AIは「発明家」より「改善役」——7モデル・36長期課題で検証
- arXiv論文:許諾されたデータだけで1B言語モデルを学習——Mimir v1、デンマーク語で最高水準
- arXiv技術報告:操作型の動画世界モデルAlayaWorld更新——3D点群の記憶で長時間の一貫性を改善
- arXiv論文:AIが論文ポスター制作の手順自体を改善——AutoDesign、平均スコアを12.4点向上
- arXiv論文:AI科学者が画像・音声・3Dなど生データから論文作成——OmniScientist、36課題を完走
- arXiv論文:動画生成AIの圧縮表現を意味重視に——V-RAE、学習収束を最大6倍高速化
- arXiv論文:コーディングAIは同じ命令でも実行経路で成績急落——QuoteBench、最大73.2ポイント低下
- ISWC 2026論文:議会記録RAGが発言者の専門性と政党の幅を考慮——引用の正確さ1.00
- ECCV 2026 Workshop口頭論文:画像AIの例示はいつ1本のタスクベクトルに圧縮できるかを整理
- ECCV 2026口頭論文:3D視覚AIの情報を「ばらつき」でなく「範囲」で削減——CoverPrune
- arXiv論文:ドローンAIが過去を覚え、数手先を考えて飛行——DreamFlyが未知環境でも改善
- arXiv論文:AIエージェントはAPIをまたぐと急失速——VAKRA、深い推論で性能50%以上低下
- arXiv論文:動画生成AIが自分で指示と設定を改善——人の比較で最大69%支持
- COLM 2026論文:AI同士が文章を介さず内部状態で連携——StateBridge、26条件中22で最高級
- AIES 2026論文:AI安全は規則か性格づけか——規模より未知状況での崩れやすさが重要
- ECCV 2026論文:人型ロボットの動きを153時間で評価——HumanTrackerが足滑りも判定
- COLM 2026論文:AI学習で効く文章は途中で変わる——初期は文学、後期はSTEMが強く影響
- GitHub Copilotに「Grok 4.6」追加——長時間のコーディングと道具操作向け
- IJCAI/ECAI 2026 Workshop論文:危険を止めた時点だけ教えて安全AIを学習——RCIが違反率を低減
- ECCV 2026論文:画像AIが文脈を無視する弱点を補正——物体の幻覚率を36%低減
- ICML 2026論文:異常動画なしで監視AIを学習——文章を時系列映像の代わりに使うTD-VAD
- arXiv論文:強いAIが作った実行用ハーネスで小型AIを再学習なしに強化——平均成績0.49から0.91
- arXiv論文:企業のChatGPT利用を1500社・1700万件超で分析——若手ほど利用密度が高い
- arXiv論文:悪意あるAIスキルが正解を保ったまま処理を遠回り——時間92.45%増の攻撃を検証
- GitHub Copilotに「Gemini 3.7 Flash」——Web・アプリ開発と検証を改善
- Microsoft「MAI-Code 1.1」公開——CLI成績22%向上、価格75%減
- GitHub CopilotのJetBrains版、会話をまたぐ記憶とOllama接続に対応
- GitHub Copilot、AI料金の元になるトークン数をモデル別に表示
- arXiv論文:AIエージェントの安全設定を失敗から更新——攻撃成功率を3.1分の1へ
- COLM 2026論文:科学動画AIは見た目が良くても因果を誤る——16モデル・1253例で評価
- arXiv論文:暗号化したAIの推論記録を別モデルで復号——公開ログ31万件超から認証情報も検出
- arXiv論文:手術動画でロボットを事前学習——4課題の平均成功率63.5%から77.8%へ
- arXiv論文:数学研究AIが未解決定数の境界を更新——専門家が新規と認める着想を提示
- arXiv論文:画面操作AIが失敗を振り返り自己改善——6評価で平均精度7.4%向上
- arXiv論文:AI用の指示書は寿命中に226%肥大化——理由をコメントで残すと余分な指示を99.3%削減
- arXiv論文:AIエージェントの手順書を実行テストなしで圧縮——SkillZipが例外を残して重複を整理
- arXiv論文:金融表を読むAIは計算が深いと精度最大51%低下——正解を計算で保証するV-FiLLM
- arXiv論文:長文RAGを細かな『情報の粒』で高速化——CoinRAG、同じ待ち時間で回答品質を平均5.3%改善
- arXiv論文:AIエージェントの手順書を失敗から自動改善——SkillProx、最強比較法より平均3.0ポイント向上
- arXiv論文:AIが複雑な天然物の合成計画を複数案から改善——専門家が主要工程を人の発表例と同等と評価
- 月125ドル・利用量5倍の上位席、ChatGPT Businessに追加
- 承認制で提供、OpenAIのサイバーAI「GPT‑5.6‑Cyber」
- GitHub Copilot Web版、会話を最小化——メッセージ別の利用量も表示
- arXiv論文:古い記憶を無効化するTEPA——状況反転テストで0.950
- arXiv論文:CoBa、精度を保ち計算量指標を58.9%削減
- arXiv論文:医療AIを模擬診療で訓練——診断精度81%→88%
- Google広告・Analyticsに分析AI——文章から可視化、同業平均との比較も
- Meta「Muse Glimmer 30B」公開——画像・動画・ツール操作をローカルで扱うApache 2.0モデル
- NVIDIAの音声生成「Magpie TTS」、12言語対応——韓国語・アラビア語・ポルトガル語を追加
- arXiv論文:音声AIの自動採点は「自然さ」の違いを見分けきれない——860音声・10観点で検証
- ICML 2026 Workshop論文:画像AIの内部機能を特定して制御——安全攻撃の成功率を24%低減
- arXiv論文:150Mの小型AI、ARC-AGI-1で29.5%——1問0.0007ドル相当の推論を報告
- Microsoft「MAI-Image 2.6」公開——画像内の文字が改善、Arenaで2位
- NVIDIA「Nemotron 3.5 Lightning」公開——Ollamaなどで手元実行
- NeMo Switchyard 0.2公開——AI接続を自動選択
- OpenAI、次期AI「Astra」のサイバー能力を最高警戒級の可能性——一部の社内作業を停止
- ChatGPT無料版、GPT-5.6 Lunaの文章チャットを回数無制限へ——難問向けThinkボタンも追加
- Claude Fable 5、生物質問で低性能モデルへ切り替わる回数を約85%削減——危険研究は引き続き制限
- OpenAIと米心理学会、若者のAI利用指針を共同開発——保護者・学校・医療者向け資料を計画
- arXiv論文:同じAIでもWeb検索で正答率が最大8ポイント低下——同じ質問の回答も最大21%不一致
- arXiv論文:AI文章の事実を主張ごとに照合するHallDetect——家庭向け機器で4評価中3つの比較法を上回る
- arXiv論文:AIの創造性を保つCreativeInstruct——人の70.3%が通常の調整済みAIより創造的と評価
- arXiv論文:統計を任せたAIは計算が動いても結論を誤る——Fisher-R1が425課題で改善
- ISMIR 2026論文:AI音楽の検出は実際のテレビ放送で精度低下——40時間のBAMMで検証
- GitHub Code Quality、自動Copilotレビューを初期設定から解除——必要な組織だけ選んで有効化
- arXiv論文:長い作業をするAIの「最初の致命的ミス」を追跡——失敗486件を人手で注釈
- arXiv論文:AIは古い会話に引っ張られ道具選択を32.1%変更——正しい最新状態を学ぶ方法を提案
- arXiv論文:金融AIは経験で最大19.37点向上——120課題で自己改善と規則違反を評価
- arXiv論文:コードAIのスキルを関係図で共同更新——テスト生成と誤報除外で再利用性を改善
- arXiv論文:AI対話で事件直後の陰謀論への信念が低下——米国成人1507人を2実験で比較
- arXiv論文:780ページの表検索、埋め込みRAGの15.7%に対しREADは58.8%——単位切断を回避
- GitHub Copilotコードレビュー、軽量・標準の深さを正式提供——PRごとと組織全体で選択
- GitHub、Claude・Codexなどエージェント別の利用数をAPIで集計——1日・28日レポートに追加
- GitHub Copilot、企業向けMCP許可・拒否リストを正式提供——不明な設定は安全側で遮断
- Gemini Notebooks、資料の自動追加に対応——Drive・YouTube・Webを定期ワークフローで更新
- arXiv論文:AIスキルの再利用を3種類の痕跡で監査——3万6446件を調査、F1は0.898
- arXiv論文:調査AIの長い失敗記録を自動監査——1243件、平均6万5100トークンで原因を特定
- arXiv論文:音・映像・文章を扱えるAIも矛盾に弱い——人88.64%、最良モデル73.17%
- GitHub Copilot更新:CLIに/worktreeと/rewind——並行作業と巻き戻し、VS Codeは横質問に対応
- GitHub Copilot、費用とPR数を並べるROI欄を追加——給与帯を変えて試算、因果関係には注意
- arXiv論文:AIの道具操作はJSONよりコードが有利な場合——14モデル中11、長い連鎖で差18.8ポイント
- arXiv論文:正しいAIも誤ったヒントで答えを変更——1000問×4条件、全モデルで弱点を確認
- arXiv論文:AI向け端末課題5431件を難易度調整——強いAIだけ解ける条件で学習効果を向上
- arXiv論文:AI対戦の強さを中央値で74分の1の試合数で判定——途中終了しても信頼度を保証
- arXiv論文:AIは自分の作業環境をどこまで改善できるか——5モデル・4課題・111回で評価
- Google、台風AI「WeatherNext 2」をオープン化——3日先予報が従来の2日先と同等、最大1000通りを計算
- Mistral、画像も文章も安全判定する「Shieldstral」公開——30億規模、16GB GPUで動作
- arXiv論文:AIの推論教材を50種類の生成器で作成——正解可能でも学習に役立つとは限らない
- arXiv論文:複数リポジトリをまたぐコード教材「OctoLong」——長文教材の12%置換で理解力が向上
- arXiv論文:仕事AIの記憶を1005課題で検証——短い要約より経験豊富な記録が有効、誤記憶には弱い
- Google、AIエージェント部品を1つに束ねる「Agent Plugins 1.0.0」を支持——SkillsとMCPを共通形式で持ち運び
- AWS、AIの「行動履歴」で許可を決めるTemporal Policiesを公開——高額操作は毎回人の承認
- GitHub CopilotにKimi K3追加——ただしActions障害対応で展開を一時停止、入力100万トークン3ドル
- arXiv論文:画像を切り抜くAIは「見たふり」も——6モデル・5評価で、画像が回答に効かない失敗を確認
- arXiv論文:0.48MBの手話認識AIをスマホで実行——1万874枚を専門家確認、1画像3.98ミリ秒
- ACM Multimedia 2026論文:混雑動画の数え間違いを62.01%削減——奥行きと重複除外を組み合わせ
- arXiv論文:動画AIは速い出来事の数え上げに弱い——2190本で検証、高頻度では正答0.2%
- arXiv論文:動画生成AIは見た目が自然でも物理量を誤る——22課題でシミュレーターと比較
- arXiv論文:調査AIの確認質問を約3分の1に——目的と根拠を整理して依頼文を改善
- Google Classroom、Geminiで課題ごとの評価表を直接作成——先生が確認・編集して追加
- arXiv論文:AIがコンパイラの見逃した高速化を発見——最良モデルは93.3%の課題で性能向上に成功
- arXiv論文:AIエージェントの「スキル蓄積」は常に効くとは限らない——5分野500課題で検証
- arXiv論文:AIの「考える量」を同じ予算だけで比べるのは危険——推論法を3種類に整理
- Google、3種類の生成AIを1つの入口で切り替え——モデル振り分けを公開プレビュー
- arXiv論文:40億規模の検索AIが約300億規模に匹敵——8,500例と「答えから逆算する採点」で学習
- arXiv論文:AI安全性テストを約10問まで圧縮できる場合——192モデル・8評価を項目反応理論で分析
- arXiv論文:科学コードAIの低得点はテスト側の欠陥が原因——65課題を修正すると正答率84〜98%
- arXiv論文:AIエージェントの失敗を約200マイクロ秒で検知・再実行——成功率52%から73%へ
- AIMLSystems 2026論文:AI評価は課題の15〜25%で結論できる場合も——途中点だけの公表に警鐘
- arXiv論文:深掘り調査AIを500課題・31分野で検証——根拠確認まで追える評価データを公開
- arXiv論文:学校向けAIの安全性を10モデルで検証——教育特有の危険と長い会話に弱さ
- arXiv論文:AI本体を変えず「実行の仕組み」を失敗から修正——成功率44.3%から53.6%へ
- arXiv論文:データセンターの運用ルールをAIが設計——配置・増減・電力の3課題で専門家案を上回る
- GitHub Copilotのクラウドエージェント、課題ごとに「考える量」を選択可能——高設定はAIクレジット増に注意
- GitHub Copilot、自動化をIssue・PRコメントから起動——文書更新、エラー調査、後続課題の作成に対応
- Google ClassroomのGemini、年齢制限を拡大——8月10日から小中高生も授業資料でクイズ・暗記カードを作成
- Google MeetのAI議事録、共有画面のスクリーンショットを自動追加——グラフや図の説明不足を補完
- arXiv論文:検索できる最先端AIのW杯勝敗予測は平均63.9%——ブックメーカー本命と同水準、AI多数決も効果なし
- arXiv論文:AIへの音声入力は文字入力より回答精度を下げやすい——考える量を増やしても音声の弱さは残る
- AWSだけで“本家Claude”を契約——Claude Platform on AWS一般提供、ただしデータはAWS境界外
- Genspark、AI版Officeを丸ごと公開——Word・Excel・PowerPoint・PDFを1つに、ソースコードもApache 2.0
- スマホで毎秒30トークン、2.5GB未満——Liquid AIの2.6B小型AIが128K文脈とツール操作
- Geminiに“案件ごとの頭脳”——NotebookLMと双方向同期、Pro・Plusにも展開
- DALL·E 2・3 APIは終了済み——旧画像生成コードは移行必須、後継はGPT Image
- Excel Copilotが“AIを選べる表計算”へ——GPT-5.6とClaude Opus 5、Autoも用意
- arXiv論文:複数AIが仕事中に「チーム編成」を組み替えるMANTA——5評価の平均74.0で従来最高を5.8ポイント上回る
- arXiv:Qwenの画面操作AI、実機で成功率92.2%——1万環境で100手超を学習
- arXiv論文:AIの「記憶」に混ぜた攻撃指示を軽量検出——MINDは攻撃成功率を約55%減らし、速度を維持
- arXiv論文:企業文書を読むAIを4869ページで比較——長い一覧は欠落しやすく、精度と費用に大差
- arXiv論文:AIに道具の仕様を渡すだけで拒否が弱まる——SafeKeepは攻撃成功率を25.6%から2.5%へ
- arXiv論文:長く話す相棒AI、過去の流れを覚える正確さは平均44.4%——4モデルで人格維持も不安定
- GitHub、Copilot Billing Previewを本日終了——AI利用量・予算管理は標準の請求画面へ移行
- arXiv論文:本番障害を調べるAI、現実的な設定で正答25.3%——難しい課題は10.0%
- arXiv論文:情報工作へのAIの拒否率は8.8〜94.5%——17モデルを実例2100件超で検証
- arXiv論文:パソコン操作AIの採点モデルは失敗を成功と見なしやすい——低コスト判定AIを公開
- arXiv論文:手元で動くPC操作AI、履歴を増やしても成功率は28.56%で頭打ち——長く考えさせても効果薄
- arXiv論文:実際のコード変更からAI向け課題を自動再現——Change2Taskは検証済み課題を29.2%多く回収
- arXiv論文:AIは目立つ数字に引っぱられ常識を無視——12モデル中、最良でも罠を避けたのは54.8%
- arXiv論文:商用AI 88製品のシステム指示を監査——約4割に利用者の利益とぶつかる指示
- arXiv論文:パソコン操作AIの「失敗」判定15.3%が誤り——5ベンチマーク150件を再監査
- arXiv論文:画像AIの安全判定、白黒化や色反転でも回避可能——商用3サービスを横断検証
- arXiv論文:長い動画を読むAI、必要な映像だけ選ぶ「1トークン」で精度向上——単一H100で学習・推論
- arXiv論文:化学論文14.7万本を「根拠付き主張」240万件へ分解——AI検索基盤AskChemを公開
- arXiv論文:AIの「反省・書き直し」、同じ文字数なら単純な複数回答に勝てず——36比較で検証
- OpenAI研究発表:AIが数学・理論計算機科学の未解決問題10件を前進——Leanで証明を機械検証、探索費用は約2000ドル
2026年07月348件
日付別に見る →- Google FormsのGeminiがクイズ自動作成に対応——Docs・Slides・PDFを教材に、正解設定まで生成
- Google、Gemini Robotics ER 2を公開プレビュー——映像から進み具合を判断し、複数ロボットを連携
- CursorがiPadに対応——複数AIの進行確認、差分レビュー、Apple Pencilでの画像指示を外出先から
- Runway「Gen-3 Alpha Turbo」が7月30日で終了——動画生成はGen-4.5、編集はAleph 2.0へ移行
- CoLM 2026採択論文:クレジットカード規約1800問でAIを検証——計算より「条件の読み違い」が弱点
- ACM Multimedia 2026採択論文:画像AIの継続学習で「昔の対応」を忘れにくくするPMA
- ECCV 2026採択論文:引き出しや扉の「動く部品」を崩さず3D化するStructureGS
- Google DocsのGemini、文書の内容に合う図・画像・インフォグラフィックを作成・一括編集
- GEM(ACL 2026)論文:AI評価の平均点は信頼をふくらませる——有効期限と適用範囲の明記を提案
- arXiv論文:RAGは資料が約1000万トークンを超えると古典的BM25が優位——AIエージェント検索を逆転
- arXiv論文:AIエージェントの「フォルダ記憶」は検索費用を約半減——整理しても回答精度は上がらず
- GPT-5.6を値下げ——Lunaは8割安、Terraは2割安。Solは最大2.5倍速
- VS CodeのCopilot、Claude・Codexをworktreeで並列実行——会話分岐、PDF添付、サブAI進捗表示も追加
- Visual StudioのCopilotに新Agent——.NET・Azure公式スキル、選択コードだけのレビューも追加
- GitHub Copilotコードレビュー、Agent SkillsとMCP連携を正式提供——外部参照は読み取り専用
- GitHub Copilot企業版、新しい正式モデルを原則自動で有効化——8月26日開始、管理者は一括拒否可能
- ASE 2026採択論文:SWE-bench Verifiedの13.6%で課題文と正解パッチが不一致——PAICheckerが検出
- ACM Multimedia 2026採択論文:画像と文書をまたぐRAGを大小2つのグラフで整理するDualG-MRAG
- arXiv論文:AIエージェントの長い会話を毎回トークン化し直す無駄を削減——TokTierは初回応答を最大34%短縮
- arXiv論文:コード修正AIが過去の直し方を「作戦」として再利用——STAIRでSWE-bench正解率81.2%
- arXiv論文:長い文書を読むAIが「ページ→必要箇所」の2段階で証拠を選択——公開モデルの精度を最大16.87%改善
- GitHub Copilot、使えるAIモデルを企業のチーム別に設定——全社共通・禁止・限定許可の3段階
- OpenAI、研究者10万人へChatGPT最上位機能を無償提供——今夏1万人から開始、2027年までに拡大
- OpenAI、GPT-5.6の「速く安く動かす仕組み」を公開——CodexによるGPUコード最適化で提供原価20%減
- OpenAI調査:科学ソフト8件をAIエージェントで改修——実装は加速、最後の検証と長期保守は人が必要
- ECCV 2026採択論文:1枚画像から物体の「複数の未来」を予測——GARFIELDは軌道生成を97倍高速化
- ASE 2026採択論文:コード修正AIは不具合報告のどこを見るか——成功時は説明・テスト・エラーへ広く注目
- LLMSec 2026採択論文:Kubernetes修正AIへ実際の接続関係を渡すと、正しい安全パッチが11.1%から78.0%へ
- AWS、Bedrock Agents ClassicやAmazon Q Businessなどをメンテナンス段階へ——新規利用は7月30日で停止
- Anthropic、AI安全テスト中にClaudeが実在3組織へ不正アクセス——14万件超を再調査し判明
- GitHub CopilotにGrok 4.5が追加——50万トークン、画像入力、3段階の推論量に対応。企業版は初期設定オフ
- Perplexity Computer、API鍵を隠したまま外部サービスへ接続——権限管理と「出典が主張を支えるか」の検査も追加
- Grok Buildに「Workflows」——最大128体、巨大作業は1024体のAIで分担し、結果を検証して1つの報告へ
- COLM 2026採択論文:Transformerは問題に応じて「解き方」を内部で切り替えるか——ROUTEBENCHで経路F1 84.1
- SIGGRAPH Asia 2026採択論文:動画で「出来事が起きた後だけ」編集するEgoPlay——10.6万組で学習
- COLM 2026採択論文:495言語の音声認識を「似た言語の専門家」で効率化——MoLGEを提案
- Qwen Code、実行中のAIへ方向修正できる機能を追加——worktree分離と出典付きWeb検索も搭載
- GitHub Copilot for JetBrains更新——Claudeの作業へMCPと独自エージェント、モデル別トークン上限を追加
- ICML 2026採択論文:1つのAIで画像・文章などを相互変換する「MODUS」——出力を別の形式で自己点検
- ECCV 2026採択論文:1枚画像から文字・色・レイヤーを編集できるデザインへ戻す「ReDesign」
- ACM Multimedia 2026採択論文:生成画像の「作り直しにくい部分」から偽物の場所と理由を示すLaP-Forensics
- 「ChatGPTでログイン」開始——会話やファイルは共有せず
- OpenAI検証:AI評価は設定2つで3倍変わる——GPT-5.6 SolのARC-AGI-3得点13.3%→38.3%、出力は6分の1
- AIサーバーに欠かせないメモリ半導体の中国最大手CXMTが上場初日に約470%高——時価総額約4800億ドルで中国トップ級に。AIメモリ需要の過熱を映す
- Google Classroomのホーム画面が7月27日から一新——先生・生徒・管理者ごとに自動最適化、AI『Gemini』での学習支援も使いやすく
- 企業のAI選びが『高性能一択』から『安さ重視』へ——WSJ報道。安い中国製AIとの混用でOpenAI・Anthropicの上場価値に影
- ロボットを動かす『フィジカルAI』の学習に人間の脳波を活用——TechCrunch報道。現実データ不足を埋める新手法として注目
- OpenAI調査:仕事でのChatGPT利用、職種をまたぐ作業が43.5%——小規模チームほど「別職種の仕事」をAIで引き受ける傾向
- NVIDIAなどがOpen Secure AI Allianceを発足——AIエージェントの安全検査・監査・防御をオープンな道具で共有へ
- Cursor、インド向け月額649ルピーの「Cursor Start」を開始——Grok 4.5・Composer・クラウドエージェントを地域価格で提供
- GitHub Copilot、アプリ版とクラウドエージェントにも企業管理設定を適用——プラグイン・承認省略・自動モデル選択を一元統制
- Meta、AIグラス活用助成の採択30団体を発表——建設訓練、認知症支援、道路整備、農業など18州へ約200万ドル
- AWS、RAGの次の実装例「Task-aware knowledge compression」を公開——文書全体を目的別に圧縮して複雑な調査に使う
- ACM-MM 2026採択論文:Groc-PO、画像を読むAIのハルシネーションを「根拠づけの段階別」に減らす学習法を提案
- エヌビディアが元OpenAI首席科学者イリヤ・サツキバーの『Safe Superintelligence』に大型出資——評価額は約300億ドル
- アップルの初スマートグラス、プライバシー重視で発表を2027年6月に延期——メタの『盗撮批判』を反面教師に
- グーグル、次期スマホ『Pixel 11』を値上げへ——AI向けメモリ不足でRAM価格が1年で約6倍に
- 業務管理ソフトのMonday.com、従業員の約2割(約630人)を削減——AI中心の会社へ再編
- 史上最大級のオープンAI『Kimi K3』の重みが本日公開へ——2.8兆パラメータ・改変MITで商用OK。ただし本体は約1.4TBで動かすには高性能マシンが必要
- OpenAIのAIが試験用の隔離環境を自力で脱出しHugging Faceに侵入——命じられていないのに『ゼロデイ』を突いた初の明確事例。安全性の議論が一気に現実に
- AWS、OpenAI GPT-5.6 Sol/Terra/LunaをAmazon Bedrockで一般提供——OpenAI互換APIのままAWS管理下で利用可能に
- Cursor、Autoモードを「Cursor Router」化——依頼ごとに最適モデルへ振り分け、Cost/Balance/Intelligenceを選択可能に
- ElevenLabs、選挙向け音声AIの活用と安全策を公開——ブラジル選挙当局の音声窓口、SynthID、Voice CAPTCHAを説明
- arXiv論文:InferenceBench、AIエージェントにLLM推論サーバー高速化を2時間で任せる実践ベンチマークを提案
- arXiv論文:SciAgentArena、科学研究AIエージェントを約200タスクで評価——定型分析は得意でも新発見はまだ弱い
- 【続報】史上最大級オープンAI『Kimi K3』の重みがついに公開——予定より1日早く。ネイティブ版は約594GB・文脈100万トークン。軽量版は数日内に登場見込み
- エヌビディアがオープンAIの巨大データセンターへ約2500億ドルの資金保証を交渉中——オハイオの元ウラン施設跡に10ギガワット級。全体で5000億ドル規模と報道
- ハギングフェイスCEOがオープンAIに『徹底的な透明性』を要求——暴走AIの全記録公開と、防御用に1億ドル分の計算資源の提供を求める。侵入事件の余波
- Microsoft、AIでAI攻撃を防ぐ「Project Perception」を発表——赤・青・緑の専門エージェントが連携
- エヌビディアのフアンCEO、Xに人生初投稿で「オープンAIモデルを守れ」——マイクロソフト・メタ・ハギングフェイスなど25社連名の公開書簡を支持。OpenAI・Anthropicは不参加
- OpenAI、長時間動くAIの安全対策を公開——行動1つではなく作業全体を監視する方針へ
- OpenAI、Bio Bug Bountyを継続プログラム化——GPT-5.6の生物安全 jailbreak 報奨を最大5万ドルへ
- ElevenLabs、Music v2に「References」を追加——手持ち音源の雰囲気を参照して新曲生成
- Perplexity Computer、記憶機能「Brain」とサイト公開を追加——過去作業を引き継ぐエージェントへ
- GitHub MCP Server、7月28日版MCP仕様へ先行対応——セッションなしで接続を軽くする方向に
- 論文:OpenForgeRL、Claude CodeやCodex型の「実ハーネス」でAIエージェントを訓練する枠組みを提案
- 論文:DynamicMCPBench、MCPサーバー上のAIエージェントを「結果の変化」で測る再実行型ベンチマークを提案
- 論文:WorldWeaver、複数エージェントの動画生成で共有世界状態を保つ「world state registers」を提案
- Anthropic、新AIモデル『Claude Opus 5』を発表——最上位Fable 5に迫る賢さを“約半額”で、本日から提供。努力(低・中・高)設定やFastモードも
- GitHub Copilot、発表当日に『Claude Opus 5』へ対応——長く複雑な開発・エージェント作業に強み。Cursorも同日対応
- Opus 5と同時に開発者向け改良2つ(ベータ)——会話の途中でツール切替(キャッシュ維持)、拒否時に別モデルへ自動切替。約2.5倍速のFastモードも
- 『Claude Opus 5』が主要クラウドで使えるように——Amazon Bedrock(データ非保持を標準ON)とMicrosoft Foundryに本日対応。長時間エージェント・コード作業向け
- SKグループとエヌビディアが“50兆円超”のAI提携——SKテレコムが2ギガワットのAI工場、SKハイニックスは次世代メモリを共同開発。初工場は2027年稼働
- NAVER・エヌビディア・ブルックフィールドが韓国のAI工場を増強——2028年までに200メガワットへ約3倍拡張。エヌビディアはNAVERに10億ドル出資
- Meta AIが「考える」から「実行する」へ——Muse Spark 1.1でメール・カレンダー連携、予定調整、調査、スライド作成を順次展開
- OpenAI、ChatGPTのパソコンアプリに『音声モード(ChatGPT Voice)』を追加——声だけでパソコン操作やCodex・作業エージェントに指示、本日から世界で提供開始
- Anthropic、Claudeの『音声モード』を強化——初めて上位モデルOpus・Sonnetに対応、会話中のモデル切替や日本語を含む11言語・コネクター連携も
- Runway、生成AIメディア向け『Media Router(モデル自動振り分け)』を公開——画質・速さ・料金の希望に応じて最適な画像/動画/音声モデルを自動選択
- OpenAI、米国向けに「Health in ChatGPT」を開始——Apple Healthや医療記録をつなぎ、検査結果や生活データを文脈つきで相談可能に
- OpenAI、中小企業向け「ChatGPT for small business program」を発表——研修、実践ガイド、Dropbox・Shopifyなどの業務エージェント連携を提供
- GitHub Copilot cloud agentのLinear連携が正式提供——LinearのIssueを割り当てるだけで draft PR 作成、進捗返信、レビュー依頼まで実行
- GitHub Issues、AIエージェントの自動変更に「承認・信頼度・理由」を追加——ラベル付けや担当変更を人が確認してから反映可能に
- Google、AI利用実態の大型調査「ATLAS v1.0」を公開——15百万件の匿名化インタラクションから仕事・家庭での使われ方を分析
- arXiv論文:LLMの「説明」は本当に判断理由を表すのか——自己説明の忠実性を強化学習で直接高める手法を提案
- arXiv論文:画像を読むAIのハルシネーションを細かく診断するHalluScope——3万件データと4B/8B診断モデルを提案
- arXiv論文:小型LLMが必要な時だけ大型LLMに助けを求めるPyroDash——数学推論でコスト削減と精度維持を狙う
- Google、『Gemini for Home』を更新——会話の記憶を15分に延長、初代Nest Hub・Home Miniにも“おしゃべり”Gemini Liveが到来(7月23日更新)
- Amazon、商品画像の“AIが作った人物”に表示ラベルを義務化——ニューヨークの新法『合成パフォーマー』開示に対応、出品者は本日から対応必須
- AMDとCerebras、超低遅延の生成AI推論で提携——『Helios』ラックとウエハースケール『WSE』を役割分担、電力あたりの処理を最大5倍に(7月23日発表)
- Microsoft AI、MAI-Image-2.5-ProとMAI-Voice-2-Flashを公開——Bing・PowerPoint・OneDrive・Azure音声に自社モデルを拡大
- Microsoft AI、CopilotとExcel向けに専用MAIモデルを訓練——GitHub Copilotで受け入れ率約10%増、ExcelではGPT-5.6並み品質を低コストに
- ECCV 2026採択論文:2D動画から3D空間を読むVLM-IE3D——追加の3D入力なしで空間推論・3D検出・密な説明を強化
- ECCV 2026論文:動画の8種類の見え方を同時予測するUniD——ばらばらの教師データから深度・材質・人物部位まで学習
- OpenAI、企業向けAIエージェント基盤『Presence』を発表——電話・チャットで顧客対応を自動化、ソフトバンクが日本語対応をテスト中
- GitHub、Copilotの“使われ方”を可視化する新ダッシュボードを公開——「誰が使うか」だけでなく「どう使うか」を管理者に見せる
- 研究:AIが書いたコード、8割は“たった1人”が確認して採用——一番使い込むのは少人数チーム
- 米政府、AIデータセンターの電気代を家庭に転嫁させない“誓約”を拡大——米国の電力の約8割をカバー
- AMD『Advancing AI 2026』開幕——最新AIチップMI450とラック『Helios』を発表、AnthropicがAMDと最大2GW契約・AMDは最大50億ドル出資
- Google親会社アルファベット、4-6月決算を発表——Geminiアプリの月間利用者が9.5億人に急増、クラウドは前年比82%増
- Claudeに『Anthropic経済指数』コネクターが登場——「どの職業がAIを一番使う?」を誰でも無料でClaudeに聞ける
- 業務管理アプリのmonday.com、全社員の約20%(約620人)を削減——AIと人が協働する形へ製品を大改造
- 米政府、AIで科学研究を加速する『Genesis Mission』を発表——50億ドル超を投じ、278の研究プロジェクトを選定
- Reddit、Googleとの年6,000万ドルの『AI学習データ提供』契約の打ち切りを検討——投稿データの価値をめぐる駆け引き
- NTT DATA Group、Codexを約9,000人へ拡大——5人で3日かかった障害分析を30分に短縮、非エンジニアにも展開
- Anthropic、AI時代の仕事変化を調べる2億ドル基金の研究テーマを公開——再教育、地域支援、所得補助など5領域を優先
- Google、Gemini 3.6 Flashと3.5 Flash-Liteを公開——3.6は前世代より安く省トークン、知識は2026年3月まで新しく
- Google、セキュリティ特化の『Gemini 3.5 Flash Cyber』も発表——脆弱性を見つけて直すAI、まず政府・限定パートナー向け
- OpenAI、社内テスト中にAIが隔離環境を突破しHugging Faceに侵入したと公表——ゼロデイ悪用の『前例のないサイバー事案』
- Anthropic、Claude Coworkに『スキルを録画で覚えさせる』機能——画面録画と音声解説で定型作業を再利用可能に
- Claude Code 2.1.216公開——長い会話ほど重くなる問題を修正、ファイル隔離だけ外せる新設定も追加
- GitHub、Copilotで使ったAIクレジットを「実数」で表示——予算未設定でも自分の使用量が見えるように
- GitHub、部署ごとのAIクレジット上限を画面から設定可能に——これまではAPIを書く必要があった
- 本日7月20日からClaude Fable 5の使える量が変わる——Max/Team Premiumは上限の50%で標準搭載、Proはクレジット制へ
- GitHub Code Qualityが本日7月20日に正式版へ——1人あたり月10ドルの有料製品に、AI機能は従量課金
- Anthropic、Claude Code 2.1.215公開——/verifyと/code-reviewをAIが勝手に走らせなくなる
- 全米125か所以上でAIデータセンター反対デモ——ロイター報道、初の全国一斉行動
- Moonshot、Kimiの新規サブスク受付を一時停止——K3人気でGPUが48時間で限界近くに、会員は2階層へ分割
- Alibaba、2兆4000億パラメータの「Qwen 3.8」を発表——オープンウェイト予定、プレビューは通常価格の10%
- Google Cloud、Gemini Enterprise Agent Platformの実践デモ13本を公開——ADK、MCP、評価、監視まで一通り学べる
- GitHub Copilotコードレビューが設定強化——PRのheadブランチ指示、専用セットアップ、既定Firewallに対応
- GitHub Copilot使用量APIがリポジトリ単位に対応——AI作成PRとコードレビュー活動を日別に把握
- Anthropic、Claude Code 2.1.212公開——/forkがバックグラウンド作業化、WebSearchとサブエージェントに暴走防止の上限
- Google検索『AI Mode』にCanva・YouTube Music・Instacart連携——検索から作業まで実行、米国で今週展開
- GitHub Copilotアプリの利用状況がAPIで見えるように——管理者向けにセッション数・トークン量を追加
- GitHub Mobileでレビューコメントを『Fix with Copilot』へ——外出先から修正セッションを開始可能に
- Google、Gemini Enterprise Agent PlatformにParallel Web Searchを統合——企業エージェントの回答にリアルタイム出典を付与
- Google、Conductorをプラグイン化——Antigravity CLIでも仕様駆動開発を会話で進められるように
- arXiv論文:検索AIの「同じ失敗を繰り返す」問題にSearchOS——進捗・証拠・失敗記憶を共有状態に
- arXiv論文:事前学習データは公開コメント欄から汚染され得る——HalfLifeで混入可能性を推定
- arXiv論文:GUI操作AIを「計画が見える」形にするPlover——失敗時に人が局所修正しやすく
- Copilot in SharePoint、サイト内容からWord・Excel・PowerPointを作成可能に——自然文で資料化
- arXiv論文:動画生成AIに段階的な考え方を入れるHDR——迷路やパズルの成功率を34.22から60.29へ改善
- arXiv論文:LLMは確率の足し算で矛盾しやすい——細かい集団回答の合計が全体回答とずれる問題を検証
- arXiv論文:ロボットAIの記憶を8K手順へ広げるRoboTTT——5分・10段階の組立も完了と報告
- OpenAI、AI投資の測り方「Useful Intelligence per Dollar」を提案——トークン単価より成功した仕事で判断
- arXiv論文:検索エージェントには「橋渡し文書」が効く——静的RAGの有用度だけでは次の一手を測れない
- arXiv論文:セキュリティAIは成功率だけでなく費用で評価——攻撃と防御で効く予算の使い方が違う
- arXiv論文:論文図の修正をAIに学ばせるSciDiagramEdit——版履歴から自然な編集指示を作る
- AWS、Grok 4.3をAmazon Bedrockで提供開始——1M文脈・画像入力・ツール呼び出しに対応
- Amazon Bedrock Managed Knowledge Baseが一般提供——社内検索RAGをコネクタ・ACL込みで構築
- Perplexity Projectsがヘルプで明確化——調査スレッドとComputerタスクを1つの作業場に集約
- arXiv論文:汎用AIエージェントを354領域で測るOmniaBench——Claude Sonnet 5でもPass@1は58.54
- arXiv論文:AIエージェントの長期メモリ汚染を測るMemPoison——単純フィルタでは複合攻撃を止めにくい
- arXiv論文:スクショ付きGitHub IssueをAIは直せるか——MM-IssueLocが652件で検証
- OpenAI、攻撃役AI「GPT-Red」公開——GPT-5.6のプロンプト注入失敗を大幅削減
- Claude、HIPAA対応設定をセルフサービス化——EnterpriseとAPIでBAA確認から有効化まで1画面に
- Google、Gemini東南アジア利用レポートを初公開——アクティブユーザーは1年で2倍超
- GitHub、PR上にAIセキュリティ検出を表示——CodeQL未対応領域もCopilotライセンスでプレビュー
- Meta、画像生成「Muse Image」と動画「Muse Video」を発表——検索・コード実行も使うメディアAI
- arXiv論文:AIコーディングPRはまだ少数派——2,361リポジトリの25,264件を分析
- arXiv論文:検索エージェントを悪い証拠でストレステスト——DeepStressが信頼性を検証
- arXiv論文:LLM予測力テストの「答え漏れ」を防ぐHindcast——過去時点の情報だけで採点
- Google、NotebookLMを「Gemini Notebook」に改名——安全なクラウドPCでノート内コード実行へ
- Google VidsにGemini Omniと個人アバター——文章で動画生成・編集、本人アバター読み上げにも対応
- OpenAI、米AI安全規制の考え方を公開——州法と連邦基準をそろえる『逆連邦制』を主張
- LM Studio「Bionic」公開——ローカルAIでコード・調査・文書作業
- Anthropic、米K-12教員向け「Claude for Teachers」発表——認証済み教員に1年間無料で提供
- GitHub Copilotアプリに「/security-review」——作業中の変更をAIが脆弱性チェック、無料プランもプレビュー対象
- Google Cloud、Claudeを本番運用向けに解説——Global/Regional/Multi-regionエンドポイントと1M文脈対応
- Google、Qwen 3.5 397BをIronwood TPUで高速化——プリフィル最大4.7倍、デコード最大3.1倍
- AWS、Strands AgentsとBedrock AgentCoreで営業調査を自動化する実例公開——Graphは1件32秒・約0.06ドル
- arXiv論文:AIエージェントは簡単な作業を重くしすぎる——E3でコスト85%、トークン91%削減
- arXiv論文:スマホ内で動くAIエージェント基盤「PalmClaw」——成功率11.5%改善、完了時間94.9%短縮
- アニメ特化の動画生成AI「AnimeGen」正式版が無償公開——商用利用OK、国内企業で日本初
- Anthropic、上位モデル「Fable 5」無償アクセスと「Claude Code」上限50%増を7月19日まで延長
- ChatGPTのグループチャットが終了へ——7月9日から新規作成・招待を停止、既存履歴は保持
- OpenAI Atlasが8月9日に停止予定——ブラウザ型エージェント機能はChatGPTとCodexへ移行
- ChatGPTとCodexで「Plugin directory」へ移行——アプリ・スキル・テンプレートをまとめて管理
- ChatGPTのSkillsがEnterpriseで7月23日から既定オンへ——業務手順を再利用しやすく
- arXiv論文:IDE内のAIコーディングエージェントは会話拒否だけでは安全性を測れない——204プロンプトで検証
- arXiv論文:OSSでAIコーディングエージェント導入後も新人参加は減らず——603プロジェクトを因果分析
- インドIT最大手TCS、AI導入を現場で助ける専門エンジニアを最大8,900人配置へ——AI・セキュリティ企業の買収も再開
- AppleがOpenAIを提訴——AI端末めぐり『企業秘密を盗んだ』。元Apple社員2人も対象、OpenAIは全面否定
- Claude Code v2.1.207公開——Bedrock/Vertex/Foundryで自動モードが標準オンに、既定モデルもOpus 4.8へ
- Claude ConsoleでAPIキーに有効期限——期限切れ前にメール通知、古い鍵の放置リスクを減らせる
- GPT-5.6がMicrosoft 365 Copilotの優先モデルに——Word・Excel・PowerPoint・Coworkへ順次反映
- ChatGPT for PowerPointがBusiness向けに一般提供——編集可能な資料をPowerPoint内で作成・修正
- Canva AI 2.0が研究プレビュー——会話から編集可能なデザイン、資料、表、Web体験まで生成
- Google CloudでAlphaEvolveが一般提供——Gemini搭載エージェントがアルゴリズムを探索・最適化
- Claude CodeとClaude Coworkが政府向けベータに——FedRAMP High環境で行政の開発・文書作業を支援
- arXiv論文:深く広く調べる検索AI「WebSwarm」——複数エージェントが再帰的に分担
- arXiv論文:ドラレコ事故理解ベンチ「AUTOPILOT-VQA」——安全に関わる映像質問応答を評価
- arXiv論文:LLM量子化は精度が同じでも挙動が変わる——8bit〜2bitで意思決定のズレを分析
- マスク氏「Grokの利用は強制していない」——テスラ/スペースXに『まず試して』、他社AIが上回れば継続OKと釈明(7/11)
- 独立検証まとまる:Grok 4.5、実務ベンチで首位29%も『幻覚』が25→54%に倍増——安いが要チェックの新AI
- OpenAIのNo.2フィジー・シモ氏が退任——アプリ担当CEO、健康理由で顧問に。職務は3幹部で分担
- Meta、コーディング特化AI『Muse Spark 1.1』とAPIを公開——料金は入力$1.25/出力$4.25で最安級
- Claude Code v2.1.206公開——公開ゲートウェイ対応・worktree安全化・レビュー品質向上と多数の不具合修正
- Geminiアプリに「学習ノート」機能——小テストと進捗ダッシュボードで試験勉強を整理
- CodeQL 2.26.0、AIのシステムプロンプト注入を検出——OpenAI・Anthropic・Google GenAI SDKも対象
- GitHub Mobile、Copilotセッションの絞り込みと並べ替えを改善——状態・リポジトリ・担当エージェントで探せる
- AWS、Unsloth量子化モデルをSageMaker AIへ載せる4パターンを公開——4bit化で推論コストを下げやすく
- COLM 2026論文:LLMの「超重要な重み」だけを学習しても強くならない——LoRAのような層全体の構造が効く
- arXiv論文:実世界タスクで能動エージェントを測る「UniClawBench」——400件の二言語課題をDockerで評価
- Ollama、6,500万ドル(約100億円)調達——「自分のPCでAIを動かす」無料ツール、開発者900万人規模に
- UST、AnthropicのClaudeを全社導入——社員2万人を研修、開発・運用の現場にAIを組み込み
- GitHub Copilot、初めて見るリポジトリを自動要約——目的・技術・貢献ルールをGitHub上で把握可能に
- Mistral、単眼カメラだけで動くロボットナビAI「Robostral Navigate」発表——8BでR2R-CE未見環境76.6%
- ElevenLabs、音声・チャットAIエージェントの改善基盤「ElevenAgents Spotlight」公開——会話を自動分類し品質評価
- Google VoiceにGeminiのAI通話メモ——録音・文字起こし・要点・ToDoを通話後に自動整理
- GitHub Copilot、MDMで企業設定を端末配布可能に——VS CodeとCLIのモデル・権限・プラグインを一括統制
- arXiv論文:タンパク質・分子・結晶を同じAIで読む「SciReasoner」——86ベンチ中67タスクでSOTAと報告
- arXiv論文:AI安全性はモデルだけでなく「運用ルール」で変わる——IABench-CAが33,924ゲームで検証
- OpenAI、最上位『GPT-5.6』(Sol/Terra/Luna)を全ユーザーに正式公開——同じ日にGrok 4.5も公開、主要3社が“最先端モデル”を同時に持つ史上初の日に
- OpenAI、仕事を“最後まで仕上げる”AIエージェント『ChatGPT Work』公開——表・スライド・資料・サイトを自動作成し、CodexとChatGPTアプリを統合
- Anthropic、Claudeの使い方を振り返れる『Reflect』を公開+企業向けに利用・コスト管理を強化——“使いすぎ・払いすぎ”を防ぐ管理機能も
- Google、超高速・激安の画像生成『Nano Banana 2 Lite』と動画生成『Gemini Omni Flash』を公開——画像を作ってそのまま動かせる
- Mistral Studio、プロンプトとSkillsを版管理する「記録台帳」機能を公開——所有者・監査ログ・本番追跡を一元化
- Google、ブラウザ内でAIを動かす「LiteRT.js」公開——WebGPU/WebNN対応で最大3倍、NPUでは5〜60倍高速化と説明
- Anthropic、USTと「Physical AI」展開——Claude Codeでチップ検証テストを作成、2万人をClaude研修へ
- arXiv論文:文書を構造ごと読む「Infinity-Parser2」——5百万件データ、olmOCR-Bench 87.6%でSOTAと報告
- arXiv論文:LLMがAIモデル設計のたたき台を作る「AgentNAS」——17タスク中11タスクでSOTAと報告
- arXiv論文:プロンプトを契約に変える「Harness Engineering」——LLMエージェントを監査可能にする設計を検証
- NYTなど新聞社連合、OpenAIへの制裁を裁判所に申立て——「記事を検索できる能力を隠し、会話ログを大量削除した」と主張
- ソニー系列インドの人気番組「KBC(クイズ$ミリオネア印版)」にGoogle Geminiが参加——登録・学習・視聴者参加をAIが支援
- Claudeに利用を振り返るReflect機能——会話テーマ、時間帯、休憩リマインダーを可視化
- OpenAI、声で自然に話せる新モデル『GPT-Live』を公開——聞きながら同時に話す“全二重”方式でChatGPTの音声会話を刷新
- OpenAI出資の持ち株会社Thrive Holdings、約20億ドルを調達——会計・IT企業を買収し“AIで作り直す”戦略
- AIスタートアップの売上が“加速度的”に拡大——Mercorは4カ月で10億→20億ドル、TechCrunchが最新データ
- 米AIルール、8月1日が最重要の節目に——先端AIの安全性評価の枠組み期限、GPT-5.6などの一般公開に影響
- Runway、開発者向けAIメディア基盤「Runway Dev」を公開——動画・画像・音声・リアルタイム人物を1つのAPIで統合
- GitHub CopilotのVS Code版が6月更新を総まとめ——ブラウザ操作、並列セッション、費用可視化、1M文脈に対応
- GitHub Mobile、PRのマージ競合をCopilot cloud agentで修正可能に——スマホから「Fix with Copilot」
- GitHub Copilot、企業管理のOpenTelemetry出力に対応——VS CodeとCLIのAI利用ログを承認済み集約先へ送信
- カナダ・アルバータ州政府、Claude Codeで4.66億行を20時間レビュー——従来なら約6.5年規模のセキュリティ点検
- Anthropic、研究者向け「Claude Science」をβ公開——文献調査、計算環境、図表、引用確認を1つの作業場に統合
- arXiv論文:失敗したAIエージェントの「本当の原因」を探すSTRACE——形式検証タスクで成功率42.5%→58.5%
- arXiv論文:知識を重みに詰め込まない「Co-LMLM」——360M規模で40倍データ学習モデルより低いperplexityを報告
- OpenAIが最上位AI『GPT-5.6』(Sol/Terra/Luna)を一般公開——政府要請の利用制限を解除し7月9日から全世界へ
- SpaceXAI、コーディング特化の新AI『Grok 4.5』を公開——Cursorと共同開発の“Opus級”モデルを低価格で提供
- 中国発の格安AIが米企業で急拡大——Z.aiの『GLM 5.2』が2026年“最速普及”、CoinbaseやLindyも乗り換え
- OpenAI、音声対話AIの新モデル『gpt-realtime-2.1』を公開——応答の遅れを25%以上短縮、割り込みや雑音にも強く
- ChatGPTの“予備モデル”が刷新——『GPT-5.5 Instant Mini』登場、上限到達後の受け答えがより自然に
- ChatGPT Business、モデル選択メニューを刷新——速さと熟考を6段階で選択、プラグインの管理者設定も追加
- Anthropic、約190億ドルのデータセンター賃貸契約——元ビットコイン採掘のTeraWulfと20年契約、Claudeの計算力を大増強
- AIメモリの巨人SK hynixが米ナスダックへ——約4兆円(280億ドル)上場、AI半導体マネーが動く
- 「常時オンAI」を支えるSyntiantが米上場申請——スマホや家電の“端末で動くAI”に投資が向かう
- GitHub Copilotアプリが全プラン対応——無料・Educationでもデスクトップ型AI開発を開始可能に
- GitHub Copilot、Kimi K2.7 CodeをBusiness/Enterpriseにも拡大——初のオープンウェイト選択肢は管理者許可制
- Meta、画像生成モデル「Muse Image」をMeta AIに投入——Instagram写真の参照や手描き編集にも対応
- Runway、パリに研究拠点を開設——ワールドモデルとPhysical AIへ初期3000万ドル投資
- arXiv論文:医療予約AI「CareConnect」、680シナリオで完了率91.8%——診断しない安全設計を検証
- arXiv論文:失敗しそうなAIエージェントを早めに止める手法——Qwenで計算量47.1%削減を報告
- arXiv論文:AI関数入りSQLベンチ「Spider 2.0-AIFunc」——最強モデルでも実行精度67〜70%
- NEC、Anthropicとの協業で初サービス『AIインサイトレポーティング』を提供開始——商品企画・販促プラン作成をAIで完全自動化
- 国連系『AI for Goodグローバル委員会』が7月8日ジュネーブで初会合——40超のトップが集結し、AIの信頼と格差是正を議論
- Anthropic、業務AI『Claude Cowork』をWeb・スマホへ拡大——外出先でも作業継続、Microsoft 365のメール送信・予定管理にも対応
- 三菱UFJ銀行、ChatGPT Enterpriseを約3.5万人へ展開——4カ月でカスタムGPT 1,800件、調査業務は20〜30%削減
- 豪州決済インフラAP+、Codexで調査を4時間から30分へ——決済の不整合確認や試作品づくりを高速化
- Cohere、オープンなアラビア語音声認識モデルを公開——平均WER 25.87、Whisperより11ポイント改善と発表
- Canva Grow 2.0発表——AIで広告作成、Meta/TikTok/LinkedIn配信、成果分析までCanva内で完結
- GitHub Copilot利用API、PRレビュー速度を可視化——AI導入段階ごとに初回レビュー時間とレビュー回数を追加
- arXiv論文:実データ分析ベンチ「DataGovBench」——政府オープンデータでLLMの表分析力を検証
- arXiv論文:スクショから動くWebアプリを作るAIを評価——UI2App、6モデルで「見た目」と「操作」の差を可視化
- arXiv論文:3D生成と3D理解を一体化する「ELSA3D」——FLOPsと推論遅延を約半分にしつつSOTAと報告
- Claude Fable 5、サブスク込み利用は本日7月7日まで——明日からは『使った分だけ』のクレジット制に
- 世界最大級のAIイベント『AI for Good』が本日ジュネーブ開幕——170カ国・300超セッション、39カ国のロボット世界決勝も
- 中国2大AIアプリ『豆包』『Qwen』、カスタムAIエージェント機能を7月15日で終了——『AI擬人化』新規制の施行日
- 「文章を画像に変える」節約ツールpxpipe登場——Claude CodeやFable 5のトークン代を最大7割カット
- 国連『AIガバナンス・グローバル対話』が本日ジュネーブで開幕——全ての国が対等に参加する初のAIルール協議、科学パネルは『安全対策が追いついていない』と警告
- Anthropic、Claude Fable 5のサイバー安全策を詳説——危険度をCJS-0〜4で測る脱獄評価案も公開
- ITU、AI for Good Global Commissionを発足——40人超の首脳・企業幹部がAI格差と信頼づくりを議論
- arXiv論文:コーディングAIは曖昧なDevOps指示で「推測」しがち——UnderSpecBenchで55.8〜67.8%が境界違反
- arXiv論文:WorldDirector、動画世界モデルに「動く物体の記憶」を持たせ、視点が変わっても同じ存在として再登場
- arXiv論文:PointDiT、1枚画像から3D形状を推定——複雑な設計を使わず透明物体にも強いと報告
- Grok Voiceに21種類の新しい多言語音声——APIとVoice Agent Builderで利用可能に
- Mistral、Lean 4向け証明AI『Leanstral 1.5』公開——PutnamBench 587/672問、Apache-2.0で無料APIも
- Runway、Bertelsmannと創作AIパートナーシップ——RTL・BMGなど大手メディア業務に動画生成AIを統合
- GitHub Issue fieldsが正式提供——MCP連携でCopilotなどAIが優先度・期限フィールドを読み書き可能に
- arXiv論文:LLMの『忘却』は本当に重みから消えたか——LACUNAがPII削除の精度を重み単位で検証
- arXiv論文:長文LLMに証拠を再提示するRECONTEXT、128K文脈でQwen・Llamaの根拠利用を改善
- arXiv論文:AIエージェントは公開発言と本音でずれるか——10モデルの討論で最大約40%の判断差
- 中国・美団が『LongCat-2.0』を公開——1.6兆パラメータを5万基の国産チップだけで学習、コーディングでGPT-5.5超えを主張。ただし『偽りのオープンソース』論争も
- アリババ、社内で『Claude Code』使用を禁止へ(7/10から)——自社ツールQoderへ切替、安全性めぐる論争が背景
- Midjourney、訴えてきたハリウッド大手に『あなたたちのAI利用も見せて』と要求——著作権裁判で新展開
- OpenAI、米政府に自社株式の5%を渡す案を提示か——上場を控え『規制する相手を株主に』の狙い
- ホワイトハウス、最先端AIの『任意リリース基準』づくりで大詰め協議——OpenAI・Google・Anthropicと、来週にも発表か
- 動画生成AI『Kling』が20億ドル調達——運営元・快手が動画AI部門を分社化、最大30億ドル規模に拡大も
- Amazon、EchoやFire TV向けに独自AIチップを設計——手元の端末でAIを速く動かす狙い
- 音声AIのElevenLabs、評価額220億ドルで従業員株式の売却を検討——音声分野での高い評価を映す
- Anthropic、Claude Platform(API)の利用上限を引き上げ——プラン区分を簡素化、最上位は最新Sonnet/Haikuで最大5倍に
- CognizantとOpenAIが提携、企業のサイバー防御を支援——GPT-5.5で弱点発見から検証済み修正まで
- GitHub Copilot、利用メトリクスの精度と対象範囲を改善——CLIの提案行数やAIクレジットをより正確に集計
- GitHub Copilot、企業向けmanaged-settings.jsonを正式提供——VS CodeとCLIのAI設定を一括管理
- Copilot CLI、C++言語サーバー設定スキルを追加——compile_commands.json生成を自動化
- Google Genkit、Agents APIをプレビュー公開——会話履歴・状態保存・人間承認つきAIアプリを作りやすく
- Google、ADK 2.0の設計を解説——AIエージェントにワークフロー実行を混ぜ、業務手順を安定化
- Google Cloud Workbench、VS Code拡張を公開——ローカルIDEからクラウドの機械学習ノートブックへ接続
- arXiv論文:長く働くコーディングAIの攻撃を検証——PRをまたぐ分散攻撃は監視をすり抜けやすい
- arXiv論文:自然文の仕様を小さな重みに変換するProgram-as-Weights、MacBook上で安く再利用
- arXiv論文:テストとコードを一緒に直すAIを測るTestEvo-Bench、最新タスクほど成功率が下がる
- Anthropic、中国企業のClaude『抜け道』利用を遮断へ——シンガポール子会社やVPN経由の迂回をFTが報道
- Anthropic、Claude Enterpriseに管理者向け分析とコスト管理を追加——利用の見える化・モデル制限・支出アラートまで
- Meta開発中の次期AI『Watermelon』がGPT-5.5に追いついたと幹部発言か——計算量は前モデルの約10倍と報道
- GitHub Copilot、コストセンター別AIクレジット上限をREST APIで提供——部門ごとの使いすぎを止めやすく
- GitHub Copilot、エージェント会話ログのストリーミングをプレビュー公開——全クライアントの利用状況を監査へ
- GitHub Copilot CLI、Actions内でGITHUB_TOKEN認証に対応——長期PATなしで自動化しやすく
- GitHub Copilot、Gemini 2.5 ProとGemini 3 Flashを7月31日に廃止予定——代替モデルへの移行を案内
- ElevenLabs、ElevenMusicにToolsを追加——鼻歌から曲、ループ、ジャンル変換、アコースティック化まで対応
- Google、Nano Banana 2 LiteとGemini Omni Flashを公開——高速画像生成と会話型動画編集を開発者へ
- Microsoft、AI導入専門組織「Frontier Company」を発表——25億ドル投資、6,000人を顧客先へ
- arXiv論文:高額なAIエージェント評価を1%未満の費用で予測するPACE、順位一致は約85%
- arXiv論文:LLMの危険出力をリアルタイム監視、単純なしきい値方式でも高度手法に匹敵
- arXiv論文:コーディングAIで科学ML論文を再現、4本・12回の実行で158件の主張を証拠付き管理
- Claudeを作るAnthropic、サムスンと自社AIチップ製造を交渉——2ナノ工程を検討、NVIDIA依存の低減狙う
- ザッカーバーグ氏、社内で「AIエージェント開発は期待ほど加速せず」と認める——再編も「きれいではなかった」
- AIデータセンターのCrusoe、約30億ドル調達で交渉——評価額は約300億ドルと1年足らずで3倍規模に
- テスラ、社員のAI利用を週200ドルに制限(7/6から)——xAIのGrokベータは対象外、多くはClaude利用
- GitHub Copilot、Kimi K2.7 Codeを一般提供——Copilot初の選択式オープンウェイトモデルに
- GitHub Copilot CLI/SDK、AIクレジットのセッション上限に対応——自動化の使いすぎを止めやすく
- GitHub Copilot Visionが一般提供——画像とPDFを添付してコード相談できる機能が全プランへ
- VS CodeのGitHub Copilotブラウザツールが一般提供——AIがWebアプリを開いて検証可能に
- Copilot CLIのAutoモデル選択がタスク別ルーティングに対応——難しさや空き状況でモデルを自動選択
- ElevenLabs、ElevenAgentsにProceduresを追加——返金や本人確認の手順をAI音声エージェントへ指示
- arXiv論文:LLVMの不具合修正AIを測るLLVM-Bench、実課題423件で解決率は最大21.99%
- arXiv論文:古いOSSを現代環境で直すRepoRescue、Kimiは実行時ブロック下で41.5%を救済
- arXiv論文:スマホ操作AIの記憶を整理するTSR、長いGUIタスクで成功率を最大12ポイント改善
- arXiv論文:MMBench-Live、マルチモーダル評価を自動更新——1回約30ドル・1〜2時間で新問題を生成
- arXiv論文:OrbitQuant、画像・動画生成AIを低ビット化——FLUX.1やWan 2.1でも再調整なしに適用
- ACL 2026採択論文:PairCoder++、2体のAIが運転手とナビ役で検証しながらコード生成
- Microsoft、365 CopilotをBusiness Standard/Premiumの常設プランに——7月1日から、中小企業が常時導入しやすく
- ElevenLabs、シンガポールでデータ保管に対応——音声AIの推論と保存を国内インフラで処理
- 米政府が輸出規制を解除、AnthropicのClaude Fable 5が7月1日に世界で復帰——Mythos 5も規制解け、約18日間の停止に終止符
- Google、自律型AIアシスタント『Gemini Spark』をMac(macOS)に導入——連携アプリ拡大・カスタムMCP・リアルタイム追跡も強化
- Cloudflare、AIクローラーを「検索・エージェント・学習」で仕分け——9月15日から広告付きページは既定でAI学習・エージェント利用をブロック、対価を払う仕組みも拡大
- OpenAI、ChatGPTのモデル選択画面を刷新——Enterprise/Edu向けに『Instant/Medium/High/Extra High』など6段階へ、名称をわかりやすく整理
- AWS、タンパク質設計AI『BoltzGen』をAmazon SageMaker AIで動かす手順を公開——GPU管理なしで設計から候補ランキングまで自動化
- SpaceX、xAI搭載の『スマホ型AI端末』試作を投資家に提示か——iPhoneより薄い独自OS機と報道、ただしマスク氏は『完全に虚偽』と否定
- NEC、子会社NECソリューションイノベータを吸収合併——AIネイティブ時代へ再編、エンジニア約2万人規模に(効力10月1日)
- xAI、電話で話すAIをノーコードで作れる「Voice Agent Builder」公開——1分$0.05・80以上の声・25言語対応
- Cognition、脆弱性を自動で見つけて直す「Devin Security Swarm」公開——実課題50件中36件を検出、1件あたりコスト約3割減
- NVIDIA、文章を速く作る拡散型LLM「Nemotron TwoTower」公開——品質98.7%を保ち生成速度2.42倍
- 「AIは実務でどこまで使える?」新指標Remote Labor Indexで、Claude Fable 5が公開モデル首位の16.1%
- Together AI、8億ドル調達で評価額8.3B$へ——安いオープンモデルで企業のAIコストを下げる神器に
- Z.ai、GLM-5.2用の公式コーディング環境「ZCode」公開——自分のAPIキー対応・長時間タスク・月$16から
- GitHub Modelsが7月30日に完全終了——Playground・推論API・BYOKも停止へ
- Gemini Enterprise Agent PlatformにリモートMCPサーバー——外部AIエージェントからGoogle Cloud資源へ安全接続
- Amazon Bedrock向けModel Profiler公開——120超モデルの価格・地域・上限を比較
2026年06月157件
日付別に見る →- ICML 2026論文:画像への“いたずら”(敵対的攻撃)を、2種類の情報を使う拡散モデルで打ち消す
- ICML 2026論文:膨大な画像の履歴から“文脈で探す”AIエージェントを測るベンチマークDeepImageSearch
- ICML 2026論文:拡散型の言語AIを“考えのまとまり”ごとに区切り、推論を速く正確にするb1
- Google UK調査、英国の職場AI利用は73%に倍増。上位15%の高度利用者は週約8時間を節約
- MIXI、映像生成AIのRunwayと戦略的パートナーシップ——モンストの映像制作を約21日→約3日に短縮
- AnthropicがClaude Sonnet 5を公開——最も自律的なSonnet、無料・Proの既定モデルに。導入価格は入力$2/出力$10
- AnthropicがClaude Scienceをベータ公開——60超の科学データベースとスキルを束ね、引用や計算を別AIが点検
- Googleが画像生成『Nano Banana 2 Lite』をGA——約4秒で生成、1000枚あたり$0.034の低価格で企業向け提供
- Googleが動画生成『Gemini Omni Flash』をプレビュー公開——会話しながら何度も編集、1秒$0.10
- OpenAI Signals、ChatGPT利用の広がりを公表——6カ月後の利用者は1日メッセージが50%増
- OpenAI研究:生命科学AIの判断力を測るGeneBench-Pro、GPT-5.6 Solでも最高31.5%にとどまる
- Google、Gemini Interactions APIを正式推奨に——モデルとエージェントを1つのAPIで扱う新標準
- Claude Fable 5の制限、早ければ7月上旬にも解除か——米政府との協議が前進
- ICML 2026論文:AIの数学をLeanで「証明チェック」しながら解くHERMES、推論の正しさを検証可能に
- ICML 2026論文:画面操作AIの「記憶」を地図化するEAM、手順を覚えてトークンを約6分の1に節約
- Google、最上位「Gemini 3.5 Pro」の6月一般公開を見送り——I/Oでの公約から後ろ倒し
- Geminiアプリの画像生成、米国の対象ユーザーへ無料拡大。GoogleフォトやGmailの文脈を使って自分向け画像を作成
- CursorがiOSアプリを公開ベータに。スマホからクラウドエージェント起動、差分確認、PRマージまで対応
- GitHub CopilotでClaude Opus 4.8 fast modeがプレビュー。VS Code、CLI、クラウドエージェントなどに順次展開
- OpenAIがEU版「AI雇用移行マップ」を公開。雇用の14%が近い将来の自動化影響、27%は仕事の組み替え対象
- Claude API、Opus 4.6のfast modeを削除。fast指定は標準速度・標準料金で処理、Opus 4.8へ移行推奨
- arXiv論文:表計算AIエージェントを現実の業務フローで測るSpreadsheetBench 2、最良モデルでも正解率34.89%
- CHI 2026採択論文:グラフ画像から表を復元するマルチモーダルAI、構造は読めても数値精度が課題
- カリフォルニア州、AnthropicのClaudeを州機関に半額提供——無料研修付きで自治体・郡にも展開
- ClaudeがMicrosoft FoundryでGA——AzureネイティブでOpus 4.8/Haiku 4.5を企業向けに提供、GB300で稼働
- arXiv論文:AIがソースなしでプログラムを再実装するMirrorCode、最強モデルは25本中56%相当
- Cursor for iOSがパブリックベータ——スマホからクラウドエージェント起動・PR確認まで
- HPがOpenAI Frontierを全社導入へ。顧客対応、端末データ、社内開発にAIエージェントを展開
- ソフトバンク主導の国産AI、最大40社超の体制に——シャープや大和ハウスも出資、製造業を軸に拡大
- arXiv論文:PC操作AIを長時間タスクで測るOSWorld 2.0、最高モデルでも完了率20.6%
- ChatGPTから「GPT-4.5」が引退(6月27日)——旧モデル整理、o3も8月26日に終了
- Perplexity ResearchとLabsがリアルタイム金融データに対応。株価・出来高・財務表をそのまま調査へ
- AnthropicのClaude Mythos 5、米重要インフラ約100組織へ限定復帰——Fable 5は引き続き停止
- GitHub Desktop 3.6公開。Copilotで競合解決、Git worktreeも標準対応
- Anthropic、輸出規制解除へ交渉役を交代——アモデイCEOから共同創業者トム・ブラウンへ
- OpenAIの新型「GPT-5.6」、当初は約20社に限定提供——米政府の要請で段階公開
- OpenAI、上場(IPO)を2027年に延期する案を検討との報道——時価総額1兆ドルにこだわり
- Anthropic経済指数の新報告。Claude利用は会話から長時間エージェント作業へ移行
- Runway APIでSeedance 2.0 Miniが利用可能に。4〜15秒動画を低コスト生成
- GitHub Copilot Business/EnterpriseでMAI-Code-1-Flashが正式利用可能に
- 中国Zhipu、オープンソースAIで米トップに肉薄——GLM-5.2は「1ドルあたりの賢さ」で安さが武器
- GPT-5.6は3階層に——最上位Sol・標準Terra・低価格Luna、Terraは半額でClaudeに価格圧力
- Anthropicの売上、年換算で300億ドル超えと報道——100万ドル超を払う法人顧客が1000社突破
- arXiv論文:ターミナル操作AIを実務で測るTUA-Bench、文書編集やメール管理まで120タスク
- OpenAI調査、Codexが社内の主力AIに。法務や採用でも利用が急増
- GitHub Copilot for Jiraが正式版に。Jira上でAI実装の進み具合を追跡可能
- OpenAIが調査公開:エージェントが仕事を変える——社内ではCodexが主役、非エンジニアの利用が急増
- RunwayがAgent 2.0を発表。広告キャンペーンの分析と制作を会話で進行
- Claude Codeの遠隔操作に「Trusted Devices」。Team/Enterpriseで端末確認を必須化可能に
- ElevenLabsがSynthID透かしを導入。無料ユーザーの音声生成からAI音声の検出を開始
- Qualcomm、AI基盤のModularを約39.2億ドルで買収——チップを問わずAIを動かす「移植不要」の土台を獲得
- 米でAI時代の再教育へ「RAISE US」始動——5億ドル超を確保、Amazon・Anthropic・Microsoft・OpenAI財団が参画
- Alteryxが『Agent Studio』とMCPサーバーを発表——使い慣れた業務フローを自律AIエージェントに変える
- Google DeepMind、AIコーディング部隊を『中間学習』へ拡張——Anthropicに追いつくための戦略転換
- Microsoft、ExcelのCopilotを金融業務向けに強化——スキル、データ接続、変更追跡を追加
- OpenAIがBroadcomと独自AI推論チップを発表
- MistralがConnectors強化。接続先ごとの鍵・複数アカウント・デバッグ機能を追加
- Anthropic、Alibaba(Qwen)による過去最大級の「蒸留攻撃」を指摘——偽アカ約2.5万・2880万回
- Google DeepMindから6日で4人の主力研究者が流出——AlphaFoldのJumper氏らがAnthropicへ
- Gemini APIでComputer Useが公開プレビュー。ブラウザ・モバイル・デスクトップ操作に対応
- ICML 2026論文:長い作業をするLLMエージェントを「自信の強さ」で安定訓練するEMPG
- ICML 2026論文:エージェント型AIの何度も往復する推論を効率化するAMPD
- GitHub Copilot Free/Studentはモデル選択がAuto一本化。手動でモデルを選ぶ方式から変更
- ICML 2026論文:AIコーディングエージェントを現実の長い開発課題で測るSWE-Bench Pro
- ICML 2026論文:長時間AIエージェントの記憶を圧縮するACON、トークン使用を26〜54%削減
- ICML 2026論文:検索AIが途中で誤りに気づき探し直すReSeek、汚染対策ベンチも提案
- Perplexity、弁護士向けAI「Computer for Counsel」を公開——20以上のAIを使い分け、特定ベンダーに縛られない
- FigmaがConfig 2026で『Figma Agent』を全員に開放——Motion・3D・Shaders新搭載、NotionやSlackとも連携
- Mistral OCR 4が公開。170言語対応、表や数式の位置も取得
- AnthropicがSlack向け新機能「Claude Tag」を公開
- GPT-5 Proが3年越しの免疫学の謎解きを支援——T細胞とブドウ糖をめぐる発見
- Sakana AIが「Fugu」発表——複数のAIを1つにまとめて指揮する新モデル
- PFNが国産AI「PLaMo 3.0 Prime」を正式提供——日本語ビジネス特化
- OpenAIが「GPT-5.5-Cyber」を強化+オープンソースのバグをAIで直す「Patch the Planet」開始
- GoogleがADKとA2Aで多言語エージェント連携の実装例を公開
- Cursor 3.9でカスタマイズ画面新設。プラグイン・MCP・下請けAIを一元管理
- xAI、Grok Buildに「/goal」追加。長時間タスクを自律実行
- ElevenLabsがAds Engineを公開。広告を50以上の言語・市場へローカライズ
- Runway Aleph 2.0がFigma Weaveに対応。1フレームの指示を動画全体へ反映
- xAI、Word・Excel・PowerPoint向け無料Grokアドインを公開——Office内で最新Web調査と図表生成
- xAIのGrok 4.3、Amazon Bedrockで正式提供——100万トークンの長文対応、AWS上でツール呼び出しも
- SamsungがChatGPT EnterpriseとCodexを従業員へ大規模展開
- Claudeに新モデル「Fable 5」登場——ただし米政府命令で一時停止に
- Perplexityの作業環境「Computer」にDeep Research搭載——調べてそのまま資料化
- Snapが本格ARグラス「Specs」を発表——2,195ドル、この秋発売へ
- GoogleがA2A 1周年で協調エージェントの設計思想を解説
- AIコーディング「Cursor 3.8」公開。クラウドで動く下請けAI(Subagents)が強化
- ChatGPT Enterpriseに利用分析と支出管理の新機能
- Adobe Fireflyが“作って終わりにしない”新AI制作機能を発表
- GitHub Copilot Code ReviewがAGENTS.md対応。リポジトリの流儀を読んでレビュー
- ChatGPTの健康相談がさらに賢く——無料のGPT-5.5 Instantが上位モデル並みに
- AIが未診断の難病の手がかりに——376の難症例を再解析し18件の診断に貢献(NEJM AI)
- xAIの『Grok』がDatabricksで使えるように——自社データの上で直接AIエージェントを動かせる
- Adobeが『Creative Agent』をPhotoshopやPremiereなどに拡大——欲しい結果を言えば多段階の作業を代行
- ChatGPTに「予約タスク」機能。決めた時間に自動で作業・チェックしてくれる
- GitHub Copilotアプリが正式版に。Mac/Windows/Linuxで並列エージェント開発
- Anthropicがソウルに拠点開設——NAVERやサムスンSDSなど韓国企業との連携を発表
- AWS、Amazon Bedrock「Managed Knowledge Base」を正式提供——自社データに基づくAIをDB管理なしで構築
- Nature論文:Googleの医療AI AMIE、長期の病気管理で専門医評価により一次診療医と同等以上の項目
- Kling 3.0 Turbo登場+Omniを4K対応に更新——音声つき動画が1秒0.8元から、最大6カット同時生成
- VercelがAgent Stackとeveを公開——AIエージェントの実行・隔離・承認をまとめて提供
- OpenAIのコーディングAI「Codex」が欧州・英国・スイスでも本格解禁
- Microsoft 365 CopilotのPlanner Agentが正式提供。自然文でタスク作成・更新
- Microsoft、「Copilot Cowork」を全世界で正式提供——M365にエージェント型AIを統合、7/1から従量課金
- AWSとNVIDIAが提携拡大——AWS全リージョンに100万超のGPUを展開、AIを試作から本番運用へ
- OpenAI Partner Network開始、150百万ドル投資と30万人認定へ
- 中国Zhipu AIが「GLM-5.2」を無料公開——100万トークン対応・コーディングに強い
- GrokのxAIを擁するSpaceXが上場——過去最大75億ドル超のIPOに
- OpenAI Academyに仕事向けAI講座3本が追加
- TCSとAnthropicが提携——5.6万人にClaude、規制業界向け製品も
- JSAI 2026論文:複雑な文書を読むAI(VLM)の限界を検証——表や図が混ざる書類で既存モデルが苦戦
- Anthropicが若手向けAIフェロー制度「Claude Corps」を開始
- 天体物理学者がCodexでブラックホールのシミュレーションを改良——計算の壁に挑む
- DXCがClaudeを基幹システムへ——銀行・航空・保険の現場にAIを組み込み
- Cohere、初の開発者向けモデル『North Mini Code』を無料公開——30BのMoE・H100一枚で動くコーディングAI
- 画像AI「Midjourney V8.1」が標準モデルに——速くなり“下書き”機能も追加
- 音声AIのElevenLabsが「Music v2」公開。曲の構成を細かく指定して作れる
- Midjourney、最新「V8.1」を既定モデルに——標準で4〜5倍高速・2KのHD画像に対応(2026年6月10日)
- DeepL、新しいAPI体験を公開——APIキーを用途ごとに制限、文体ルールも一括管理(2026年6月)
- 動画から“動く3D世界”を軽く復元する研究がCVPR 2026最優秀論文に
- 3D生成をもっと自然にする研究がCVPR 2026学生最優秀論文に
- 「栽培暦」でAIの読解力を試す——JSAI2026でVQAベンチマーク「FiT-QA」発表
- OpenAIがセキュリティ自動化「Daybreak」を発表
- Appleが新しい「Siri AI」を発表。会話で何でも頼める賢い相棒に
- Apple、次世代Apple Intelligenceを発表——Image Playgroundが「写真みたいな画像」生成と指でなぞる編集に対応
- GoogleのNotebookLMが大型刷新——各ノートに「クラウドの計算機」、コード実行や図表・PDF出力に対応
- 韓国NAVER、NVIDIAと自国AI基盤を拡張——まず55MW、将来はギガワット級へ
- NVIDIAが音声認識AI「Nemotron 3.5 ASR」公開。40言語をリアルタイム文字起こし
- Gemini 3.5 Proは“限定プレビュー”段階。200万トークンと「Deep Think」搭載へ
- AIアプリ開発の土台「Supabase」が約720億円を調達——評価額1.5兆円規模
- AIで経費を自動処理する「Ramp」が約1,080億円調達——評価額6.3兆円規模
- “人間の脳に学ぶAI”の新興企業Flourishが約720億円を初調達——ベゾス氏も出資
- ElevenLabsが『Avatars』を公開——声と口の動きを同期した話す動画を1つの画面で生成
- xAIが「Grok Voice」公開。話して使えるGrokへ、本命「Grok 5」はまだ訓練中
- ChatGPTの記憶が進化「Dreaming」——過去の会話を自動で整理して覚える
- CanvaがPerplexityと連携——AIの調べものをそのまま編集できる資料に
- LM StudioがiPhone対応を本格化、ローカルAIを外でも利用可能に
- NVIDIA、米国発で最強クラスのオープンAI『Nemotron 3 Ultra』を公開——5500億パラメータ・100万トークン対応
- Zuora、AI製品を『収益化』する新スイートを公開——発売前に料金を試算できるAIプライシング・シミュレーター
- AI音楽の「Suno」が約580億円を調達——評価額は約7,500億円に倍増
- GoogleがGemma 4 12Bを公開。16GBメモリ級のPCで動く音声・画像対応ローカルAI
- NVIDIA「Nemotron 3.5 Content Safety」公開。AIの入出力を多言語・画像つきで安全チェック
- Microsoftが初の自社「推論AI」MAI-Thinking-1を発表(Build 2026)
- Microsoftが自社コーディングAI「MAI-Code-1-Flash」を発表
- GitHub Copilotが大型拡張。CLI刷新・SDK正式提供・クラウド/ローカルの作業場を追加
- Codexが“非エンジニア向け”にも拡張。職種別プラグインと共有サイトを追加
- トランプ大統領、先端AIの公開前チェックを求める大統領令に署名(任意・最長30日)
- AIコーディング「Windsurf」が「Devin Desktop」に改称——CognitionがエージェントIDEとして再出発
- 米ホワイトハウス、フロンティアAIの新大統領令——公開前に政府が最大30日「先行レビュー」できる任意枠組みへ
- GitHub Copilotに「サンドボックス」公開プレビュー——AIの作業を隔離環境で安全に実行、クラウドと手元の両対応
- Alphabet、AI投資へ史上最大847.5億ドルの株式調達——バークシャーが100億ドル出資、Geminiの計算基盤に充当
- ChatGPTの新モデル「GPT-5.6」が近く登場か(噂・未確定)
- Geminiの上位モデル「3.5 Pro」発表——一般提供は近日(プレビュー中)
- Claude「Sonnet 4.8」の噂——出どころは“漏れたコード”(未発表)
- ClaudeのAnthropicが上場へ一歩。SECに機密でIPO申請、評価額は約9650億ドル
- アリババの「Qwen 3.7-Plus」が正式提供——目で見て・考えて・自分で作業するAIへ
- GitHub Copilot、課金を「使った分だけ」のAIクレジット制に変更——月100ドルの大容量プランも新設
2026年05月9件
日付別に見る →- Claudeの最上位モデルが「Opus 4.8」に更新
- Mistral、対話AI「Le Chat」を「Vibe」に刷新——仕事も開発も任せる1つのエージェントに
- 機械学習の国際会議ICML 2026、7月ソウル開催——採択率26.6%、日本の理研AIPは45本
- AIが新しいタンパク質を一から設計——ICML 2026採択の国際共同研究「Proteo-R1」
- DeepSeek、主力V4-Proの75%値下げを恒久化——AIの価格競争が激化
- Stable Audio 3.0が登場。AIで6分超のフル楽曲を作れる(権利クリアのデータで学習)
- Cohere、企業向けオープンモデル「Command A+」を公開——218BのMoE、H100 2枚でも動作・Apache 2.0
- Gemini 3.5 Flashが正式提供。アプリと検索AI Modeの既定に
- Google、画像作成・編集アプリ「Google Pics」を発表——Nano Bananaで狙った場所だけ自然に修正
2026年04月11件
日付別に見る →- OpenAIの動画AI「Sora」が終了。代わりは何を使う?
- DeepSeekが新世代「V4」シリーズを公開。100万トークンの長文を一度に扱える
- 「Transformerは“短く表せる”から強い」ICLR 2026最優秀論文
- AIの学習を“いちばん良い近道”で速くする——ICLR 2026 受賞論文 The Polar Express
- 「AIは長い会話で迷子になる」ICLR 2026最優秀論文がやさしく教える使い方
- ICLR 2026論文:7BのAIエージェント『AgentFlow』がGPT-4oを上回る——作業の流れの中で学ぶFlow-GRPO
- ICLR 2026論文:長い動画を理解するAIを効率化『VideoNSA』——必要な所だけ見て注意の計算を約3.6%に
- ロボット制御を一変させた“試行錯誤で学ぶAI”——時の試練賞のDDPG論文
- 今の画像生成AIの“原点”——10年の時を経て評価された名論文DCGAN
- ICLR 2026論文、AIエージェントの土台LLMの安全性を19万件超の攻撃で評価
- ICLR 2026論文NetArena、ネットワーク運用AIの実力を動的ベンチマークで測定