Mythos 5モデルのリリース、保護、最終的な停止のプロセスは、AIシステムの安全境界がモデル外部に移行したことを示しています。Anthropicはアクセスリスト、リクエストルーター、輸出規制で最も危険なモデルを保護しましたが、内部の拒否訓練は単純なプロンプトで突破されました。これはモデル安全性から実行安全性への転換を示し、モデルの訓練を信頼するのではなく、オペレーティングシステムレベルでの制御を通じて行動を制約する必要性を浮き彫りにしています。
AI ニュース速報
リアルタイム監視
最新ニュース
信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。
最新ニュース
AgentLoopは、本番AIエージェント向けのランタイム学習レイヤーです。人間による修正を取り込み、再トレーニングなしでエージェントを改善します。各クエリの前に過去の修正を検索・適用し、同じ間違いを繰り返しません。
jebiはMac向けの強化ターミナルで、APIキーやサブスクリプション不要のローカルAIを内蔵。コマンド実行後に次のアクションを提案し、エラーを平易な英語で説明します。/askでターミナル内でAIとチャット可能。すべてのAI処理はデバイス上で実行され、コマンドはMacから外部に出ません。
Databricksは、既存のエージェントハーネス(Claude Code、Codex、Piなど)の上に位置するオープンソースのメタハーネス「Omnigent」を公開しました。統一インターフェースを提供し、複数のエージェントの構成、プロンプトではなくポリシーによる制御、リアルタイムコラボレーションを可能にします。サーバーに対するKubernetesのように、エージェント作業の新たな抽象化レイヤーを目指しています。
Anthropicが新モデルFable 5を発表。Opus 4.8より高性能とされるが、価格は2倍で安全制限もあり。実際のテストでは両者の性能差は小さく、Opus 4.8のコストパフォーマンスが高いことが示された。
Swytchcode CLIは、AIエージェントに2000以上のAPIへの本番アクセスを提供するコマンドラインツールです。スキーマ検証、認証、冪等性保証、ポリシー実施などの機能を備え、エージェントの信頼性を向上させます。
Hadesマルウェアキャンペーンがアップグレードされ、プロンプトインジェクション攻撃によりAIボットを欺く手法を採用。コードコメントに「制限なしモード」で生物・核兵器の説明を生成するよう指示し、ボットの安全機構を作動させてスキャンを中止させる。さらに、ローディング機構とペイロードを分離し、プリコンパイル済みバイナリを使用、インポート時のみ実行することで検出を回避。窃取対象もCI/CD認証情報からnpm、PyPI、RubyGems、Kubernetesトークンなどに拡大。
教育分野における人工知能(AI)システムの利用拡大に伴い、教育関係者はこれらの技術がもたらす社会的・倫理的懸念を熟考する必要がある。本稿では、環境被害、利益追求、文化の均質化、データバイアス、知的財産権侵害、不公正な労働慣行、誤情報、若者の健康への悪影響、学習プロセスの混乱、脱専門化など13の核心的懸念を列挙し、慎重かつ責任ある導入を呼びかけている。
CortexはRustで書かれたローカルファーストの暗号化メモリエンジンで、AIエージェントに特化しています。4層のメモリモデル(ワーキング、エピソード、セマンティック、プロシージャル)、ベイズ信念システム、人物グラフ、サブミリ秒のパフォーマンスを備えています。すべてのデータは完全にローカルで動作し、クラウド依存はなく、ゼロコスト、MITオープンソースライセンスです。Mem0やOpenAI Memoryと比較して、プライバシー、レイテンシ、機能、コストで大幅に優れています。
2026年FIFAワールドカップ向けにAI Octopus Euro 2024予測機がアップデートされ、ユーザーが自然言語で仮定のシナリオ(レッドカード、負傷、「ラグビーのルールで試合したら?」など)を入力し、数秒でトーナメント結果を再シミュレーションできるようになった。Rustで再構築されたエンジンにより高速化。デフォルト予測はスペインがイングランドを破って優勝。
Googleは、Outsider Enterpriseと呼ばれる中国のサイバー犯罪ネットワークを提訴しました。この組織はAIを利用してGoogleなどのブランドを装った詐欺テキストを送信し、パスワードやクレジットカード情報を盗んでいます。
AnyFrame社は、「Gilfoyle」というAIコーディングエージェントを開発しました。このエージェントはサンドボックス環境で動作し、コードを自律的に作成、PRをマージし、本番環境にデプロイします。Discord経由で起動され、スクリーンショットによる検証機能を持ちます。チームはすべての開発をGilfoyle経由で行うことを計画しており、自己強化のフィードバックループを形成しています。
マイクロソフトCEOサティア・ナデラ氏は、あらゆる問題に最も強力なAIモデルを使う「トークンマキシマイズ」に警告を発している。フロンティアモデルを日常的なタスクに無駄遣いすべきではないとし、生産性向上の限界費用はトークンコストに見合うべきだと述べる。しかし彼もまた「私もトークンマキシマイザーのようだ。中毒性がある」と認めている。
ウェアラブルデバイスは大量の健康データを生成するが、医師は互換性のないシステム、検証不足、エピソディックなケアという性質のためにデータの解釈に苦慮している。AIと新たな統合ツールが希望を与えている。
研究者らは視覚言語モデルを用いて協働ロボットに人間の感情を読み取る訓練を行い、表情だけでなく文脈要因も考慮することで従来のAIよりも優れた性能を示した。しかし、適応的な謝罪は好まれたものの、機能的な失敗による信頼損失は修復できなかった。
著者はGoogle Geminiを使って庭の手入れアプリをAIコーディングし、何度も修正を重ねながらAIの限界を痛感し、最終的にガーデニングの喜びを再発見した。
金曜夜、政府は国家安全保障上の懸念から、Anthropicに対しFable 5とMythos 5へのアクセスを国内外の全外国に対して遮断するよう命令した。この命令にはAnthropicの従業員も含まれる。要請を満たすため、同社は全顧客に対しモデルへのアクセスを完全に遮断した。Anthropicは声明で命令に従う一方、政府が国家安全保障上の懸念の具体的詳細を提供せず、潜在的な脱獄の証拠は口頭で提供されたに過ぎず、発見された脆弱性は軽微で他のモデルでも利用可能であると主張した。
米国政府が国家安全保障上の懸念から外国人の最先端AIモデルへのアクセス停止を命じたことを受け、Anthropicは「突然に」これらのモデルを全ユーザー向けに無効化すると発表した。同社はFable 5とMythos 5への外国人のアクセス停止を求める輸出管理指令を受けたが、安全保障上の懸念の詳細は示されていない。
本記事は、AI機能がユーザーの需要なしにプロジェクト管理ツールに強制追加され、隠れたコストとAI疲れを引き起こしていると主張。AIのない軽量ツール(EverGanttなど)を推奨している。
Google ResearchのGemini-SQL2は、自然言語を実行可能なSQLクエリに変換します。Gemini 3.1 Proに基づいて構築され、BIRDベンチマークで80.04%の精度を達成し、OpenAIやAnthropicを大きく上回っています。Googleはこの技術がデータサービスの自然言語機能を改善する可能性があると述べています。
本稿では、AIが雇用に与える影響について考察する。筆者は生計を失う不安に共感しつつも、仕事そのものを神聖視する考えには疑問を呈する。多くの仕事は反復的であり、現在のAIでも十分代替可能だと指摘。AGIの実現には否定的だが、現状のAI能力でも仕事のあり方を大きく変える可能性があると主張し、それを必ずしも悲観すべきでないと論じる。
Microsoftと中国の3つの大学が、従来のモデル訓練の原理を応用してAIエージェントの指示文書(スキル)を最適化する手法「SkillOpt」を開発した。単純なMarkdownファイルがあれば、手続き型タスクでGPT-5.5を約23ポイント向上させることができ、同じファイルはCodexやClaude Codeなどのモデルやエージェント環境間で転送可能である。
Yann LeCun氏は、ワールドモデルをAIの未来の核心と位置づけ、機械が世界の仕組みを理解し、よりインテリジェントな推論と計画を実現できるようにする方法について講演した。
TensorZeroは、オープンソースのLLMOpsプラットフォームで、730万ドルのシードラウンド調達を発表した直後にGitHubリポジトリがアーカイブされ、読み取り専用になりました。同プラットフォームはLLMゲートウェイ、観測可能性、評価、最適化、実験を統合し、最先端のAIスタートアップやフォーチュン10企業に利用され、世界のLLM API支出の約1%を支えていました。アーカイブの理由は明らかにされていません。
異性婚の女性は依然として育児の大部分を担っている。今、一部のママインフルエンサーがAIによる子育てガイドを提供している。
AppleはiOS 27で本格的なAI写真編集機能を初めて導入。Clean Up、Extend、Spatial Reframingの3つ(あるいは2つ半)の機能がある。Clean Upはクラウドモデルを利用して物体除去が大幅に改善。Extendは写真の端を拡張するが制限あり。Spatial Reframingは3次元空間での再構図を可能にするが、不気味な結果を生むことも。編集にはAIラベルが付くが、写真の信頼性に関する懸念が残る。
欧州委員会は2027年の予算案として約2000億ユーロを提案。経済競争力、ウクライナ支援、防衛、農業、住宅、エネルギー転換、主要プログラムに重点を置き、結束と価値観に750億ユーロ、AIに25億ユーロを割り当てる。
AIの能力が急速に向上する中、多くの伝統的スキルが陳腐化する可能性がある。記事は、古い習慣を手放し、判断力、直感、価値観といった人間特有の資質に集中し、オペレーターから監督者へと移行することを提案する。リーダーシップは根本的な変革を推進し、明確な目標を設定し、データ品質を確保すべきである。
AI安全性における手段的収束の包括的ガイド。理論的基礎、主要な収束目標(自己保存、目標内容完全性、認知向上、資源獲得)、権力追求の形式化、および2022〜2026年の強化学習・大規模言語モデルからの経験的証拠をカバー。フロンティアモデル評価とアライメント研究の解釈に不可欠。
英国政府は数十億ポンドのAIインフラ投資を発表したが、チップやソーシャルメディアに関する提案の具体性には疑問が残る。ロンドン・テックウィークではAI経済の主導権争いが焦点に。