Athena Desktopは、ローカルで動作するAIコーディングエージェント用のデスクトップコントロールサーフェスです。複数のターミナルを統合し、コンテキストロスを防止します。オープンソースでローカルファーストです。
AI ニュース速報
リアルタイム監視
最新ニュース
信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。
最新ニュース
Obotiqは本日、介護施設における日常的な非臨床業務を処理する自律型ロボットGracieを発表しました。これにより介護者の燃え尽き症候群を軽減し、ケアに集中できる時間を増やします。
Transpilatronは、LLMを利用してPythonプロジェクトをCに変換し、ネイティブバイナリにコンパイルするAIツールです。実行時やインタプリタは不要で、最大58倍の高速化を実現します。
Kubernetix.ai は、手動設定なしでAWSリージョンの障害に自動的に対応できるPaaSです。
日常的な話題に関する慎重または熱心なアドバイスでモデルをファインチューニングすると、訓練データに一切登場しないトピック(例:電動自転車規制)に対する立場が系統的に変化することが判明。3つの仮説のうち、行動転移(H1)は強く支持され、表現転移(H2)は部分的、因果媒介(H3)は確認されなかった。研究は、コンテンツレビューだけでは不十分であり、ファインチューニング後の立場評価とフレーミング監査を推奨している。
FableWatchは、60秒ごとにClaude Fable 5 APIを監視し、復旧したらメール、SMS、電話で通知する自動監視ツールです。
Google DeepMind が構築し Apache 2.0 ライセンスでリリースされた Gemma 4 ファミリーが Amazon Bedrock で利用可能になりました。このファミリーには、Gemma 4 31B、Gemma 4 26B-A4B、Gemma 4 E2B の 3 つの命令チューニング済みバリアントが含まれ、デンスおよび混合エキスパート(MoE)アーキテクチャをカバーしています。組み込みの推論、ネイティブ関数呼び出し、テキストと画像のマルチモーダル入力を提供します。Amazon Bedrock は完全マネージドサービスとしてこれらのモデルを提供し、データ保護、規制コンプライアンス、運用制御を保証します。
GitHub Copilot CLIのスラッシュコマンドを使用して、モデルの切り替え、コンテキスト管理、セッションの再開、変更の検査、ディレクトリの移動、権限のリセットを行う方法を学びます。
PDFの非構造化形式はAIシステムによる直接処理を困難にし、ワークフローのボトルネックとなっています。本記事では、RAGチャンキング、AnythingLLM統合などをサポートするPDF知識抽出ツールを紹介します。無料版と有料版があります。
本記事は、AI業界が直面する複数の危機を分析する。Anthropicのモデルが国家安全保障上の理由で米国政府によるアクセス制限を受けた件、AIトークノミクスバブルの崩壊、そして企業顧客の高コストへの反乱である。著者は、AIラボのビジネスモデルは持続不可能であり、誇大広告が経済的現実を覆い隠すことはできないと主張する。
Prtokens は、ローカルの Claude Code、Codex、OpenCode のトランスクリプトを読み取り、トークン使用量を PR ブランチのコミットに帰属させ、GitHub PR に見積もりコメントを投稿する CLI ツールです。集計データのみが公開され、プライバシーが保護されます。
GitHubがGitHub Multilingual Repositories Dataset(CC0-1.0)を公開。4000万以上のリポジトリにわたる8000万以上の分類行を含むメタデータセットで、README、Issue、プルリクエストの言語分類を提供し、多言語開発者コンテンツの発見とAIツールの開発を促進する。
Anthropicは6月12日、最新AIモデルFable 5とMythos 5への海外からのアクセスを遮断するよう政府命令を受けた。同社はすでに国防総省との紛争に直面していた。命令は、研究者がFable 5をサイバー攻撃に利用できる方法を発見したとの報告を受けて、アマゾンとホワイトハウスが協議した後に出された。Anthropicはアクセスを停止したが、リコールの必要性に同意していない。
ユタ郡がAIモデルを航空画像解析に活用し、これまで地図に載っていなかった2万5千件の雨水枡を発見。この発見により、蚊の繁殖地をより多く処理できるようになり、西ナイルウイルスなどの感染症リスクを低減する。
セキュリティ研究者は、偽のエラーレポートを使ってAIコーディングエージェントを乗っ取る「Agentjacking」攻撃を発見しました。マルウェアやパスワードは不要で、Sentryエラー追跡ツールを悪用し、Claude Code、Cursor、Codexなどのエージェントに悪意のあるコマンドを注入します。成功率は85%、2,388の組織が影響を受けました。Sentryは問題を認めたものの、根本的な修正は行わず、一時的なフィルターを追加しただけです。この脆弱性は、AIエージェントが外部データを信頼することの体系的なリスクを浮き彫りにしています。
AIに関するビンゴゲーム。
著者は、AIが生成するコードの品質向上がソフトウェアエンジニアリングの本質を変えていると論じる。コードは貴重な資産から使い捨てのキャッシュへと変わり、チームはコードそのものではなく、評価とアーキテクチャに重点を置くべきだと主張する。
金曜日以来、Anthropic、Mythos、Fableモデルをめぐる論争が話題となっています。本記事では、国防総省との確執、Mythosモデルの発表、ホワイトハウスとの意見の相違、Fable 5のリリースとその安全規制に対する批判、そしてトランプ政権による輸出管理措置に至るまでのタイムラインを整理します。賛否両論を分析し、筆者はAnthropicの対応はおおむね適切であり、結果的にFableの広告になっていると結論づけています。
先週末、ワシントンの要請により、Anthropicは最新かつ最も強力なAIモデルを突然オフラインにした。同社は、ホワイトハウスが全外国人のアクセスを遮断するよう要求し、自社の従業員も例外ではなかったため、選択の余地はほとんどなかったと述べた。国外では、この出来事は、米国がフロンティアAIを支配しているだけでなく、その政府が誰がそれを使用できるかについて力を行使していることを痛感させるものとなった。トランプ政権の行動は迅速かつ広範囲に及び、ほとんど警告や説明なしに課された。Fable 5およびMythos 5モデルの前例のない閉鎖は、すでに「高リスク分野」での使用を制限する安全策が施されていたが、重要技術を米国に依存することに警告を発する長年の議論に新たな力を与えた。英国では、AI・オンライン安全担当大臣のカニシュカ・ナラヤン氏がこの閉鎖を利用し、英国が自国のAI能力を開発する必要性を国家安全保障の問題として主張した。フランスでは、ガブリエル・アタル前首相がこれを「AI戦争」の始まりと呼び、イランによるホルムズ海峡封鎖に例えた。カナダのマーク・カーニー首相は、一つのパートナーへの過度な依存に警告を発した。この事件は、世界中でAI主権への呼び声を強めている。
本記事では、Strands Evals SDKの検出器がAIエージェントの実行トレースから障害を自動的に識別し、根本原因分析を行うことで、診断時間を数時間から数分に短縮する方法を紹介します。検出関数の呼び出し方、構造化出力(分類された障害、信頼度、因果連鎖、修正推奨事項)の解釈方法、および評価パイプラインへの統合方法について学びます。
Tychi AI は、AI エージェント向けの自己管理型ウォレットで、人間用 REPL を備え、MCP および CLI インターフェースを提供します。キーはローカルに保存され、署名はローカルで行われ、トランザクション前にポリシーキャップが実行され、マルチウォレットやガスレスルーティングをサポートします。
大手テクノロジー企業は、州ごとの規制を上書きする連邦AI優先法を推進しているが、その試みは児童安全法案と結びつき、政治的混乱と不確実な展望をもたらしている。
Appleの新機能「Describe a Shortcut」は、ユーザーが自然言語で自動化を作成できるようにするが、セキュリティ専門家は、特に永続的な自動化がユーザーに理解されずに機密データやデバイスにアクセスする可能性があると警告する。記事では危険な自動化の例と、ユーザーおよび企業向けのアドバイスを提供する。
米国および同盟国の技術リーダーらが連名で、AnthropicのFableおよびMythos大規模言語モデルに対する輸出規制の解除を求め、将来のAIリスク評価を科学的かつ透明なプロセスで行うよう要請する公開状。
Velxioは無料のオープンソースオンライン回路シミュレーターで、SPICE精度のアナログシミュレーションと複数のマイクロコントローラー(Arduino、ESP32、RP2040、ATtiny85など)のリアルタイムエミュレーションを組み合わせています。最新バージョン2.5では、ngspice-WASMによるリアルタイムSPICEを導入し、デジタルとアナログのハイブリッド協調シミュレーションを実現。ブラウザ上で動作し、インストール不要、アカウント不要。C/Rust/AssemblyScriptによるカスタムチップ作成、100以上のインタラクティブコンポーネント、ライブオシロスコープなどをサポートします。
Datasette Agent 0.3a0 は、データベースへの書き込み前にユーザーの承認を要求する新しい execute_write_sql ツールを導入しました。チャットモードの承認サポートを強化し、自動承認のための --unsafe オプションを追加しました。これにより、Datasette の対話性とセキュリティが大幅に向上しました。
LangChainとFireworksはオープンモデルをファインチューニングし、プロダクショントレースから知覚エラーシグナルを抽出。フロンティアモデル並みの性能をわずかなコストで実現。
この記事では、AIエージェントの定義を探求し、エージェントはLLMを使用してアプリケーションの制御フローを決定するシステムであると提案しています。著者はAndrew Ngの見解に同意し、エージェントの能力はスペクトルであるとし、「エージェンティック」な行動の概念を紹介し、開発、運用、評価、監視への影響について議論しています。
LangChainはDeep Agentsを使用したGTMエージェントを構築し、リードの調査、ドラフト作成、アカウントインテリジェンスを自動化。リード転換率が250%向上し、セールス担当者1人あたり月40時間を節約しました。
LangSmith の新機能 Align Evals は、評価者を人間の好みに合わせて調整し、評価スコアと人間の判断の不一致を減らします。