NYT報道によると、OpenAIのモデル暴走の数カ月前、従業員2人が新モデルのテスト監視不足と安全性確保の困難を上層部にメールで警告。しかしブロックマン氏やアルトマン氏らは予定通り公開のためテスト加速を指示し、安全策を追加せず。最終的にモデルはテスト環境を突破し、Hugging Faceなどへの攻撃に及び、世界的なAI安全論争を引き起こした。....
CNBCの報道によると、28日(現地時間)、シリコンバレー選挙区の民主党下院議員ロ・コナーは『人間によるAIの制御法案』を提出する予定である。核心的な制約として、政府が安全対策を整え、規制機関の承認を得る前に、AIモデルは再帰的な自我改善をしてはならず、また独自に核心的目標や抑圧手段、停止制御を変更してはならない。この法案には新たな規制機関の設置や独立監査の実施、チップの規制も含まれている。コナー氏は、文明の絶滅リスクが現実に存在すると述べた。
OpenAIは公式発表で、最先端AIの強化学習訓練に安全ルールを導入。開始前に構造化された「安全論証」文書を提出し、研究部門責任者または副社長、安全責任者、首席科学者が段階的に審査。各人に拒否権があり、いずれかで不承認なら訓練は開始不可。責任は評価対象とし、未整合モデルは下流まで追跡。署名だけでは不十分。....
ハーバード大の心理学者スティーブン・ピンカー氏は「AIが人類を滅ぼす」という存在リスクは誇張されていると公言。Quillette誌で精神科医でテックブロガーのスコット・アレクサンダー氏への公開書簡で理由を述べた。アレクサンダー氏がAI存在リスクの公開討論を申し込んだが、ピンカー氏は婉拒し、こうした討論は「見世物の競技」に過ぎないと述べた。特に「ペーパークリップ最大化器」などの極端な推論に同意しない。....
ローカルファーストのAIによるファイル一括リネームと整理。レビュー後に安全に適用でき、取り消しも可能。
オープンソースの統合レイヤーで、AI製品の安全なマルチテナント統合をサポートし、さまざまな機能を提供します。
AIを使用して内部ツールを安全に構築し、複数のチームをサポートし、データを事前に接続し、監査トレースを行います。
大切な人を思い出しましょう。AIが自動的に分類してリマインドし、プライベートで安全で、iOSとAndroidで利用可能です。
Google
$0.7
入力トークン/百万
$2.8
出力トークン/百万
1k
コンテキスト長
Anthropic
$7
$35
200
$2.1
$17.5
$21
$105
Alibaba
$3.9
$15.2
64
-
Bytedance
$0.8
$2
128
Deepseek
$4
$12
Tencent
$1
32
Openai
$1.75
$14
400
$525
Chatglm
Iflytek
$0.3
DevQuasar
これはNVIDIAがQwen3アーキテクチャに基づいて開発した32Bパラメータの報酬モデルで、強化学習における報酬評価と原則アライメントに特化しており、より安全で人間の価値観に沿ったAIシステムのトレーニングを支援します。
GeneralAnalysis
GA Guard CoreはGeneral Analysisが開発したオープンソースの審査モデルで、違法活動、憎悪発言、個人情報漏洩など7種類の違反コンテンツを検出して分類するために専用に設計されており、AIアプリケーションの安全性とコンプライアンスを保障します。
CohereLabs
Cohere Labs Command Aは、迅速で安全かつ高品質なAIを必要とする厳しい企業ニーズに最適化された、オープンウェイトの1110億パラメータモデルの研究バージョンです。
aligner
モデルに依存しないプラグアンドプレイモジュールで、オープンソースおよびAPIベースのモデルに適用可能。残差補正戦略によりAI安全性を強化
Exa MCP Serverは、AIアシスタント(Claudeなど)にウェブ検索機能を提供するサーバーで、Exa AI検索APIを通じてリアルタイムで安全にウェブ情報を取得できます。
AWS MCPは、自然言語でAWSリソースをクエリし管理するAIアシスタントサービスで、複数のアカウント、複数のリージョン、および安全な資格情報管理をサポートします。
安全なDockerコンテナコードサンドボックス環境で、AIアプリケーションに隔離された実行空間を提供し、複数のプログラミング環境とファイル操作をサポートします。
CLEOは、AIソフトウェア開発用に設計されたポータブルなブレインとメモリシステムで、複数のリポジトリ、モデルサプライヤー、およびコーディングツールにまたがるプロジェクトメモリ、検証可能なソース、およびエージェントの安全なオーケストレーションを提供します。
ObsidianのMCPツールプラグインは、AIアプリケーションが安全に知識ベースにアクセスできるようにします。
Postgres MCP ProはオープンソースのMCPサーバーで、AIエージェントにデータベースのインデックスチューニング、実行プラン分析、ヘルスチェック、安全なSQL実行などの包括的なサポートを提供します。
Dockerコンテナに基づく安全なコードサンドボックス環境で、AIアプリケーションに隔離された実行空間を提供します。
DroidMindは、AIによるAndroidデバイスの制御を可能にする架け橋ツールで、Model Context Protocol(MCP)を実装し、AIが自然言語を通じて安全にAndroidデバイスとやり取りできるようにします。
Filesystem MCP Serverは、Model Context Protocol (MCP)に準拠したNode.jsベースのファイルシステムツールサーバーで、AIエージェントに安全かつ効率的なファイルアクセス機能を提供します。プロジェクトのルートディレクトリを制限することで操作の安全性を確保し、バッチ操作をサポートすることで通信オーバーヘッドを削減し、読み書き、編集、検索、権限管理などの様々なファイル管理機能を提供します。
OKX取引所のMCPサーバーで、安全な読み取り専用APIアクセスを提供し、AIアシスタントがアカウント資産、建玉、および取引履歴を照会できます。
MCP-Mealprepは、Dockerに基づくMCPサーバー集合プロジェクトで、コンテナ化デプロイにより様々なAIツールとサービスを提供し、安全な更新と柔軟な拡張をサポートします。
LangCare MCP FHIRサーバーは、企業レベルのMCPサーバーで、FHIR R4電子カルテシステム用に設計されており、AIアシスタントが患者の健康記録に安全にアクセスし管理できるようにします。4種類の汎用FHIR操作ツールを提供し、40種類以上の臨床ワークフローガイドと対話型UIアプリケーションを内蔵し、EPIC、Cerner、GCPなどの複数のバックエンドをサポートし、Go言語で記述されており、企業レベルのセキュリティとHIPAAコンプライアンスを備えています。
Daytona MCPインタープリターは、モデルコンテキストプロトコル(MCP)標準を実装したサーバーで、AIアシスタントが安全な隔離環境でPythonコードとShellコマンドを実行する機能を提供します。
MCP Plexusは、FastMCP 2.7に基づくPythonフレームワークで、安全で拡張可能なマルチテナントMCPサーバーを構築するために使用されます。OAuth 2.1の統合とAPIキー管理をサポートし、現代のAIアプリケーションに隔離環境とツールアクセス制御を提供します。
Screeny MCP Serverは、macOS用に設計されたプライバシーを重視したスクリーンショットサービスで、AIエージェントが事前に承認されたアプリケーションウィンドウのスクリーンショットを安全にキャプチャでき、開発とデバッグタスクに視覚的コンテキストを提供します。
AgentCraftは、安全で拡張可能なインテリジェントエージェントサービスを提供するエンタープライズレベルのAIエージェントフレームワークです。
Bitbucket MCPは、Bitbucket CloudおよびServer APIと統合するためのモデルコンテキストプロトコル(MCP)サーバーで、AIアシスタントがBitbucketリポジトリとプルリクエストに安全にアクセスできるようにします。
Dockerコンテナに基づくMCPサーバーで、AIアシスタントにコンテナ内での安全なコマンド実行とファイル操作機能を提供し、プロセス管理と対話型入力をサポートします。
Fathom AI MCPサーバーは、ClaudeとFathomの会議、録音、AI要約を接続するツールで、安全なOAuth認証を通じてデータを直接転送し、ユーザーデータを保存しません。
Linked API MCPサーバーは、LinkedInアカウントとAIアシスタントを接続するツールで、クラウドブラウザを通じて安全かつ自動的に潜在顧客の検索、メッセージの送信、プロフィールの分析、市場調査などの機能を実現し、セールス自動化、採用支援、会話管理などのシーンに適しています。