AI動画生成プラットフォームHiggsfieldは、DST Global、ゴールドマン・サックス、インテルなどの投資により4億ドルを調達し、評価額が54億ドルに上昇しました。これは8ヶ月前と比べて13億ドルから4倍に増加したものです。会社設立から2年しか経っていないにもかかわらず、企業向けサブスクリプションビジネスを加速的に拡大しており、商業化がさらに加速しています。年間収益は7億ドルに迫っています。創業者は元Snapchatの幹部であるAlex Mashrabovです。
テンセントの第2四半期財報によると、AIが核心的な主軸となっている。混元大モデルは急速にアップデートされ、Hy3previewから正式版へと進化し、パラメータ数がより大きいHy4の公開を計画している。オフィス向けインテリジェントエージェントはすでに初期的な優位性を築き、複数製品が力を入れて展開している。微信のAIアシスタント「マイクロ」は6月に公開し、灰字テストを拡大した。基本的な経営状況は安定しており、売上高は2047.9億元で、前年同期比で増加している。
マスク氏のSpaceXAIがGrok Botを発表。24時間対応のAIエージェントチームで専門タスクをシームレスに処理。AnthropicやOpenAIへの追い上げと見られる。アプリやウェブにログインし重要情報を保持、ロボット間連携も可能。....
マイクロソフトTeamsは2026年8月、会議中にフィッシングやディープフェイクなどの不審行為を直接報告できる機能を導入。企業のセキュリティチームの迅速対応を支援し、生成AIによる音声や顔の複製を用いたなりすまし詐欺などAI攻撃の増加に対応する。....
オープンソースの家庭用サーバーオペレーティングシステムで、ワンクリックで200以上のアプリケーションをインストールでき、AIアシスタントのLivがあり、任意のブラウザからアクセスできます。
TelegramにワンクリックでOpenClawをデプロイ。サーバーや技術知識不要。プライベートAIアシスタントが24時間稼働
Dabeは、250以上のアプリケーションでタスクを実行する無料のAIエージェントです。簡単に英語でご希望の内容を記述するか、テンプレートを使用してください。Dabeはバックグラウンドで自動タスクを構築?テスト?実行します。
たった一行のコードで、250以上のアプリケーションへの統合プラットフォームにアクセスできます。
Google
$0.49
入力トークン/百万
$2.1
出力トークン/百万
1k
コンテキスト長
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$6
$24
256
Baidu
128
$2
$20
$4
$16
$8
$240
52
nineninesix
KaniTTSは、リアルタイム対話型AIアプリケーション向けに最適化された高速、高音質のテキスト音声変換モデルです。2段階パイプラインを用いて、大規模言語モデルと高効率オーディオコーデックを組み合わせ、卓越した速度とオーディオ品質を実現します。このモデルはスペイン語をサポートし、4億のパラメータを持ち、サンプリングレートは22kHzです。
KaniTTSは、リアルタイム対話型人工知能アプリケーション向けに最適化された高速かつ高忠実度のアラビア語テキスト音声変換モデルです。2段階パイプラインアーキテクチャを採用し、大規模言語モデルと効率的なオーディオコーデックを組み合わせることで、卓越した速度とオーディオ品質を実現し、対話型AI、障害者支援、研究など多くの分野の音声合成ニーズを満たすことができます。
KaniTTSは、リアルタイム対話型AIアプリケーション向けに最適化された高速かつ高忠実度のテキスト音声変換モデルです。独自の2段階アーキテクチャにより、大規模言語モデルと効率的な音声コーデックを組み合わせ、低遅延で高品質な音声合成を実現します。リアルタイムファクターは最低0.2で、リアルタイム速度の5倍の高速合成が可能です。
rtr46
meiki.text.detect.v0.1は、ビデオゲームや漫画のテキスト検出に特化した高精度、低遅延のOCRモデルで、日本語関連の内容で優れた性能を発揮します。このモデルはD - FINE検出器アーキテクチャに基づき、MobileNet v4 smallをバックボーンネットワークとして使用し、異なるアプリケーションシーンに対応するために2種類の解像度バリエーションを提供します。
KaniTTS Pretrain v0.3は高速で高忠実度のテキストを音声に変換するモデルで、リアルタイム対話型人工知能アプリケーション向けに最適化されています。2段階パイプラインアーキテクチャを採用し、大規模言語モデルと高効率オーディオコーデックを組み合わせて、超低遅延と高品質の音声合成を実現します。
KaniTTSは、リアルタイム対話型AIアプリケーション向けに最適化された高速かつ高忠実度のテキスト音声変換モデルです。2段階のパイプラインアーキテクチャを採用し、大規模言語モデルと効率的なオーディオコーデックを組み合わせることで、卓越した速度と音質を実現し、複数の言語をサポートし、エッジ/サーバーデプロイメントに適しています。
KaniTTSは高速で高忠実度のテキスト音声変換モデルで、リアルタイム対話型人工知能アプリケーション向けに最適化されています。このモデルは2段階の処理フローを採用し、大規模言語モデルと効率的なオーディオコーデックを組み合わせています。Nvidia RTX 5080で15秒の音声を生成する際の遅延は約1秒だけで、MOS自然度評価は4.3/5で、英語、中国語、日本語などの多言語をサポートしています。
malaysia-ai
X-Codec-2.0-25TPS-24kは、HKUSTAudio/xcodec2を改良した音声コーデックモデルで、毎秒の処理トランザクション数を50から25に低下させると同時に、出力サンプリングレートを24kHzに引き上げ、音声品質を維持しながら処理効率を最適化しています。
Kwai-Klear
Klearは、快手Kwai-Klearチームによって開発された疎なハイブリッドエキスパート(MoE)の大規模言語モデルで、高性能と推論効率の特徴を備えています。総パラメータは460億で、活性化パラメータはわずか25億で、複数の能力ベンチマークテストで優れた成績を収め、実際のアプリケーションに効率的で強力な解決策を提供します。
Sci-fi-vy
GPT-OSS-20BはOpenAIが開発したオープンウェイトモデルで、強力な推論、エージェントタスク、多様な開発者ユースケースに特化して設計されています。このモデルは210億のパラメータ(うち36億はアクティブなパラメータ)を持ち、ハイブリッドエキスパートアーキテクチャを採用し、低遅延のローカルデプロイと特定のシナリオでのアプリケーションをサポートしています。
BruhzWater
Lilith's-Whisper-L3.3-70b-0.1は、Llama 3.3アーキテクチャに基づく700億パラメータの大型言語モデルで、ロールプレイング(RP)シナリオに特化して最適化されています。このモデルは2/3段階のマージ方式を採用し、複数のトップレベルのRPモデルの長所を融合し、ロールプレイングアプリケーションに強力な対話生成能力を提供します。
OpenMed
これは疾病実体識別に特化したTransformerモデルで、xlm - roberta - baseアーキテクチャに基づき、NCBI疾病データセットで微調整されています。このモデルは、バイオメディカルテキスト内の疾病実体を正確に識別でき、B - DiseaseとI - Diseaseの2種類の実体タイプの識別をサポートし、企業レベルの医療アプリケーションに高精度な実体抽出能力を提供します。
LumiOpen
Poro 2 8B Instructは、Llama 3.1 8Bアーキテクチャに基づく命令従順型チャットボットモデルで、フィンランド語と英語の対話型AIアプリケーション向けに設計されています。
meta-llama
Llama Prompt Guard 2はMetaが提供するプロンプト攻撃検出モデルシリーズで、86Mパラメータのアップグレード版と22Mの軽量版を含み、大規模言語モデルアプリケーションにおけるプロンプトインジェクションやジェイルブレイク攻撃を検出します。
OddTheGreat
複数の24Bパラメータモデルを融合し、言語表現力とロールプレイ能力を強化したハイブリッドモデルで、特に感情的なインタラクションシーンに最適化されています
buildborderless
これはビジュアルTransformerアーキテクチャに基づく画像分類モデルで、AI生成画像の検出に特化し、法医学アプリケーションをサポートします。モデルは270万枚の画像を含む大規模データセットで訓練され、15種類以上の生成器と4600種類以上のモデルをカバーしています。
timm
SigLIP 2に基づくViT画像エンコーダーで、グローバル平均プーリングを採用し、アテンションプーリングヘッドを削除、画像特徴抽出タスクに適しています。
SigLIP 2アーキテクチャに基づく視覚Transformerモデル、WebLIデータセットで事前学習され、アテンションプーリングヘッドを削除しグローバル平均プーリングを採用
SigLIP 2アーキテクチャに基づく視覚Transformerモデルで、画像特徴抽出のために設計され、アテンションプーリングヘッドの代わりにグローバル平均プーリング(GAP)を採用
SigLIP 2に基づくViT画像エンコーダーで、グローバル平均プーリング(GAP)を使用してアテンションプーリングヘッドを置き換え、画像特徴抽出タスクに適しています。
Open Data MCPはオープンソースプロジェクトで、MCPプロトコルを通じて公開データセットをLLMアプリケーションに迅速に接続することを目的としています。プロジェクトはCLIツールを提供し、2分での接続を実現し(現在はClaudeをサポート)、コミュニティ協力のフレームワークを構築して、開発者が簡単に公開データセットを貢献して公開できるようにします。核心的な目標は、すべてのLLMアプリケーションと数百万の公開データセットを接続するインフラストラクチャを構築することです。
MCPプロトコルに基づく意味コード検索サーバーで、OpenAIとOllamaの2種類の埋め込みモデルをサポートし、ローカルプロジェクトまたはGitリポジトリをインデックス化でき、企業レベルのオンプレミスコード検索ソリューションを提供します。
これは、MariaDB Cloudをベースとしたハイブリッド検索強化生成(RAG)検索システムのデモプロジェクトです。MariaDBのベクトル検索とFastMCPサーバーを通じたBrave Searchのウェブ検索強化を統合し、20 Newsgroupsデータセットをサンプルとして使用し、即時利用可能なハイブリッド検索アーキテクチャを提供します。
Kernel MCP ServerはModel Context Protocol (MCP)に基づくオープンソースサーバーで、AIアシスタントがKernelプラットフォームのツールとブラウザー自動化機能に安全にアクセスできるようにします。クラウドアプリケーションのデプロイ、ヘッドレスブラウザーの制御、ドキュメント検索などの機能をサポートし、OAuth 2.0認証を採用してセキュリティを確保しています。
このプロジェクトは、CISA BOD 25 - 01のセキュリティコントロールを実装したM365 MCPサーバーで、Microsoft Graph APIを通じてMicrosoft 365のセキュリティ設定を管理し、レガシー認証のブロック、リスクベースのアクセス制御、多要素認証管理、アプリケーション登録制御、パスワードポリシー管理などの機能を提供します。
MSSQL MCPサーバーは、標準インターフェイスを通じて言語モデルにMicrosoft SQL Serverデータベースへの全面的なアクセス機能を提供する強化型データベース管理ツールです。模式チェック、クエリ実行、ストアドプロシージャ管理などの高度な機能を含む23種類のデータベース操作ツールをサポートしています。
このプロジェクトは、Chromeとのやり取りを行うMCPサーバーを構築することを目的としています。簡易デモ版とPython SDKに基づく堅牢なバージョンの2種類の実装があり、ページのスクリーンショット撮影やプロトコル検証に使用されます。
このプロジェクトは、pyATSとGenieに基づくMCPサーバーを実装し、JSON - RPC 2.0プロトコルを通じて構造化、モデル駆動型のネットワーク機器とのやり取り機能を提供します。安全なCLIコマンドの実行、設定変更、およびデータ収集をサポートし、コンテナ化またはLangGraph統合シナリオに適しています。
AIパッケージセキュリティスキャンツールで、CLIとMCPサーバーの2つのモードを提供し、MCPサーバー、AIスキル、ソフトウェアパッケージ内の脆弱性、プロンプトインジェクション、サプライチェーン攻撃を迅速に検出できます。
MCP Dockmasterは、MCPサーバを簡単にインストールして管理するためのクロスプラットフォームのデスクトップアプリ、CLI、ライブラリです。Mac、Windows、Linuxシステムをサポートしています。プロジェクトはNXで管理されるmonorepo構造を採用しており、メインアプリとプロキシサーバの2つの核心モジュールを含んでいます。
Msty Admin MCPは、Msty Studioデスクトップ版2.4.0以上用に設計されたAI駆動のシステム管理ツールで、Claude Desktopを通じて155のツールを提供し、データベースクエリ、設定管理、ローカルAIモデルのオーケストレーション、階層型AIワークフローの構築などの機能を実現します。
非公式のMake.com MCPサーバーで、AIアシスタントにMake.comのモジュールの完全なドキュメントへのアクセス、シナリオの検証、ワンクリックでのデプロイ機能を提供します。200以上の自動化モジュールを検索し、ブループリントを構築し、直接Make.comプラットフォームにデプロイできます。
セキュリティコントロールフレームワーク(SCF)に基づくMCPサーバーで、1451個のセキュリティコントロール項目をISO 27001、NIST CSF、DORA、AIガバナンス標準など262のコンプライアンスフレームワーク間で双方向のマッピングと検索機能を提供し、AIアシスタントが異なるセキュリティ標準の要件を直接クエリして関連付けることができます。
Letta MCPサーバー鉄道版は、クラウドデプロイ用に最適化されたHTTPトランスポートMCPサーバーで、AIクライアントをLetta.aiの強力な状態エージェントにシームレスに接続し、鉄道プラットフォームへのワンクリックデプロイをサポートし、20以上のエージェント管理、対話、メモリ管理、および監視ツールを提供します。
このプロジェクトには、モデルコンテキストプロトコル(MCP)に基づく2つのサーバーが含まれています。IoTデバイス制御サーバーとメモリ管理サーバーです。IoTサーバーは、デバイスの制御、状態の照会、およびリアルタイム更新機能を提供し、スマートホームや産業用IoTなどのシナリオに適しています。メモリ管理サーバーは、長期的なメモリ保存とセマンティック検索機能を提供し、会話履歴や知識管理などの分野に適しています。
mcp - server - linearは、クライアントアプリケーションとLinearプラットフォームを接続する中間サーバーで、標準化されたMCPインターフェースを提供して、Linearの問題、プロジェクトなどのリソースにアクセスし管理します。APIキーとOAuthの2つの認証方式をサポートし、完全なCRUD操作、高度な検索機能を備え、複数のAIアシスタントと統合できます。
ヴェネツィアブラウザMCPブリッジは、軽量級で本番環境で使用できるツールで、stdin/stdoutを通じてJSON - RPCプロトコルを使用してブラウザ自動化フレームワークPlaywrightと通信し、行モードとコンテンツ長の2種類のメッセージフレーム形式をサポートし、ウェブページのナビゲーションとセッション管理機能を提供します。
これは、AIアシスタントとMetabase分析プラットフォームを接続するMCPサーバーで、データアクセス、ダッシュボード管理、クエリ実行などの機能を提供し、2種類の認証方式をサポートしており、AIが直接データ分析プラットフォームと対話できるようにします。
Next.js MCP Serverは、Next.jsアプリケーションのルーティング情報を分析するためのツールで、プロジェクトのディレクトリ構造をスキャンし、APIルートの詳細情報(パス、HTTPメソッド、パラメータ、ステータスコードなど)を抽出し、コマンドラインとDockerの2つの実行方法を提供します。
SHARPはApple研究によって開発されたAIモデルで、単一の2D写真を迅速に3Dガウシアンスプラット表現に変換し、写真からインタラクティブな3Dシーンへのリアルタイム変換を実現し、推論時間は1秒未満です。