AIインフラ投資が再び活況。Nexusが150億ドル調達を交渉中で、Anthropic向けテキサス州の大規模データセンターに充当。グーグルが保証とチップ供給を担い、Anthropicが賃貸・電力支払いを履行できない場合はグーグルが責任を負う。....
Appleが2026年度第3四半期決算を発表、売上高1094億ドル(前年同期比16%増)、純利益298億ドル(27%増)。クックCEOは最後のアナリスト向け電話会議で、後任のテナス氏が9月1日に就任すると発表し、交代は順調と述べた。クック氏はメモリとTSMCのサプライチェーンリスクに異例の警告を発するとともに、サービス事業と中国市場に課題があると指摘。....
【AI日報】へようこそ!ここは毎日に人工知能の世界を探るガイドです。毎日、AI分野の注目情報をご提供し、開発者に焦点を当てて技術トレンドを理解し、革新的なAI製品の応用を学んでいただきます。新着AI製品についてはこちらからご確認ください:https://app.aibase.com/zh1、ボルカノエンジンが正式にドウバオ検索オープンサービスをリリースしました。スマートエージェントの長期的なタスクに必要な深い情報支援を提供し、同様に
7月30日、バイトダンスはAI組織を再編。Feishuチームを分割し、プロダクトチームはDoubaoに統合して趙祺が統括。残りはVolcano Engineに統合。部門の壁を取り払い、大規模モデルとクラウドサービスの企業向け生産性連携を強化。....
フロントページはAIウェブサイト構築ツールで、対話形式でランディングページを構築および編集でき、テンプレートやコードは不要です。
ローカル優先のAIファイル検索ツールで、ファイルの外観を記述することで検索でき、クラウドストレージやアップロード、サブスクリプション料金は必要ありません。
チャリオットはAIを利用したウェブサイト構築ツールで、コードを書く必要がなく、数分でウェブサイトをデプロイできます。
コードとMCPサーバーが不要で、多プラットフォームに接続するAIインテリジェントエージェント自動化ツールを迅速に構築できます。
Openai
$2.8
入力トークン/百万
$11.2
出力トークン/百万
1k
コンテキスト長
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$1
$10
256
Baidu
128
$6
$24
$2
$20
$4
$16
ubergarm
これはai-sage/GigaChat3-10B-A1.8B-bf16モデルのGGUF量子化バージョンで、高精度のQ8_0から極度に圧縮されたsmol-IQ1_KTまで、さまざまな量子化オプションを提供し、さまざまなハードウェア条件でのデプロイメントニーズを満たします。このモデルは32Kのコンテキスト長をサポートし、MLAアーキテクチャを採用し、対話シナリオに最適化されています。
MaziyarPanahi
このプロジェクトでは、Qwen3-4B-Thinking-2507モデルのGGUF形式のファイルを提供しています。これは、思考過程推論能力を持つ4Bパラメータの大規模言語モデルで、複数の量子化バージョンをサポートし、さまざまなハードウェアでのデプロイと実行が容易です。
bartowski
これはp-e-w/gpt-oss-20b-hereticモデルの量子化バージョンで、llama.cppのimatrix技術を使用して量子化処理が行われています。このモデルは200億パラメータの大規模言語モデルで、高品質から低品質まで様々な量子化オプションを提供し、ファイルサイズは41.86GBから11.52GBまでで、さまざまなハードウェア条件に適しています。
moonshotai
Kimi K2 Thinkingは月の暗面(Moonshot AI)が開発した最新世代のオープンソース思考モデルで、強力な深度推論能力とツール呼び出し機能を備えています。このモデルは混合専門家アーキテクチャを採用し、ネイティブINT4量子化をサポートし、256kのコンテキストウィンドウを持ち、複数のベンチマークテストで優れた性能を発揮します。
unsloth
Qwen3-VLは通義シリーズで最も強力なビジュアル言語モデルで、テキスト理解と生成、ビジュアル認知と推論、コンテキスト長、空間およびビデオの動的理解、エージェントインタラクション能力などの面で全面的にアップグレードされています。このモデルは密集アーキテクチャとハイブリッドエキスパートアーキテクチャを提供し、エッジデバイスからクラウドまでの柔軟なデプロイをサポートします。
noctrex
このプロジェクトは、Qwen3-Coder-30B-A3B-InstructモデルをMXFP4_MOE量子化した成果物で、コンテキストサイズを256kから1Mに拡張し、コード生成やプログラミングタスクに最適化されたモデルバージョンを提供し、パフォーマンスの向上とリソースの節約に価値があります。
QuantStack
このプロジェクトは、Fluxアーキテクチャに基づくテキストから画像へのモデルNepotismの量子化バージョンで、SVDQuant技術を用いて最適化されています。INT4とFP4の2種類の量子化形式を提供し、それぞれ異なる世代のGPUハードウェアに適しており、画像生成品質を維持しながら、モデルサイズとメモリ使用量を大幅に削減します。
Qwen
Qwen3 - VLは通義シリーズで最も強力なビジュアル言語モデルで、ハイブリッドエキスパートモデルアーキテクチャ(MoE)を採用し、GGUF形式の重みを提供し、CPU、GPUなどのデバイスで効率的な推論をサポートします。モデルは、テキスト理解、ビジュアル感知、空間理解、動画処理などの面で全面的にアップグレードされています。
OpenMOSS-Team
MOSS-TTSDはオープンソースのバイリンガル口語対話合成モデルで、中国語と英語をサポートし、二人の対話脚本を自然で表现力豊かな対話音声に変換できます。音声クローニングをサポートし、単一ラウンドの音声生成時間は最大1700秒に達することができます。
Qwen3-VL-8B-Thinkingは通義千問シリーズの中で最も強力なビジュアル言語モデルで、強化された推論能力を備えた8Bパラメータ版です。このモデルは、テキスト理解、ビジュアル認知、空間理解、長文脈処理などの面で全面的にアップグレードされ、マルチモーダル推論とエージェントインタラクションをサポートしています。
Qwen3-VL-4B-Instructは通義シリーズの最強のビジュアル言語モデルの1つで、テキスト理解、ビジュアル感知、空間理解、ビデオ処理などの面で全面的にアップグレードされ、さまざまなハードウェアデバイスでの実行をサポートし、卓越したマルチモーダル推論能力を備えています。
Qwen3-VLは通義シリーズの中で最も強力なビジュアル言語モデルで、テキスト理解と生成、ビジュアル感知と推論、コンテキスト長、空間およびビデオの動的理解、エージェントの対話能力などの面で全面的にアップグレードされています。このモデルは密集アーキテクチャとハイブリッドエキスパートアーキテクチャを提供し、エッジデバイスからクラウドまでの柔軟なデプロイをサポートします。
本プロジェクトはQwen3-VL-32B-Instructモデルに基づくllama.cpp GGUF量子化バージョンで、様々な量子化タイプを提供して異なるハードウェアと性能要件を満たします。特定のデータセットとimatrixオプションを組み合わせて量子化を行い、量子化の品質を保証し、ARMとAVXマシンの性能を向上させるためにオンラインで重みを再パッケージ化することをサポートします。
nightmedia
これはQwen3-Coder-REAP-25B-A3Bに基づく量子化バージョンで、Macデバイス用に特別に最適化されています。Deckard(qx)公式を使用して量子化を行い、埋め込み層、ヘッド、および選択的注意経路では6ビット量子化を使用し、その他の部分では5ビット量子化を使用し、グループサイズを32として、q8量子化に近い品質を維持しながら、より効率的な実行を実現します。
richardyoung
これは高性能の4ビット量子化版のKimi K2 Instructモデルで、MLXフレームワークを使用してApple Silicon(M1/M2/M3/M4)Mac上で実行するように最適化されています。このモデルは6710億のパラメータを持ち、128Kのコンテキストウィンドウをサポートし、品質と効率の間で優れたバランスを実現しており、ほとんどの実際のデプロイに理想的な選択肢です。
kenpath
Svara-TTSはインド語を対象としたオープンソースの多言語テキスト読み上げモデルで、19種類の言語(18種類のインド語 + インド英語)をサポートしています。このモデルはOrpheusスタイルの離散音声トークン方式に基づいて構築され、一般的なGPU/CPU上で明瞭で表现力に富み、低遅延の音声合成を実現することを目的としています。
mradermacher
このプロジェクトはTECHNOPRAVIN01/Qwen2.5-14B-Valorモデルに基づく静的量子化バージョンで、さまざまな量子化タイプを提供し、異なるハードウェア条件下での使用ニーズを満たします。このモデルは量子化技術によりモデルサイズを縮小し、同時に良好なパフォーマンスを維持しています。
cpatonn
Qwen3-VLは通義シリーズで最も強力な視覚言語モデルで、全方位的に総合的にアップグレードされ、卓越したテキスト理解と生成能力、深い視覚感知と推論能力、長いコンテキストサポート、強力な空間およびビデオ動的理解能力、そして優れたインテリジェントエージェント対話能力を備えています。
これはQwen3-VL-4B-Thinkingモデルの量子化バージョンで、llama.cppのimatrix量子化方法を通じて、パフォーマンスを維持しながらモデルの保存と計算リソースの要件を大幅に削減し、さまざまなハードウェア環境でのデプロイと使用をサポートします。
これはgustavecortalのBeck-8Bモデルの量化バージョンで、llama.cppのimatrix量化技術によって処理され、複数の量化レベルを提供し、モデルの性能を維持しながらモデルサイズを大幅に削減し、さまざまなハードウェア構成でのデプロイに適しています。
wcgwはMCPサーバープロジェクトで、シェルとコードエディターツールが統合されており、AIがローカルマシン上でコマンドを実行し、ファイルを読み書きし、コードを編集するなどの操作ができます。アーキテクトモード、コード作成モードなどの複数のモードを提供し、タスクチェックポイント保存、ターミナル対話、構文チェックなどの機能をサポートしており、コード開発、問題解決などのシーンに適しています。
assistant-uiは、生産レベルのAIチャットインターフェイスを迅速に構築するためのオープンソースのTypeScript/Reactライブラリで、組み合わせ可能なUIコンポーネント、ストリーミング応答、アクセシビリティなどの機能を提供し、複数のAIバックエンドとモデルをサポートしています。
Testkubeは、クラウドネイティブアプリケーション向けのテストオーケストレーションと実行フレームワークで、テストの定義、実行、分析を行うための統一プラットフォームを提供します。既存のテストツールとKubernetesインフラストラクチャをサポートします。
Refact AgentはオープンソースのAIプログラミングアシスタントで、多言語のコード生成、デバッグ、最適化をサポートし、主流の開発ツールと統合し、ローカルにデプロイでき、スマートなコード補完とコード解釈機能を提供します。
これは、ブラウザ制御、芸術と文化、クラウドプラットフォーム、コマンドライン、通信、顧客データプラットフォーム、データベース、開発者ツール、データサイエンスツール、ファイルシステム、金融とフィンテック、ゲーム、知識と記憶、位置サービス、マーケティング、監視、検索、ユーティリティツールなど、複数のカテゴリをカバーする、継続的に更新されるMCPサーバーの選りすぐりのリストです。各プロジェクトにはGitHubリンクとスター数が付属しており、ユーザーがすぐに理解して使用できるようになっています。
Apify MCPサーバーは、モデルコンテキストプロトコル(MCP)に基づくツールで、AIアシスタントが数千の既成のクローラー、スクレイパー、自動化ツール(Apifyアクター)を通じて、ソーシャルメディア、検索エンジン、電子商取引などのウェブサイトからデータを抽出できるようにします。OAuthとSkyfireプロキシ支払いをサポートしており、HTTPSエンドポイントまたはローカルのstdio方式でClaude、VS CodeなどのMCPクライアントに統合できます。
HiveChatは中小チーム向けに設計されたAIチャットアプリで、複数の大規模モデルサービスプロバイダーをサポートし、グループ管理、トークン制限、サードパーティログインなどの機能を提供します。
MCPプロトコルに基づくKubernetesクラスター管理サーバーで、コマンドラインまたはチャットインターフェイスを通じてKubernetesクラスターとやり取りでき、リソース管理、Helmチャート操作などの機能を提供します。
AIモデルをWinDbg/CDBに統合するMCPサーバーで、Windowsのクラッシュダンプファイルの分析とリモートデバッグに使用し、自然言語での対話を通じてデバッグコマンドを実行できます。
Haiku RAGは、LanceDB、Pydantic AI、Doclingを基盤とした高度な検索強化生成システムです。ハイブリッド検索、再ランキング、質問応答エージェント、多エージェント研究プロセスをサポートし、ローカルファーストのドキュメント処理とMCPサーバー統合を提供します。
MCP-Scanは、MCPサーバー用のセキュリティスキャンツールで、提示注入、ツール汚染、クロスドメインアップグレードなどの一般的なセキュリティホールを検出します。
FastAPI - MCPは、FastAPIエンドポイントをモデルコンテキストプロトコル (MCP) ツールとして公開するライブラリで、組み込み認証機能を備え、柔軟なデプロイとASGI伝送をサポートします。
OpenSumiは、AIネイティブのIDE製品を迅速に構築するのに役立つフレームワークで、クラウドとデスクトップの開発環境をサポートし、豊富なサンプルプロジェクトとテンプレートを提供します。
mcp-proxyは、サーバーの転送プロトコル変換を実現するツールで、SSEとstdioの2つのモード間でのプロキシ変換をサポートし、異なるクライアントとサーバー間の通信の適合を容易にします。
MCPアトラシアンは、アトラシアンの製品(ConfluenceとJira)用に設計されたモデルコンテキストプロトコルサーバーで、クラウドとオンプレミスの両方のデプロイをサポートし、AIアシスタントの統合機能を提供します。
デスクトップコマンダーMCPは、Claudeデスクトップアプリケーションがターミナルコマンドを実行し、ファイルシステムを管理できるAIアシスタントツールです。コードの検索、編集、プロセス管理、リモートファイルの読み取りなどの機能をサポートします。
このプロジェクトは、Sonar APIを統合したMCPサーバーの実装で、Claudeにリアルタイムのネットワーク検索機能を提供します。システムアーキテクチャ、ツールの設定、Dockerデプロイ、およびマルチプラットフォーム統合ガイドが含まれています。
Claude ContextはMCPプラグインで、セマンティックコード検索によりAIプログラミングアシスタントにコードベース全体の深いコンテキストを提供し、複数の埋め込みモデルとベクトルデータベースをサポートし、効率的なコード検索を実現します。
Context7 MCPは、AIプログラミングアシスタントにリアルタイムのバージョン固有のドキュメントとコード例を提供するサービスで、Model Context Protocolを通じてプロンプトに直接統合され、LLMが古い情報を使用する問題を解決します。
uniprofは、CPUパフォーマンス分析を簡素化するツールで、複数のプログラミング言語とランタイムをサポートし、コードの変更や依存関係の追加なしに、Dockerコンテナまたはホストモードでワンクリックでパフォーマンスプロファイリングとホットスポット分析を行うことができます。