マイクロソフトは、Copilot音声モードで表情を見せる黄色いキャラ「Mico」をチャット画面から撤去し、Learn Live学習プラットフォームへ移行すると発表。「反応できるコンテンツを増やすため」と説明。Micoは昨年10月登場から1年未満。AI CEOは「チャットボットにアイデンティティを与える」と語っていた。GeekWire報道。....
DeepSeek-V4-Pro-0813がSiliconFlowでDay-0公開。1Mコンテキスト、低/高/最大の3段階推論、コーディング・ツール呼び出し・エージェントに注力。MITライセンス維持。入力100万トークン1.32ドル、出力3.96ドル、キャッシュヒット0.44ドルでキャッシュコスト優位。....
ローカルに配置された大規模モデルは実際のビジネスにおいて十分な能力を示すとは限らない。AIは複雑な規則を正確に理解し、セキュリティの境界を守り、適切に外部ツールを呼び出す必要がある。このような課題に対応するため、アリババASystemチームはオープンソースコミュニティによって維持されているローカル後処理ツールキットであるARenoと協力し、百靈大モデルとともに軽量な後処理実践経路を開発し、モデルのビジネスでの適用能力を向上させた。
京东七鲜咖啡の初の24時間スマート化された无人カフェが8月16日に北京銀河ソホで開店する予定です。開店日には24時間ロボットによるコーヒー製造のライブ配信を開始し、ギネス記録を挑戦します。来店者にはロボット製のコーヒーを無料でプレゼントします。店舗は24時間フルオートマチックで運営され、コーヒー、スパークリングウォーター、紅茶、プロバイオティクスジュースなど、いつでも注文できます。
無料オンラインAIビデオおよび画像生成プラットフォーム。10以上のツール、プロ品質、完全な商業利用権
知漫劇はAIを活用して短編ドラマのシナリオ、キャラクター、コマ割り、ナレーション、ビデオを一括生成するフルプロセスのAI創作プラットフォームです。
AIネットワークプロキシによる効率的な自動化ワークフローをサポートする企業向けインフラストラクチャを提供します。
チャットで企業向けAIワークフローを構築でき、APIまたはMCPサーバーとしてデプロイ可能です。SOC 2基準に準拠しています。
Google
$0.49
入力トークン/百万
$2.1
出力トークン/百万
1k
コンテキスト長
Openai
$2.8
$11.2
$7.7
$30.8
200
-
Anthropic
$105
$525
$7
$35
$17.5
$21
$0.7
Alibaba
$1
$10
256
Baidu
128
$6
$24
$2
$20
$4
$16
$8
$240
52
Bytedance
$1.2
$3.6
4
bartowski
これはマイクロソフトFara-7Bモデルの量子化バージョンで、llama.cppのimatrix技術を使用して最適化されています。このモデルは、高精度のbf16から超低精度のIQ2_Mまで、さまざまな量子化レベルをサポートし、異なるハードウェア構成とパフォーマンス要件を満たします。
black-forest-labs
FLUX.2 [dev] は320億のパラメータを持つ補正フロートランスフォーマーモデルで、画像生成、編集、および合成タスクに特化しています。このモデルは、テキストから画像への生成、単一参照編集、および多参照編集においてリーディングレベルであり、微調整なしでキャラクター、オブジェクト、およびスタイルの参照を実現し、個人、科学、および商業用途をサポートします。
mradermacher
これはwexyyyyyy/Ru-Gemma3-1Bモデルの静的量子化バージョンで、ロシア語と英語をサポートし、対話とテキスト生成タスク用に特別に設計されています。このモデルは、さまざまなハードウェア構成とパフォーマンス要件に適した複数の量子化バージョンを提供します。
MaziyarPanahi
このプロジェクトでは、Qwen3-4B-Thinking-2507モデルのGGUF形式のファイルを提供しています。これは、思考過程推論能力を持つ4Bパラメータの大規模言語モデルで、複数の量子化バージョンをサポートし、さまざまなハードウェアでのデプロイと実行が容易です。
tlennon-ie
QwenEdit2509は、画像の色彩処理に特化した低ランク適応型(LoRA)モデルです。画像の飽和度を下げ、コントラストを低下させ、カメラのログプロファイルに似た扁平で未グレーディングの外観を作り出すと同時に、ハイライトとシャドウの細部を保持します。
これはVibeStudioのMiniMax-M2-THRIFTモデルを量子化したバージョンで、llama.cppツールと特定のデータセットを使用して生成され、複数の量子化タイプのGGUFファイルを提供し、LM Studioまたはllama.cppベースのプロジェクトでの実行をサポートします。
unsloth
MiniMax-M2は、コーディングとエージェントのワークフローを最大化するために構築された小型の混合専門家モデルで、総パラメータは2300億、活性化パラメータは100億です。このモデルは、コーディングとエージェントタスクで卓越した性能を発揮し、同時に強力な汎用知能を維持し、コンパクトで高速かつ経済的に効率的な特徴を持っています。
noctrex
Gelato-30B-A3Bは、GUIコンピュータ使用タスクに対して微調整された最先端(SOTA)モデルで、デプロイ効率を最適化するために量子化バージョンを提供しています。このモデルは、グラフィカルユーザーインターフェース関連のタスクを理解して処理するように特別に設計されています。
このプロジェクトは、Qwen3-Coder-30B-A3B-InstructモデルをMXFP4_MOE量子化した成果物で、コンテキストサイズを256kから1Mに拡張し、コード生成やプログラミングタスクに最適化されたモデルバージョンを提供し、パフォーマンスの向上とリソースの節約に価値があります。
JanusCoder-14Bは、Qwen3-14Bをベースに構築された14Bパラメータのオープンソース基礎モデルで、コードインテリジェンスに統一されたビジュアルプログラミングインターフェイスを構築することを目的としています。このモデルはJANUSCODE-800Kマルチモーダルコードコーパスで学習され、さまざまなビジュアルプログラミングタスクを統一的に処理することができます。
JanusCoder-8Bは、Qwen3-8Bをベースに構築されたオープンソースのコードインテリジェンス基礎モデルで、統一されたビジュアルプログラミングインターフェイスを構築することを目的としています。このモデルは、JANUSCODE-800K(これまでで最大のマルチモーダルコードコーパス)で学習され、データ可視化、インタラクティブなWeb UI、コード駆動のアニメーションなど、さまざまなビジュアルプログラミングタスクを処理できます。
Mungert
gpt-oss-safeguard-20bは、GPT-OSS-20bをファインチューニングした安全推論モデルで、大規模言語モデルの入出力フィルタリング、オンラインコンテンツのラベリング、および信頼と安全のユースケースのオフラインラベリングに特化しています。このモデルはApache 2.0ライセンスを採用しており、カスタムポリシーと透明な決定プロセスをサポートしています。
microsoft
Fara-7Bは、マイクロソフト研究所が開発した、コンピューターの使用シーン向けに設計された小型言語モデルで、たった70億のパラメータしか持たず、同規模のモデルの中で卓越した性能を発揮し、ウェブ自動化やマルチモーダル理解などのコンピューターインタラクションタスクを実行できます。
本プロジェクトでは、MiniMaxAIのMiniMax - M2モデルを量化処理し、llama.cppツールを使用して、様々なニーズを持つユーザーに複数の量化タイプのモデルファイルを提供し、異なるハードウェア条件下でのモデルの効率的な実行を容易にします。
これはinternlmのJanusCoder-14Bモデルの量化バージョンで、特定のツールとデータセットを使用して量化処理が行われ、低品質から高品質までの複数の量化タイプのファイルを提供し、LM Studioまたはllama.cppベースのプロジェクトで実行できます。
redponike
MiniMax - M2は、高効率コーディングとインテリジェントエージェントワークフロー用に特別に開発されたハイブリッドエキスパートモデルで、総パラメータが2300億、活性化パラメータが100億です。このモデルは、コーディングとインテリジェントエージェントタスクで卓越した性能を発揮し、低遅延、低コスト、高スループットの特徴を持ち、作業効率を効果的に向上させます。
GPT-OSS-Safeguard-20Bは、GPT-OSSをベースに構築された210億パラメータのセキュリティ推論モデルで、セキュリティ関連のテキストコンテンツの分類とフィルタリングタスクに特化して最適化されています。このモデルはカスタムセキュリティポリシーをサポートし、透明な推論プロセスを提供し、大規模言語モデルの入出力フィルタリングやオンラインコンテンツのラベリングなどのセキュリティユースケースに適しています。
bullerwins
MiniMax - M2は、コーディングとエージェントワークフローを最大化するために構築された小型のハイブリッドエキスパート(MoE)モデルです。総パラメータは2300億で、活性化されるパラメータは100億のみで、コーディングとエージェントタスクで卓越した性能を発揮し、同時に強力な汎用知能を保持し、コンパクトで高速かつ経済的です。
MiniMax-M2は、コーディングとエージェントのワークフローを最大化するために構築された「ミニ」モデルです。これはコンパクトで高速かつ費用対効果の高い混合専門家(MoE)モデルで、コーディングとエージェントタスクで卓越した性能を発揮し、同時に強力な汎用知能も備えています。
LeviDeHaan
SecIntは、リアルタイムのnginxセキュリティログ分類に対して微調整されたSmolLM2-360Mモデルです。Webサーバーログ内のセキュリティ脅威、エラー、および正常なトラフィックパターンを自動的に検出することを目的としており、精度は99%を超え、CPU上でリアルタイム検出を実現できます。
Einoは、Golang用に設計されたLLMアプリケーション開発フレームワークで、シンプルで拡張可能で信頼性が高く効率的なコンポーネント抽象化と編成機能により、AIアプリケーションの開発プロセスを簡素化することを目的としています。豊富なコンポーネントライブラリ、強力なグラフ編成機能、完全なストリーム処理サポート、および高度に拡張可能なアスペクトメカニズムを提供し、開発からデプロイまでの全サイクルのツールチェーンを網羅しています。
MCP GoはGo言語で実装されたモデルコンテキストプロトコル(MCP)サーバーフレームワークで、LLMアプリケーションと外部データソースやツールを接続するために使用されます。リソース管理、ツール呼び出し、プロンプトテンプレートなどの核心機能を提供し、セッション管理とミドルウェア拡張をサポートしています。
wcgwはMCPサーバープロジェクトで、シェルとコードエディターツールが統合されており、AIがローカルマシン上でコマンドを実行し、ファイルを読み書きし、コードを編集するなどの操作ができます。アーキテクトモード、コード作成モードなどの複数のモードを提供し、タスクチェックポイント保存、ターミナル対話、構文チェックなどの機能をサポートしており、コード開発、問題解決などのシーンに適しています。
これは、ブラウザ制御、芸術と文化、クラウドプラットフォーム、コマンドライン、通信、顧客データプラットフォーム、データベース、開発者ツール、データサイエンスツール、ファイルシステム、金融とフィンテック、ゲーム、知識と記憶、位置サービス、マーケティング、監視、検索、ユーティリティツールなど、複数のカテゴリをカバーする、継続的に更新されるMCPサーバーの選りすぐりのリストです。各プロジェクトにはGitHubリンクとスター数が付属しており、ユーザーがすぐに理解して使用できるようになっています。
MCPプロトコルに基づくKubernetesクラスター管理サーバーで、コマンドラインまたはチャットインターフェイスを通じてKubernetesクラスターとやり取りでき、リソース管理、Helmチャート操作などの機能を提供します。
このプロジェクトは、ObsidianのLocal REST APIプラグインを通じてObsidianノートアプリとやり取りするMCPサーバーです。Obsidian内のファイルを操作および管理するためのさまざまなツールを提供し、ファイルのリスト表示、内容の取得、検索、内容の変更、ファイルの削除などが可能です。
Klavis AIはオープンソースプロジェクトで、Slack、Discord、Webプラットフォームで簡単に使えるMCP(モデルコンテキストプロトコル)サービスを提供します。レポート生成、YouTubeツール、ドキュメント変換などのさまざまな機能があり、非技術ユーザーと開発者がAIワークフローを使用するのをサポートします。
Haiku RAGは、LanceDB、Pydantic AI、Doclingを基盤とした高度な検索強化生成システムです。ハイブリッド検索、再ランキング、質問応答エージェント、多エージェント研究プロセスをサポートし、ローカルファーストのドキュメント処理とMCPサーバー統合を提供します。
セレナは強力なオープンソースのコーディングエージェントツールキットで、大規模言語モデル(LLM)をコードベース上で直接動作するフル機能のエージェントに変えることができます。IDEに似た意味論的なコード検索と編集ツールを提供し、様々なプログラミング言語をサポートし、MCPプロトコルまたはAgnoフレームワークを介して様々なLLMと統合することができます。
mcpoは使いやすいプロキシツールで、任意のMCPツールをOpenAPI互換のHTTPサーバーに迅速に変換し、標準的なRESTfulインターフェースでアクセスできるようにし、LLMプロキシやアプリケーションとの統合を容易にします。
Zen MCPは多モデルAI協調開発サーバーで、ClaudeやGemini CLIなどのAIコーディングアシスタントに強化されたワークフローツールとモデル間のコンテキスト管理を提供します。これは複数のAIモデルのシームレスな協調をサポートし、コードレビュー、デバッグ、リファクタリングなどの開発タスクを実現し、異なるワークフロー間で会話のコンテキストを維持することができます。
MCP - Frameworkは、TypeScriptに基づくフレームワークで、モデルコンテキストプロトコル(MCP)サーバーをエレガントに構築するために使用されます。すぐに使えるアーキテクチャを提供し、自動ディレクトリ発見ツール、リソース、およびプロンプトをサポートし、複数の伝送方式と型安全な特性を備えています。
ソロンは、高効率、オープン、エコシステムにやさしいJavaのエンタープライズアプリケーション開発フレームワークで、全シナリオの開発に対応し、高性能、低メモリ消費、高速起動、小さなパッケージサイズなどの特徴があり、Java8からJava24まで、およびGraalVMネイティブランタイムと互換性があります。
codemcpはClaude Desktopをペアプログラミングアシスタントに変えるツールで、ユーザーがClaudeに直接ローカルコードベース上で機能の実装、エラーの修正、コードのリファクタリングを行わせることができます。
エージェンティックレーダーは、エージェントシステムを分析・評価するセキュリティスキャナーで、開発者、研究者、セキュリティ専門家がエージェントシステムのワークフローを理解し、潜在的なホールを特定するのに役立ちます。
FastMCPは、TypeScriptに基づくフレームワークで、クライアントセッションをサポートするMCPサーバーを構築するために使用されます。ツール、リソース、プロンプトの簡単な定義を提供し、認証、セッション管理、画像と音声コンテンツの返却、ログ記録、エラー処理、SSE通信などの機能をサポートし、テストとデバッグ用のCLIツールも含まれています。
Cogneeは、AIエージェントに記憶機能を提供するオープンソースプロジェクトです。モジュール化されたECLパイプラインを通じて動的な知識グラフを構築し、複数のデータソースと形式をサポートし、幻覚を減らし、コストを削減します。
DeeboはAIデバッグアシスタントで、自動調査とマルチスレッドワークフローにより、コードエラーの解決プロセスを加速し、開発効率を向上させます。
Cipherは、プログラミングAIエージェント向けに設計されたオープンソースのメモリ層フレームワークです。MCPプロトコルを通じてさまざまなIDEとAIコーディングアシスタントと統合し、自動記憶生成、チーム記憶共有、デュアルシステム記憶管理などの核心機能を提供します。
OpenSumiは、AIネイティブのIDE製品を迅速に構築するのに役立つフレームワークで、クラウドとデスクトップの開発環境をサポートし、豊富なサンプルプロジェクトとテンプレートを提供します。