フランスのISCビジネススクールの研究は『応用認知心理学』に掲載され、45名の18歳から25歳で頻繁にChatGPTを使用する若者を対象に行った調査で、即座に答えを得る習慣がある一部の人々が、独立した思考能力が明らかに低下していることが分かった。これは学習や仕事、そして情緒的な生活にも影響を与えている。
通義千問がアップグレード、「思考研究」「タイマー機能」「オフィスアシスタント」の3機能を追加。フラッグシップモデルQwen3.8-MAXを全面サポートし、対話型から自律実行型へ進化。複雑な意思決定と定型業務の効率化を実現し、特に「思考研究」モードでビジネス生産性が向上。....
元OpenAI CTOミラ・ムラティ氏が「思考機械研究所」を設立し、初のマルチモーダルAI「Inkling」を公開。高性能で米国オープンソースAI分野の最有力候補と目される。創業チームは豪華で、中核メンバーの約3分の2がOpenAI出身。....
Google研究チームがVantage手法を発表。大規模言語モデルでチームの相互作用を模倣し、従来のテストでは評価が難しい協働、創造性、批判的思考などの「持続的スキル」を測定。教育分野における有効な評価ツール不足を補う。....
小型言語モデルが自己進化と深層思考を通じて数学的推論能力を習得する研究成果を示します。
新たな思考媒体を探求し、人間の想像力を広げる独立系研究ラボ
Anthropic
$105
入力トークン/百万
$525
出力トークン/百万
200
コンテキスト長
$21
Alibaba
$1
$10
256
$2
$20
-
Moonshot
$4
$16
Bytedance
$0.8
$0.15
$1.5
Baidu
32
$54
$163
1k
Deepseek
$12
128
$8
Tencent
Openai
$0.4
$0.75
$15
$0.63
$3.15
131
prithivMLmods
Olmo-3-Thinkはアレン人工知能研究所が発表した完全にオープンソースの言語モデルシリーズで、7Bと32Bの2種類の規模があります。このモデルは特別に訓練され、明確な推論過程を示すことができ、透明な段階的な推論と検証可能な中間思考痕跡をサポートし、推論、数学、コードタスクで優れた性能を発揮します。
allenai
Olmo-3-7B-Think-DPOはAllen Institute for AIが開発した70億パラメータの言語モデルで、長い連鎖的な思考能力を持ち、数学やコーディングなどの推論タスクで優れた性能を発揮します。このモデルは、教師付き微調整、直接的な嗜好最適化、検証可能な報酬に基づく強化学習などの多段階の訓練を経ており、研究や教育目的に特化して設計されています。
ojus1
Qwen2.5はアリババが開発した次世代の大規模言語モデルで、チャットテンプレートに重要な最適化を施し、思考状態を恒久的に無効化し、多輪チャットテンプレートに関する問題を解決し、実験や研究により便利な体験を提供します。
Hume-vla
Hume-Libero_Objectは、Libero-Objectデータセットで訓練されたデュアルシステム視覚-言語-動作モデルで、システム2の思考能力を備え、ロボット分野の研究と応用に適しています。
Think MCPはMCPサーバーを実装するプロジェクトで、AIエージェントが複雑なタスクで構造化された推論を行うための「think」ツールを提供します。このツールは、Anthropicの研究に触発されています。このツールは、思考過程を記録することで、AIが情報を処理し、遡及し、またはポリシーを遵守するのを支援し、ツール出力の分析、ポリシーが密集した環境、および逐次的な決定シナリオに適しています。
MCPサーバーMAS逐次思考は、逐次思考プロセスを強化することに特化したサーバー環境プロジェクトで、モジュール化設計、拡張性、多言語サポートを提供し、教育、研究、アプリケーション開発に適しています。