M
新モデル
0 updates
RELEASE
Mistral AI、数学証明特化モデル「Leanstral 1.5」公開
Mistral Small 4ベースの数学証明・コード検証特化モデル。証明支援システム「Lean 4」に最適化されたAIコードエージェントで、Putnam Benchにて過去最高スコアを記録。
▸ 数学・コード検証ユースケースでの評価を検討
source ↗Mistral Small 4ベースの数学証明・コード検証特化モデル。証明支援システム「Lean 4」に最適化されたAIコードエージェントで、Putnam Benchにて過去最高スコアを記録。
▸ 数学・コード検証ユースケースでの評価を検討
source ↗Z.aiのGLM 5.2がOpenRouterで値下げ。プロンプト: $0.93 → $0.77/1Mトークン (-17.2%)、補完: $3.00 → $2.42/1Mトークン (-19.33%)。コンテキスト長1Mトークンは変わらず。
▸ GLM 5.2利用中のユーザーはコスト試算を更新
source ↗実行環境フィードバックを受けるAIエージェントの学習効率が3カ月ごとに2倍上昇するという新スケーリング則を提示。最大72時間の高難度タスクを対象とするオープンソースベンチマーク「EdgeBench」も同時公開。
▸ 長時間エージェントタスク評価にEdgeBenchを確認
source ↗トランプ大統領がCNBCインタビューで「ガードレールは必要だが介入はできるだけ少なく」と発言。中国との開発競争で「大幅なリード」を強調した。
source ↗快手(クアイショウ)の動画生成サービスKling AIが、アリババ・テンセント・バイドゥ等から28億ドルの資金調達を発表。評価額は180億ドルで、今後30億ドルまで追加調達の可能性あり。香港IPOも検討中。
source ↗