モデル
40 件
GLM-5.3のベンチマークが開発者の議論を呼ぶ
Artificial AnalysisによるGLM-5.3のベンチマークが、Hacker Newsとr/LocalLLaMAで共有された。
Qwen3.8 27B、Artificial Analysisで52点を記録
RedditとHacker Newsのユーザーが、このモデルのArtificial Analysisでの結果とエージェント性能ランキングに注目した。
「Your AI Slop Bores Me」は人間にチャットボット役を演じさせる
このWebゲームでは、ユーザーが手作業でプロンプトに答え、AI側を演じることでクレジットを獲得する。
Google、Gemini 3.7 Flashを発表
新しいFlashモデルは、コーディング、エージェント、ワークフロー自動化を対象に、導入価格で提供される。
Meta、オープンウェイトのAIモデル「Glimmer」を公開
このモデルはダウンロードしてローカルで実行できる一方、Metaは「Muse Spark」をAPI経由に限定している。
Meta、オープンウェイトのGlimmerモデルを公開
MetaはGlimmerの公開に合わせ、AIは「すべての人のため」のものであるべきだというZuckerbergの主張を打ち出した。
MistralのドキュメントにGLM-5.2とOCR 4.1が掲載
コミュニティ投稿が、Z.aiのGLM-5.2とMistral OCR 4.1に関するMistralのドキュメントを指摘した。
AIテキストのウォーターマークに改めて注目
新たな解説記事が、モデル生成テキストの痕跡がどう機能し、なぜ書き換えで弱まるのかを検証。
Hugging Face、オープンモデル利用がQwen寄りにシフトと報告
Hubレポートによると、2026年のオープンAIはQwen派生モデル、小規模モデル、エージェント由来トラフィックによって形づくられた。
Writer、トークンコスト削減を狙う新AIモデルを発表
同社は、GLM-5.2ベースのシステムを低コストでのデプロイに向けて設計したとしている。
OpenAI、GPT-5.6 Sol向け「Ultrafast」モードをプレビュー公開
企業ユーザー向けに、GPT-5.6 Solを14倍高速化するとうたうモード。
OpenAI、GPT-5.6向け開発者ガイドを公開
このガイドは、スタートアップがGPT-5.6をAIエージェントに活用する方法、モデル選定、Responses APIを解説している。
Grok 4.6、Artificial Analysisの指数で61点を記録
Hacker News上のリンクが、xAIによるGrok 4.6の公開と初期ベンチマーク分析を示している。
Google DeepMind、手話テキスト化モデルを発表
DeepMindのSL2Tが、ろう者や難聴者向けの新たな手話機能を支える。
LiquidAI、LFM2.5-VL-3BをHugging Faceで公開
3Bクラスのマルチモーダルモデルは、テキスト、画像、OCR、グラウンディングに対応し、エッジ環境での視覚タスクを狙う。
ローカルテスター、Muse Glimmer 30BをQwenと比較ベンチマーク
r/LocalLLaMAの初期報告では、Muse Glimmer 30Bのコーディング性能は評価が分かれる一方、トークン効率の高さが示された。
GoogleのGeminiアプリ、ユーザー数10億人に到達
Geminiアプリのユーザー数が10億人に達し、6月に同じ節目を迎えたChatGPTに並ぶ勢いを示している。
OpenAI、サイバー分野向けに訓練した新AIモデルを発表
同社はサイバーセキュリティ防御プログラム「Daybreak」を、新モデルで拡充する。
Meta、オープンウェイトモデル軸にAI戦略を再始動
MetaはMuse Glimmerを発表し、今後数週間以内にMuse Spark 1.2のウェイトを公開する計画を明らかにした。
Meta、ローカルエージェント向けワークフロー用にMuse Glimmerを公開
30Bのオープンウェイトモデルは、マルチモーダル入力と4ビット量子化に対応し、オンデバイスのエージェント利用を狙う。
Meta、GlimmerモデルとともにパーソナルAI構想を提示
Zuckerbergがマニフェストを公開し、MetaはオープンウェイトのMuse Glimmerモデルをリリースした。
Cactus、エッジデバイス向けにNeedle 2をリリース
14MBのエージェント型LLMで、スマートフォン、ウェアラブル、ロボット上でのツール利用と構造化抽出を狙う。
異なるAIニュースを伝える複数の情報源
提供された報道は、Metaのオープンモデルと、AI会議録音の流出を扱っている。
Meta、ローカルコーディング向けにMuse Glimmerの重みを公開
オンデバイスで動作する30Bのエージェント型マルチモーダルモデルに、早くもllama.cpp対応の動きが出ている。
Meta、オンデバイス向けMuse Glimmerをオープンソース化
ローカルで動作するエージェント型マルチモーダルモデルが登場。Muse Spark 1.2も近く公開される見通し。
OpenAI、セキュリティ懸念でAstraの開発作業を一部減速
同社は、評価でサイバーセキュリティ能力が指摘されたことを受け、一部の社内作業を停止した。
OpenAI、セキュリティ懸念でAstraの開発を減速
同社は、サイバーセキュリティ上の懸念からAstraの一部開発を停止したと明らかにした。
OpenAI、サイバー安全対策を理由にAstraの作業を一時停止
OpenAIは、予備評価でAstraが高度なコーディング能力とサイバーセキュリティ能力を示したと明らかにした。
ByteDance、10兆パラメータ規模に達する可能性のあるAIモデルを訓練
Ars Technicaによると、初期段階のこのモデルはMoonshotのKimi K3を大きく上回る規模になる見通しだ。
Anthropic、Fable 5の生物学関連セーフガードを改善したと発表
同社は、Fable 5における生物学関連のセーフガードに関する取り組みを発表した。
Qwen 3.8 Max、Artificial Analysisのエージェント性能指標で首位に
RedditとHacker Newsの投稿が、エージェント性能ベンチマークでQwen 3.8 Maxがトップに立ったことを伝えた。
SaferAI、Z.aiのGLM-5.2に安全性の課題を指摘
報告書は、オープンウェイトモデルが主要な安全対策を欠いたままフロンティア級の能力に近づいていると指摘している。
LG AI Research、K-EXAONE 2.0のレポートを公開
オープンウェイトの多言語MoEモデルは総パラメータ数750Bで、256Kトークンのコンテキストに対応する。
Mistral、マルチモーダルモデレーション向けShieldstralを発表
3Bのオープンウェイトモデルで、マルチモーダルコンテンツのモデレーションを対象とする。
Liquid AI、ローカルエージェント向けにLFM2.5-2.6Bを公開
26億パラメータのモデルは、オンデバイスでのツール利用、ワークフロー、プライベートなローカル推論を想定している。
Alibaba、AIモデル「Qwen3.8-Max」をリリース
Alibabaは、最新のQwenモデルが同社史上最大かつ最も高性能だとしている。

Z.ai、サイバーセキュリティ向けにオープンウェイトのGLM-5.2を公開
研究者らは、中国発のこのモデルが一部のバグ発見やサイバーセキュリティのシナリオでMythosに匹敵するとしている。
Margaret Atwood、誤回答をめぐりClaudeを批判
作家のAtwood氏は、Anthropicのチャットボットを一度だけ使い、その回答は信頼できないと感じたと語った。
OpenAI、GPT-5.6の限定プレビューを公開
新たなGPT-5.6スイートは、コーディング、セキュリティ、エージェント型タスク向けにSol、Terra、Lunaの各モデルをそろえる。