AAI News Hub

模型

40 条简报

模型

GLM-5.3 基准测试引发开发者讨论

Artificial Analysis 关于 GLM-5.3 的基准测试在 Hacker News 和 r/LocalLLaMA 上流传。

Hacker News+1 家媒体·1d ago
模型

Qwen3.8 27B 在 Artificial Analysis 上获得 52 分

Reddit 和 Hacker News 用户注意到该模型在 Artificial Analysis 上的表现及其智能体排名。

r/LocalLLaMA+1 家媒体·2d ago
模型

《Your AI Slop Bores Me》让真人扮演聊天机器人

这款网页游戏让用户手动回答提示词,通过扮演 AI 一方来赚取积分。

The Verge AI·4d ago
模型

Google 发布 Gemini 3.7 Flash

这款新的 Flash 模型面向编码、智能体和工作流自动化,并提供入门优惠价格。

Hacker News+9 家媒体·5d ago
模型

Meta 发布开源权重 AI 模型 Glimmer

该模型可下载并在本地运行,而 Meta 仍将 Muse Spark 保留在 API 之后。

TechCrunch AI·5d ago
模型

Meta 发布开放权重模型 Glimmer

Meta 在发布 Glimmer 的同时,配合 Zuckerberg 关于 AI 应该“属于每个人”的论述。

TechCrunch AI·5d ago
模型

Mistral 文档列出 GLM-5.2 和 OCR 4.1

社区帖子指出,Mistral 文档中出现了 Z.ai 的 GLM-5.2 和 Mistral OCR 4.1。

r/LocalLLaMA+1 家媒体·5d ago
模型

AI 文本水印再受关注

新的解读文章梳理了模型文本标记的工作方式,以及改写为何会削弱这些标记。

r/LocalLLaMA+10 家媒体·6d ago
模型

Hugging Face 称开源模型使用重心转向 Qwen

Hub 报告称,Qwen 衍生模型、小模型和智能体流量塑造了 2026 年的开放 AI 格局。

Hugging Face·6d ago
模型

Writer 推出新 AI 模型,旨在降低 token 成本

该公司表示,其基于 GLM-5.2 的系统面向更低成本的部署。

TechCrunch AI·6d ago
模型

OpenAI 预览 GPT-5.6 Sol 的 Ultrafast 模式

该模式宣称可让企业用户使用的 GPT-5.6 Sol 运行速度提升至 14 倍。

TechCrunch AI+1 家媒体·6d ago
模型

OpenAI 发布 GPT-5.6 开发者指南

这份指南介绍了创业公司如何将 GPT-5.6 用于 AI agents、模型选择以及 Responses API。

OpenAI·6d ago
模型

Grok 4.6 在 Artificial Analysis 指数中得分 61

Hacker News 上的链接指向 xAI 的 Grok 4.6 发布页面和早期基准分析。

Hacker News+1 家媒体·Aug 13
模型

Google DeepMind 推出手语转文本模型

DeepMind 的 SL2T 为面向失聪和听障用户的新手语功能提供支持。

Google DeepMind+1 家媒体·Aug 12
模型

LiquidAI 在 Hugging Face 发布 LFM2.5-VL-3B

这款 3B 级多模态模型面向边缘端视觉任务,支持文本、图像、OCR 和 grounding。

Hugging Face+1 家媒体·Aug 12
模型

本地测试者将 Muse Glimmer 30B 与 Qwen 对比跑分

r/LocalLLaMA 早期报告显示,Muse Glimmer 30B 在代码任务上表现参差不齐,但 token 使用效率较高。

r/LocalLLaMA+1 家媒体·Aug 12
模型

Google 的 Gemini 应用用户数达到 10 亿

Gemini 应用用户数已达到 10 亿,跟上了 ChatGPT 在 6 月创下的里程碑。

TechCrunch AI+6 家媒体·Aug 12
模型

OpenAI 推出新的网络安全训练 AI 模型

该公司正通过一款新模型扩展其 Daybreak 网络安全防御项目。

TechCrunch AI·Aug 11
模型

Meta 围绕开放权重模型重启 AI 战略

Meta 发布了 Muse Glimmer,并计划在未来几周开放 Muse Spark 1.2 的权重。

Ars Technica AI+1 家媒体·Aug 11
模型

Meta 发布 Muse Glimmer,面向本地智能体工作流

这款 30B 开放权重模型面向端侧智能体,支持多模态输入和 4-bit 量化。

r/LocalLLaMA+2 家媒体·Aug 11
模型

Meta 阐述个人 AI 愿景,并推出 Glimmer 模型

在 Meta 发布开放权重的 Muse Glimmer 模型之际,Zuckerberg 发表了一篇宣言。

TechCrunch AI·Aug 11
模型

Cactus 发布面向边缘设备的 Needle 2

这款 14MB 的智能体 LLM 面向手机、可穿戴设备和机器人上的工具使用与结构化提取场景。

Hacker News+1 家媒体·Aug 11
模型

消息源呈现了不同的 AI 议题

所提供的报道分别涉及 Meta 开放模型,以及 AI 会议录音暴露问题。

Hacker News+3 家媒体·Aug 10
模型

Meta 开放 Muse Glimmer 权重,可用于本地编程

这款 30B 端侧智能体多模态模型,已经吸引 llama.cpp 社区展开适配工作。

r/LocalLLaMA+2 家媒体·Aug 10
模型

Meta 开源端侧模型 Muse Glimmer

这款本地、智能体式多模态模型已发布,Muse Spark 1.2 预计也将很快到来。

r/LocalLLaMA+2 家媒体·Aug 10
模型

OpenAI 因安全担忧放缓 Astra 相关工作

评估显示其具备网络安全能力后,公司暂停了部分内部工作。

TechCrunch AI+1 家媒体·Aug 8
模型

OpenAI 因安全担忧放缓 Astra 研发

该公司表示,出于网络安全方面的担忧,已暂停 Astra 的部分开发工作。

TechCrunch AI·Aug 8
模型

OpenAI 因网络安全防护暂停 Astra 相关工作

OpenAI 表示,Astra 在初步评估中展现出先进的编程和网络安全能力。

The Verge AI+2 家媒体·Aug 8
模型

ByteDance 正在训练或达 10 万亿参数的 AI 模型

据 Ars Technica 报道,这一早期阶段模型的规模将远超 Moonshot 的 Kimi K3。

Ars Technica AI+1 家媒体·Aug 7
模型

Anthropic 称其改进了 Fable 5 的生物学安全防护

该公司宣布推进 Fable 5 生物学相关安全防护工作。

Anthropic·Aug 7
模型

Qwen 3.8 Max 领跑 Artificial Analysis 智能体指数

Reddit 和 Hacker News 上的帖子显示,Qwen 3.8 Max 在智能体基准测试中排名第一。

r/LocalLLaMA+1 家媒体·Aug 7
模型

SaferAI 称 GLM-5.2 已接近前沿能力

报告称,Z.ai 的开源权重模型发展速度正快于关键安全缓解措施的推进。

TechCrunch AI·Aug 5
模型

LG AI Research 发布 K-EXAONE 2.0 报告

这款开放权重的多语言 MoE 模型总参数量达 750B,支持 256K token 上下文。

HF Daily Papers+1 家媒体·Aug 5
模型

Mistral 发布面向多模态审核的 Shieldstral

这款 3B 开放权重安全分类器可依据自然语言策略评估文本和图像。

r/LocalLLaMA+1 家媒体·Aug 5
模型

LiquidAI 在 Hugging Face 发布 LFM2.5-2.6B

这篇 Hugging Face 文章将 LFM2.5-2.6B 定位为面向本地智能体部署的模型。

Hugging Face·Aug 4
模型

Alibaba 发布 Qwen3.8-Max AI 模型

这家中国科技巨头称,其最新 Qwen 模型是迄今规模最大、能力最强的一款。

The Verge AI·Aug 3
模型

Z.ai 发布面向网络安全的开放权重 GLM-5.2

研究人员称,这款中国模型在部分漏洞发现和网络安全场景中可比肩 Mythos。

The Verge AI+1 家媒体·Jun 29
模型

Margaret Atwood 批评 Claude 给出错误回答

这位作家表示,她只用过一次 Anthropic 的聊天机器人,就发现其回答并不可靠。

The Verge AI·Jun 28
模型

OpenAI 推出 GPT-5.6 限量预览版

新的 GPT-5.6 系列包含 Sol、Terra 和 Luna 三款模型,面向编程、安全和智能体任务。

The Verge AI·Jun 27