大模型动态
浏览本站已发表的人工智能栏目报道,对照模型榜与厂商信息。
Google 发布 Gemini 3.8 Live 双模型,扩展实时语音与多模态理解
Google 于9月15日推出 Gemini 3.8 Live 与 Extended Thinking,扩展实时语音、多模态理解和生成音频水印能力。
OpenAI 称 Perplexity 将 GPT-6 Astra 用于生产系统监测与端到端测试
OpenAI 9月14日披露,Perplexity正以 GPT-6 Astra 支持生产系统监测、软件变更和端到端测试。
OpenAI 推出金融服务版 ChatGPT,GPT-6 Astra进入带数据与引文的工作流
OpenAI称,面向金融机构的ChatGPT工作区已内置GPT-6 Astra、金融数据及引文追溯能力。
Cognition称将 GPT-6 Astra用于 Devin 测试环节,模型输出增加可审查证据
Cognition披露,Devin正使用GPT-6 Astra执行软件测试,并返回运行记录与未覆盖项说明。
Kimi K2.8 Preview 全量接入 Kimi Code,沿用原模型 ID 开放百万上下文
月之暗面于9月11日将 Kimi K2.8 Preview 全量上线 Kimi Code,既有 kimi-for-coding 调用无需改配,可选三档思考强度并支持最高百万 token 上下文。
DeepSeek 发布 V4.1 Flash:原生多模态模型上线 API,并开放权重
DeepSeek 于9月10日发布 V4.1 Flash。该模型上线 API、支持原生多模态输入,并在官方模型页提供开放权重。
OpenAI 推出 Agents API,GPT-6 Astra 获托管智能体部署入口
OpenAI 于9月10日宣布 Agents API 进入公开测试;官方示例显示 GPT-6 Astra 可作为智能体模型接入托管环境与工具链。
GPT-6 Astra在Amazon Bedrock正式可用,新增托管调用与跨区域推理入口
AWS宣布GPT-6 Astra于9月8日在Amazon Bedrock正式可用,开放托管API、跨区域推理标识与明确的上下文及服务层级信息。
OpenAI披露 GPT-5.6 Sol 进入量子芯片测量流程
OpenAI称,MIT研究团队已将GPT-5.6 Sol接入量子芯片例行测量软件,用于结果分析与后续测量决策。
Google 将 Lyria 3.5 接入 Gemini API,音乐生成模型扩大分发入口
Google于9月4日宣布,音乐生成模型Lyria 3.5已进入Gemini应用和Gemini API,并可通过AI Studio、Flow Music与Google Vids使用。
IFM发布 K2 Horizon 六款开放模型,权重与训练资料同步公开
IFM于9月3日发布K2 Horizon模型系列,涵盖0.9B至375B-A23B六个规格,并称同步开放权重、代码、训练数据和方法资料。
OpenAI 发布 GPT-6 Astra,模型服务将覆盖 API 与多云渠道
OpenAI 于9月3日发布 GPT-6 Astra,并计划向 API、Azure 与 AWS Bedrock 提供服务。
OpenAI 推出 ChatGPT Images 2.5,API 增加 Flare 与 Sunburst 两个模型
OpenAI 于9月8日推出 ChatGPT Images 2.5,并在 API 中发布 GPT-Image-2.5 Flare 和 Sunburst。
Google 推出 Gemini 3.8 Flash,公布入门价格并提供受限网络安全版本
Google 于9月2日发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,前者维持此前的入门定价。
腾讯混元 Hy4 preview开源:百万上下文模型进入生产力工具链
腾讯发布并开放混元 Hy4 preview 权重,模型采用混合专家架构,支持超过100万 token 上下文,并已接入多款办公与开发产品。
Meta开源Muse Glimmer:本地智能体开始争夺开发者部署入口
Meta发布30B参数开源模型Muse Glimmer,面向本地智能体工作流,支持多模态输入和工具调用。
DeepSeek上线视觉理解实验模型,API补齐图文输入与文件接口
DeepSeek上线V4-Flash-Vision-Exp实验模型,新增视觉理解能力并支持图文混合输入与Files API。
Anthropic年化营收据报超过650亿美元,企业模型服务扩张提速
Axios援引Bloomberg所见文件称,Anthropic在7月底的年化营收运行率超过650亿美元。公司此前披露将扩充算力并扩大产品与合作伙伴关系,模型服务的企业采购和交付能力成为产业链关注重点。
DeepSeek V4 Flash开放调用,模型服务比较转向上下文与接口兼容性
DeepSeek公开资料显示,V4 Flash作为V4系列的一部分已开放API调用,支持100万上下文以及OpenAI和Anthropic兼容接口。
OpenAI与Hugging Face披露安全事件时间线,评估环境治理进入焦点
OpenAI与Hugging Face披露模型评估期间的安全事件及技术时间线。两家公司公开的处置和调查安排,使智能体权限、隔离与安全响应成为开发平台的重要议题。
Netflix披露内部大模型推理服务:把 vLLM 接入既有模型平台
Netflix 技术团队披露内部大模型推理服务的架构选择:保留既有模型服务入口,并以 Triton、vLLM 和双接口承接不同推理工作负载。
昇腾适配dots3-note preview:开源模型部署多了一条国产算力路径
小红书发布dots3-note preview后,华为宣布昇腾Atlas 800 A3和Atlas 900 A3 SuperPoD完成适配,并提供vLLM Ascend部署支持。
千问办公新增第三方模型选项,办公AI入口扩展模型编排
千问办公新增 GLM-5.3 与 DeepSeek V4 Pro 模型选项。本文梳理办公产品聚合模型服务及其产业传导。
Anthropic传出高估值上市预期,模型公司商业化叙事转向收入与算力
媒体援引投资者称Anthropic可能以约2万亿美元估值推进潜在上市。公司尚未确认相关安排,市场关注点回到企业收入和算力投入。
英伟达推出Nemotron 3.5 Lightning与NeMo Switchyard,补齐智能体模型路由工具
英伟达发布Nemotron 3.5 Lightning及NeMo Switchyard,面向从边缘到云端的智能体AI工作流。本文梳理已披露的产品定位及产业影响。
Anthropic公开风险报告:把Claude部署治理写进制度流程
Anthropic更新负责任扩展政策,并公布Claude Opus 4.6相关风险报告的公开版本。本文梳理其披露范围与产业传导。
Anthropic推进上市前交易:算力优化成为模型公司扩张变量
Axios报道称Anthropic正推进上市前交易活动,并就收购Decart进行洽谈。本文梳理已披露信息及其对AI基础设施软件的传导。
至知研究院提出从权重切入的大模型可解释性路线
至知研究院提出从模型权重切入的大模型可解释性研究路线,模型评估工具获得新的研究方向。
QQ Bot 接入 DeepSeek Harness,扩展单聊与群聊工具入口
QQ Bot 宣布接入 DeepSeek Harness 与官方插件,支持单聊和群聊场景。本文梳理已披露的产品边界及其对应用软件的产业传导。
Anthropic二季度营收超过115亿美元,模型服务商业化进入新量级
公开报道将Anthropic二季度营收描述为超过115亿美元、同比增幅超过14倍;这一变化把企业级模型服务的收入规模与基础设施投入同时推到台前。
智谱发布 GLM-5.3,强调编程与网络安全能力
智谱发布 GLM-5.3 模型,聚焦编程与网络安全相关能力,开发工具市场迎来新的模型供给。
阿里开源 Qwen3.8-27B:开放权重模型进入编程与办公场景
阿里开源 Qwen3.8-27B 模型。本文梳理已披露的许可、模型定位与部署选择,并分析对应用软件和阿里巴巴的经营传导。
DeepSeek推出Harness开发者预览版,智能体运行层走向插件化
DeepSeek发布Harness开发者预览版,采用模型、工具和智能体循环可替换组合的插件化结构。公开信息显示,该产品仍处开发者预览阶段。
AI服务商把成本衡量转向完成任务:OpenAI与Anthropic披露相关方法
OpenAI以成功任务成本讨论模型效率,Anthropic以任务和职业维度追踪计算成本;企业评估AI支出正从单纯单价转向任务结果。
OpenAI 调整 GPT-5.6 价格性能组合,Sol Fast mode 提供更快处理
OpenAI 更新 GPT-5.6 的 API 服务组合:Sol Fast mode 最高可达标准处理2.5倍速度,Terra 与 Luna 同步调整定价。本文梳理这一分层服务动作及其行业传导。
谷歌推出 Gemini 3.7 Flash:限时价格下调,开发者调用成本成为焦点
谷歌推出 Gemini 3.7 Flash,并给出年末前的限时调用价格。本文梳理模型发布与定价事实,并分析其对AI应用和云服务的经营传导。
Meta 推出 Muse Glimmer,本地运行开源模型进入分发环节
Meta 发布开源模型 Muse Glimmer,可在个人电脑运行,本地推理与开发者分发成为关注点。
WeLM进入公众视野,腾讯微信AI能力布局受关注
公开报道将WeLM称为微信大模型。本文在已保存材料的事实边界内,梳理该名称进入公众视野后对腾讯既有产品与服务布局的关注。
Qwen3.8-2.4T模型引发关注,超大模型部署成本成为焦点
围绕Qwen3.8-2.4T的公开信息显示,超大模型的能力迭代将继续拉动云端推理、模型服务和基础设施配置需求。
VS Code 1.133支持Claude会话跨模型提供商切换
VS Code 1.133允许Claude会话在Anthropic与Copilot模型之间逐轮切换,并试验无需GitHub登录的Agents窗口,同时改进长对话和本地网页预览。
Anthropic为Claude新模型加入机器可读水印,文本检测不等于作者鉴定
Anthropic将为Claude新模型输出加入机器可读标记:文本采用不可见水印,文件使用签名元数据。这项安排与欧盟透明度要求相衔接,并扩展至Claude其他服务地区,但检测结果不能单独证明作品由AI原创。
SpaceXAI推出Grok 4.6,API以每百万输入2美元起价
SpaceXAI发布Grok 4.6并开放API,基础价格为每百万输入Token 2美元、输出Token 6美元,模型同时进入OpenRouter、Vercel和Cloudflare。
Apple Intelligence获准在中国推进,通义千问将接入苹果系统
Apple Intelligence在中国市场取得监管进展,苹果将接入阿里通义千问,本地服务与具体上线范围仍待官方公布。
Meta发布可在个人电脑运行的开源模型Muse Glimmer
Meta发布可在个人电脑本地运行的开源AI模型Muse Glimmer,并提供Muse Spark 1.2开发者访问,继续推进开放模型与个人智能体路线。
OpenAI扩展Daybreak并推出GPT-5.6-Cyber
Axios报道显示,OpenAI向经审核的网络安全防御人员提供GPT-5.6-Cyber,并扩展Daybreak项目。
OpenAI将GPT-5.6 Luna API价格下调80%
OpenAI将GPT-5.6 Luna API价格降至每百万输入Token 0.20美元、输出Token 1.20美元,Terra同步降价20%,Sol价格不变。
ChatGPT桌面端接入语音任务入口,Work与Codex可由语音协调
OpenAI把ChatGPT Voice接入桌面端Work与Codex,将语音从问答输入延伸至复杂任务的启动、协调和进度调整;相关能力仍受设备与用户授权的约束。
阿里视频大模型Wan3.0开启公测,文档和PPT可生成视频
多家科技媒体报道阿里视频大模型Wan3.0进入公测,并把文档和演示文稿接入视频生成流程。此次更新的重点在于内容输入范围,而非单一文生视频提示词。
微软推出模型路由方案,AI智能体开始按任务管理推理成本
微软在Azure AI Foundry介绍模型路由方案,通过任务分级在不同模型之间调度,降低企业AI智能体的调用成本。
OpenAI扩大Astra安全测试,模型发布节奏受到网络能力评估牵动
OpenAI据报扩大Astra网络安全能力测试,AI模型上线前的红队评估和权限控制受到关注。