OpenAI 取消免费用户文字聊天限制,默认模型升至 GPT-5.6Luna
8/7 起免费用户与 ChatGPT 文字互动不再受限,默认模型换为 GPT-5.6Luna(速度最快、成本最低),并加入"思考"按钮;公司称周活已达 10 亿。含文件上传/图片生成/语音等重算力对话仍受限。月底 OpenAI 刚把 GPT-5.6 家族中 Luna 降价 80%、Terra 降 20%。
查看原文 ↗
AI 视频大模型融资密集落地,可灵 AI 创全球最大额纪录
近三个月可灵 AI、生数科技、爱诗科技、演语科技四家新增融资合计近 300 亿元;可灵 AI 落地近 30 亿美元融资、投后估值有望达 180 亿美元,腾讯/阿里云/百度罕见同台入股。赛道从"概念驱动"转向"商业化实质定价",中信证券预判终局呈"3–4 家头部寡头并存"。
查看原文 ↗
英伟达据称测试低显存版 Rubin Ultra,应对高端 HBM 短缺
据 The Information,英伟达正评估下调下一代 AI GPU Rubin Ultra 的 HBM 容量(已测试至少三个低显存版本),以缓解高端高带宽内存供应不足带来的量产压力;降显存意味着客户需部署更多 GPU 才能完成同等训练任务,数据中心成本或进一步上升。
查看原文 ↗
SpaceX 启动 Terafab AI 芯片超级工厂,初期投资 168 亿美元
8/6 SpaceX 宣布联合特斯拉在得州启动 Terafab AI 芯片超级工厂,集制造/封装/测试于一体,初期投资 168 亿美元、远期扩至 1190 亿美元,供 Optimus 机器人、Cybercab 与航天 AI 项目使用;Optimus 预计消耗约 25% 算力产能。
查看原文 ↗
Grok 4.6 于 8 月 7 日登场,沿用 1.5T 架构靠后训练提升
马斯克宣布 Grok 4.6 约 8/7 发布、沿用 4.5 的 1.5 万亿参数架构,增益完全来自后训练(SFT+RL);Arena 确认其将于发布次周登上排行榜独立评测。更强的 Grok 4.7(2.1T)将在数周后推出,xAI 保持约 4 周一代的发布节奏。
查看原文 ↗
AMD 宣布计划收购 AI 推理芯片初创公司 Taalas
8/7 公告拟收购 Taalas——其为单一 AI 模型定制加速器,以牺牲通用性换取更低成本与更高输出速度(部分型号比传统 GPU 快数千倍),基于 Meta Llama 3.1、采用台积电成熟工艺与片上高速 SRAM;号称收到新模型后仅需 2 个月即可落到硬件。
查看原文 ↗
腾讯研究院 AI 速递:DeepMind 掌门卸任、Anthropic 自研芯片、Meta 发编程 Agent、DeepSeek 拟提价、阿里 Wan3.0 公测
Hassabis 卸任 Google DeepMind 日常运营、Jeff Dean 结束 27 年任期离职创业攻 ASI;Anthropic 首次确认组建内部芯片团队为 Claude 自研定制芯片;Meta 发布编程 Agent Muse Code(对标 Opus 5);DeepSeek 拟整体上调整体 API 定价;阿里 Wan3.0 视频模型公测、单次生成 30 秒。
查看原文 ↗