跳到正文

#大模型

今日 0 条
10月3日周六
  1. 钛媒体15

    Edge AI Daily 早报(10月3日):洛克希德把 F-35 核心算法交给 OpenAI,东芝 600 亿日元加仓 HDD

    洛克希德·马丁高管确认 OpenAI 正为 F-35 核心传感器融合系统解决数学与物理问题,这是五角大楼首次让商业 AI 公司触及核心武器系统工程内核。东芝宣布投资 600 亿日元扩建菲律宾 HDD 工厂,计划 2027 财年内将 AI 数据中心用机械硬盘产能翻倍。泰国将家庭太阳能补贴从 500 亿泰铢扩至 750 亿泰铢,覆盖 150 万户家庭,登记于 11 月 1 日启动。

  2. 钛媒体62

    大模型一体机开始缩水:满血版遇冷,轻量化 AI BOX 兴起

    大模型一体机市场正从追捧 671B 满血版转向轻量化设备,多数中端机型最多只能运行 70B 级别模型。文章归因于需求挤泡沫、模型能力密度提升、高端芯片供给受限和内存涨价,并指出满血高端机型仍集中在有强合规要求的央国企和金融机构。

    推荐理由:梳理大模型一体机从满血版遇冷到轻量化 AI BOX 兴起的市场分层,并给出高端机型仍适用的合规与生产场景。

  3. OpenAI News30

    OpenAI 发布 GPT-6 系列模型选型指南

    OpenAI 发布 GPT-6 系列模型指南,面向初创公司说明如何选择 GPT-6 模型、调整推理强度、改进提示词与技能、协调工具,并为生产环境准备 Workflow。指南覆盖从模型选型到上线前的完整准备环节。

    推荐理由:OpenAI 官方给出 GPT-6 系列选型与推理强度调优的实操指引,可帮助团队把模型接入生产工作流。

10月2日周五
  1. IT之家58

    英伟达发布 64GB 内存版 DGX Spark 桌面 AI 计算机,4999 美元起

    英伟达 10 月 2 日推出 64GB 内存版 DGX Spark 桌面 AI 计算机,起售价 4,999 美元,10 月 23 日发售,宏碁、戴尔、华硕、技嘉、微星、H3C 等 OEM 将推出整机;128GB FE 版本同步更新定价为 6,950 美元。

    推荐理由:英伟达推出 64GB 版 DGX Spark 并下调 128GB 版定价,读者可据此比较本地部署大模型的硬件门槛与集群扩展成本。

  2. IT之家51

    贝恩:全球 AI 行业到 2031 年需创造 6 万亿美元年营收才能支撑数据中心投入

    贝恩公司报告称,全球 AI 行业到 2031 年每年需创造 6 万亿美元营收,才能支撑当前数据中心建设的巨额资本投入;现有消费级和企业级 AI 服务最多贡献 1.8 万亿美元,还需找到 4.2 万亿美元新增收入,可能来自自动化机器、机器人以及药物研发、心理健康和能源生产等起步阶段市场。

    推荐理由:贝恩给出 AI 行业 2031 年需 6 万亿美元年营收的测算,并指出基础设施投入已跑在需求前面,可供判断算力投资节奏。

  3. 钛媒体71

    DeepSeek 为何在此时开源面向华为昇腾的基础设施组件

    DeepSeek 在国庆假期前一天正式开源面向华为昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、高性能计算库与分布式通信库,与此前面向英伟达平台的开源组件一一对应。

    推荐理由:文章拆解了 DeepSeek 把英伟达平台工具链整体搬到昇腾的技术路径,读者可据此理解国产算力适配从跑通到成体系迁移的差别。

  4. 钛媒体62

    谷歌 DeepMind 发布 Gemini 4 首款旗舰模型 Argon

    谷歌 DeepMind 于 9 月 30 日正式发布 Gemini 4 系列首款旗舰模型 Argon,官方称在 19 项基准测试中取得 13 项领先,输出 Token 上限从上一代的 6.4 万提升到 100 万。

    推荐理由:文章把 Argon 的基准成绩、真实工程案例与内部质疑放在一起,读者可据此判断跑分领先与实际落地之间的落差。

  5. IT之家55

    微软预热 10 月 7 日 Surface 发布会,黄仁勋出席聚焦本地 AI

    微软官方开发者账号 @windowsdev 宣布将于太平洋时间 10 月 7 日上午 10 点举办面向开发者与构建者的线上活动,主题为本地人工智能如何塑造 PC 的下一阶段。

    推荐理由:微软联合英伟达预热 Surface 发布会,读者可了解本地端侧 AI 在 PC 上的硬件规格与可运行模型规模。

  6. IT之家22

    腾讯 WorkBuddy:Hy4 preview 夜间限免、Hy3 限免延期至 10 月 31 日

    腾讯 WorkBuddy 于 9 月 30 日晚宣布,将 Hy3 模型限免及 Hy4 preview 模型夜间限免均延期至 10 月 31 日。已体验过 Hy4 preview 的用户可在闲时夜间(23:00 - 次日 8:00)继续免费使用,其余时间正常消耗积分;未体验过的用户在 10 月 10 日 23:59 前首次开启对话,可获 14 天每日免费额度。

  7. 钛媒体66

    江苏电力印发“人工智能+”三年行动方案,百亿订单之外的机会在三个不造机器人的环节

    国网江苏电力近日印发《“人工智能+”三年行动方案》,以“2359”骨架部署AI与电网业务融合,明确2026年体系筑基、2028年全面领先。叠加国家电网年内计划采购具身智能设备约8500台、总投资约68亿元,产业链人士预计2026年电力行业具身智能总投资规模有望突破100亿元。

    推荐理由:从江苏电力三年方案与国网采购清单出发,拆解算电协同中三个不造机器人的环节,可帮助读者判断订单之外的落地切口。

  8. TechCrunch · AI53

    AWS 开源决策模型 Strands Decider 2B,灵感来自 TypeSafe 的 Jev

    AWS 发布开源决策模型 Strands Decider 2B,灵感来自 TypeSafe 的 Jev,可高速低成本地在预设选项中做选择并给出置信度,模型完全开源、现已可用且小到能在本地运行。

    推荐理由:AWS 开源决策模型 Strands Decider 2B,读者可了解决策模型这一新品类与前沿 LLM 的取舍差异。

10月1日周四
  1. 钛媒体62

    谷歌发布 Gemini 4 Argon:18 项基准拿下 12 项第一,终端操作仍落后

    谷歌推出新一代旗舰模型 Gemini 4 Argon,采用公司迄今规模最大的预训练,在谷歌公布的 18 项基准测试中拿下 12 项第一、1 项并列第一,GPT-6 Astra 为 3 项第一、1 项并列第一,Claude Opus 5.5 为 2 项第一。

    推荐理由:原文列出 Gemini 4 Argon 在 18 项基准中的胜负分布与短板项,可据此判断它在知识工作与终端操作上的能力边界。

  2. 极客公园62

    阿里云云栖大会升级全栈 AI 基础设施,提出 Agent 时代「芯云模一体」

    阿里云在云栖大会上沿模型生产、智能落地、系统自进化三条效率线,升级从数据入湖、训练集生产、模型训练、推理服务到系统自我优化的整条链路,并强调「芯云模一体」的协同设计。

    推荐理由:阿里云在云栖大会对数据、训练、推理到自进化链路的整体升级,呈现了 Agent 负载对基础设施提出的新要求。

  3. 极客公园22

    谷歌 Gemini 4 Argon 曝光;中国生成 AI 用户超 7 亿;美光 2026 财年净利暴涨 895%

    谷歌发布迄今最先进的 AI 模型 Gemini 4 Argon,重点面向长流程软件工程、企业知识工作和网络安全防御,单次输出上限提至约 100 万 tokens,但暂未全面开放。CNNIC 报告显示,截至 2026 年上半年中国生成式 AI 用户规模突破 7 亿,普及率超 50%。美光 2026 财年营收 1331.88 亿美元、归母净利润 849.69 亿美元,同比增长 895.07%。

9月30日周三
  1. 雷锋网74

    DeepSeek 开源 TileLang 原生支持华为昇腾 950,同步推出五大算子库昇腾版

    DeepSeek 将算子开发产品 TileLang 官宣原生支持华为昇腾 950 NPU,并同步推出 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大核心计算与通信库的昇腾版本。

    推荐理由:原文梳理了 TileLang 原生支持昇腾 950 的架构设计与基准数据,可据此判断国产算子工具链的跨平台适配路径。

  2. 雷锋网49

    雷锋网实测:免费 AgnesCode 与 Codex 在 DeepSeek-V3 算子优化任务中互有胜负

    雷锋网把 AgnesCode + Agnes 3.0 Flash 与 Codex + GPT-5.6 Sol 放进众智 FlagOS 开放计算全球大赛的 DeepSeek-V3 解码阶段融合 QKV-A 下投影算子题(Task66: dsv3_fused_a_gemm),在 8 款芯片上接受赛事官方自动化评测。

    推荐理由:雷锋网用同一道算子优化题对比免费 AgnesCode 与付费 Codex,给出跨芯片加速比与耗时数据,可作 Agent 底层工程能力的参照。

  3. 量子位65

    斯坦福 HomeBody 用 GPT-6 Astra 接上宇树 G1 收拾厨房

    斯坦福团队项目 HomeBody 让 GPT-6 Astra 接上宇树 G1 进入厨房干活,机器人先探索陌生厨房并保存空间记忆,再按语言指令收拾物品、丢弃纸盒,甚至从视野外的抽屉取药递给人。

    推荐理由:斯坦福 HomeBody 项目展示了 GPT-6 Astra 调度技能库控制宇树 G1 完成厨房任务,读者可了解大模型控制机器人的技能调用分工方式。

  4. 量子位58

    DeepSeek 知乎独家发文,首次公开 V4.1 Agent 训练沙盒基础设施 DSec

    DeepSeek 在知乎独家发布技术长文,首次系统阐释支撑 DeepSeek-V4 全部训练、评测与数据预处理流程的沙盒基础设施 DeepSeek 弹性计算(DSec),相关技术报告已公开至 arXiv,由 DeepSeek 联合清华大学发布,作者团队超过 130 人。

    推荐理由:DeepSeek 公开了支撑 V4 系列 Agent 训练的沙盒基础设施细节,读者可了解大规模 Agent RL 训练的工程约束与解法。

  5. 量子位66

    DeepSeek 开源昇腾基础组件,与昇腾共建 AI 芯片软件生态

    9月30日,DeepSeek 正式开源面向昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、高性能计算库与分布式通信库,与此前面向 GPU 平台开源的组件一一对应。

    推荐理由:DeepSeek 把面向昇腾的基础设施组件开源,并给出超节点部署的实测吞吐数据,可据此判断国产算力承载大模型的成熟度。

9月29日周二
  1. 极客公园66

    AMD 以约 82 亿美元收购 World Labs,李飞飞将出任首席科学家

    AMD 宣布以约 82 亿美元全股票收购李飞飞创办的 World Labs,预计 2026 年底前完成交割,仍需通过监管审批,这是 AMD 历史上第二大收购。交割后李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向 CEO 苏姿丰汇报。AMD 表示这笔交易看重的是 World Labs 的模型经验,用以理解推理、机器人和物理 AI 等负载如何演变,从而塑造未来的芯片技术路线图。

    推荐理由:AMD 以 82 亿美元全股票收购 World Labs,读者可借此理解芯片公司为何要买模型团队来提前定义算力需求。