LLM大模型邮报
  • 首页
  • 模型动态
  • 研究前沿
  • 教程指南
  • 行业观察
  • 关于

首页

  • OpenAI 详解 Codex 安全部署边界

    • 工程实践
    • •
    • 2026 年 5 月 9 日 06:04
    • •
    • ···

    OpenAI 在官方文章中披露 Codex 安全部署的控制体系,重点包括沙箱、审批、网络策略、身份绑定、规则管理与 agent-native telemetry。OpenAI 的目标是让 Codex 在低风险开发任务中保持效率,同时让高风险动作进入显式审批。对企业安全团队而言,这提供了一套可复用的 coding agent 治理样板。

    MISTY
  • Mozilla 用 Claude Mythos 做 Firefox 安全加固

    • 工程实践
    • •
    • 2026 年 5 月 9 日 05:56
    • •
    • ···

    Mozilla 披露了 Firefox 安全加固的内部流程:团队使用 Claude Mythos Preview、Claude Opus 4.6 与其他模型,结合自研 agentic harness 发现并修复潜伏安全漏洞。Mozilla 称,Claude Mythos Preview 在 Firefox 150 版本中识别的漏洞修复数量为 271 个;Firefox 在 2026 年 4 月发布的安全修复数量升至 423 个。这次 Firefox 安全加固的重点不是一次性提示模型,而是把模型接入可复现测试、去重、分诊、补丁与发布流程。

    MISTY
  • OpenAI 和 Anthropic 人均营收超科技巨头

    • 行业观察
    • •
    • 2026 年 5 月 9 日 05:02
    • •
    • ···

    据 Epoch AI 估算,OpenAI 和 Anthropic 的人均营收已高于多家大型上市科技公司。Anthropic 的年化人均营收约为 900 万美元,OpenAI 约为 550 万美元;若两家公司上市,其人均营收或将超过 Forbes Global 2000 中所有公开交易的科技公司。这个指标不等同于利润率,但能反映 AI 实验室用较少员工撬动订阅、API 与企业收入的能力。

    MISTY
  • 文心 5.1 发布 预训练成本降至 6%

    • 模型动态
    • •
    • 2026 年 5 月 9 日 04:37
    • •
    • ···

    百度正式上线文心 5.1,并公布模型在参数效率、训练成本和多项 benchmark 上的表现。文心 5.1 将总参数压缩至文心 5.0 约 1/3,激活参数压缩至约 1/2,预训练算力成本约为业界同规模模型的 6%。5 月 9 日,文心 5.1 以 1223 分位列 Arena 搜索榜全球第 4、国内第 1。

    MISTY
  • Grok Build 桌面应用被曝对标 Codex

    • 工程实践
    • •
    • 2026 年 5 月 9 日 01:54
    • •
    • ···

    据报道,SpaceXAI 正在筹备 Grok Build 桌面编码应用,目标是进入 agentic coding 工具赛道。Grok Build 桌面应用曾因 Grok 网页端短暂出现的 Grok Computer 按钮而曝光,但相关功能随后被撤下。早期访问截图显示,它面向 macOS、Linux 与 Windows,并试图对标 OpenAI Codex 桌面应用与 Anthropic Claude Code。

    MISTY
  • Claude Code HTML 工作流提升可读性

    • 工程实践
    • •
    • 2026 年 5 月 9 日 01:45
    • •
    • ···

    Claude Code HTML 工作流正在从 Markdown 规格文档转向更丰富的 HTML artifact。Thariq 来自 Claude Code 团队,他在 X 平台原帖中给出的核心判断是:当 agent 输出超过 100 行时,HTML 更适合承载可视化、交互和可分享的上下文。这个建议不是要求替换所有文本,而是把规划、评审、研究报告和一次性编辑器交给浏览器呈现。

    MISTY
  • 蚂蚁百灵发布 Ring-2.6-1T

    • 模型动态
    • •
    • 2026 年 5 月 8 日 18:32
    • •
    • ···

    蚂蚁百灵公布 Ring-2.6-1T 的多档能力设置与一组 benchmark 成绩。官方称 high 档面向真实任务执行、通用 agent 与 coding agent,xhigh 档面向数学、研究和多路径推理;OpenRouter 上的免费试用持续到 5 月 15 日。

    MISTY
  • OpenAI 微调 API 将停止新训练

    • 工程实践
    • •
    • 2026 年 5 月 8 日 17:33
    • •
    • ···

    OpenAI 微调 API 将进入逐步下线期。根据用户收到的 OpenAI 通知,现有活跃客户可继续创建微调训练任务至 2027 年 1 月 6 日,此后将无法再创建新的训练任务。现有微调模型仍可通过 Chat Completions API 和 Responses API 推理,但会在对应底座模型退役后停止可用。

    MISTY
  • Zyphra 发布 AMD 训练模型 ZAYA1-8B

    • 模型动态
    • •
    • 2026 年 5 月 8 日 14:46
    • •
    • ···

    Zyphra 官方发布 ZAYA1-8B,这是在 AMD Instinct MI300 栈上完成预训练、中期训练与监督微调的 MoE 模型。ZAYA1-8B 的活跃参数少于 10 亿,官方称其在数学、代码与复杂推理任务上超过部分更大开源权重模型。Zyphra 还公布了 Markovian RSA 测试时计算方法,在 HMMT'25 上取得 89.6 分,高于 Claude 4.5 Sonnet 的 88.3 分。

    MISTY
  • xAI 与 Anthropic 算力消化情况完全相反

    • 行业观察
    • •
    • 2026 年 5 月 8 日 14:33
    • •
    • ···

    xAI 与 Anthropic 算力消化成为这轮算力竞争的新观察点。据原帖转述 The Information 报道,xAI 近期模型的 FLOPs 利用率约为 **11%**;Anthropic 则面临相反问题,Claude 需求增长快于可用容量,新增 SpaceX 算力容量被迅速转化为 Claude Code 与 Opus 的更高使用上限。

    MISTY
  • DeepSeek 融资被曝达 500 亿元 或推 V4.1

    • 行业观察
    • •
    • 2026 年 5 月 8 日 13:48
    • •
    • ···

    据 The Information 报道,DeepSeek 正寻求最高 500 亿元人民币的首轮融资,折合约 73.5 亿美元。DeepSeek 融资若完成,可能成为中国 AI 公司史上规模最大的单轮融资之一。报道还称,DeepSeek 计划加快商业化和模型迭代节奏,其中 V4.1 更新版或在 2026 年 6 月推出。

    MISTY
  • OpenAI 推出 GPT-5.5-Cyber 预览

    • 模型动态
    • •
    • 2026 年 5 月 8 日 12:32
    • •
    • ···

    OpenAI 推出 GPT-5.5-Cyber 有限预览,面向负责关键基础设施安全的防御者开放。GPT-5.5-Cyber 与 Trusted Access for Cyber 共同构成分级访问机制:多数团队仍以 GPT-5.5 with TAC 作为起点,少数经更强验证的伙伴可测试更宽松的网络安全工作流。

    MISTY
  • 第 17 / 21 页
    较新文章
  • 第 17 / 21 页
    较早文章

网站

  • WordPress

社交媒体

  • X(Twitter)
  • 小红书 Xiaohongshu

友情链接

  • WinDiscover

© 2026 LLM大模型邮报 · 保留所有权利