GPT-5.6 Luna示例成本
OpenAI BrowseComp示例;对照GPT-5.5 Extra High为33.27美元。
来源:OpenAI今天最值得记住的是交付层变化。OpenAI一边用GPT-5.6构建指南解释成本和编排,一边把Ultrafast做成有限预览服务层;Google则把Gemini 3.7 Flash推向编码和智能体默认位。模型本身仍重要,但默认入口、速度层、缓存和执行框架开始决定开发者真实体验。
第二条线是商业化与治理。OpenAI任命CRO并披露周活和businesses规模,说明企业化不只是发布更强模型;Computer History、Sheets canvas和DeepSeek Harness也都把更多工作上下文交给AI系统,后续需要看权限、审计和可复现质量。
OpenAI BrowseComp示例;对照GPT-5.5 Extra High为33.27美元。
来源:OpenAIOpenAI称相对Standard processing的最高提升。
来源:OpenAI明确价格和迁移时间能让API用户安排批处理、缓存和预算。它也修复了昨日只有文档映射、缺正式变更日志的事实缺口。
音乐生成正在从Web应用走向可嵌入的本地节点和自动化管线,影响创作者工具与版权治理。
创作者可尝试把模型接入ComfyUI等工作流。平台方需要审查版权、商用许可和生成内容标注策略。
环境冷启动决定云代理是否能承接长任务,直接影响开发者愿不愿把工作交给后台执行。
开发团队可把常用依赖和构建步骤纳入预构建流程。平台管理员需要关注构建缓存、密钥隔离和失败回滚。
表格是企业数据工作的高频入口,mini-app生成会把AI能力嵌入最普通的业务流程。
运营和财务团队可更快做内部工具原型。IT和数据治理团队需要定义权限边界、审计生成逻辑和防止敏感数据外泄。
以下内容仅作为追踪线索,不与已核验新闻等量呈现;正式文件、项目材料或独立复核出现后再升级。
电脑活动历史会改变ChatGPT理解用户任务的上下文来源,也会触发更高隐私和企业合规要求。
用户可减少重复解释,但需要主动管理排除、暂停和清除历史。企业管理员应评估桌面活动记录是否符合内部数据政策。
社交雷达 · X 讨论
- Google AI Studio 宣布 Gemini 3.7 Flash,定位为面向编码和智能体的 workhorse 模型
- 相较 3.6 Flash,强调开发者反馈和算法改进,并给出按百万 token 半价的 introductory pricing。
原帖 ↗- Cerebras 预告为 OpenAI GPT-5.6 Sol 提供 Ultrafast 模式:最高 750 tokens/s
- 同一模型相较 Standard processing 最高快 14 倍
- 并称 Humanity's Last Exam 跑完全程用 11 小时 11 分。
原帖 ↗- Artificial Analysis 发布 Optima,让团队用自有数据
- Hugging Face 数据集或 agent traces 构建自定义基准,并同时比较模型表现
- 成本和 Time per Task。
原帖 ↗- MiniMax 宣布 MiniMax-Music3,称其为新一代 open-weights
- production-ready
- versatile 音乐模型
- 后续帖还表示 Music 3 已可在 ComfyUI 本地运行,云端版本即将上线。
原帖 ↗- Arcee 开源 nac,并同步启动开放模型 API beta。
- nac 采用 Apache 2.0 许可证,面向长任务和复杂多步骤工程工作负载的 agent harness。
原帖 ↗- Cursor 称 Cloud agents 现在启动速度提升至 3 倍,原因是后台持续准备 ready-to-use development environments 的 builds,面向更长
- 更完整的云端代理任务。
原帖 ↗更多讨论4 条
- Codex app 更新:新增可选择启用的 apps 与网站 timeline,用于理解近期工作上下文
- 用户可控制来源、暂停采集或删除历史,面向 Pro、Business 和 Enterprise 用户。
原帖 ↗- Nous Research 宣布 LongCat-2.0 在 Nous Portal 免费开放一周,并强调其 1.6T MoE
- 1M context
- 面向 agentic coding,Terminal-Bench 2.1 得分 70.8。
原帖 ↗- MaxForAI 汇总 Jiahui Yu 离开 Meta 创业的消息,并回顾其在 Gemini、GPT-4o、o3/o4-mini 与 Meta Muse 多模态方向的经历
- 新公司名称和具体方向尚未公开。
原帖 ↗- Chrome DevTools 团队发布面向 agents 的闭环调试能力:环境可读取失败的 Lighthouse 浏览器验证并自动定位
- 修正破损代码元素,减少人工复制错误信息到提示词窗口。
原帖 ↗