🔥 今日看点
- OpenAI 价格战再升级:GPT-5.6 Luna 直降 80%、Terra 降 20%,新增 Sol Fast 模式(吞吐最高 2.5 倍)
- 字节跳动发布 Seedance 2.5:单次生成 30 秒视频,一次可参考 30 图 + 10 视频 + 10 音频
- Thinking Machines 开源 Inkling Small:1/4 体积逼近旗舰,SWE-bench Verified 反超
- 企业 Agent 基础设施五强亮相:编排(BAND)、安全(Conifers)、审计(Raindrop)、权限(Arcade)
- Cursor 用量页”隐藏”费用信息引众怒,HN 295 分热帖
- GitHub 热门:腾讯云 Agent 记忆中枢、HF 本地语音 Agent、字节 deer-flow 长周期 Agent 框架
📰 VentureBeat 精选
1. OpenAI 打响 AI 价格战:GPT-5.6 Luna 降价 80%
OpenAI 大幅下调 GPT-5.6 系列价格:最小最快的 Luna 直降 80%($0.20/$1.20 每百万 token),中端 Terra 降 20%($2/$12),并为旗舰 Sol 新增 Fast 模式(价格翻倍、吞吐最高 2.5 倍且智能不变)。此前 Anthropic 以 Opus 4.8 同价发布 Claude Opus 5,谷歌推出 Gemini 3.6 Flash 与 3.5 Flash-Lite,模型竞争正从”性能”转向”单位智能成本”。
阅读全文
2. Thinking Machines 开源 Inkling Small:1/4 体积逼近旗舰
Mira Murati 创办的 Thinking Machines 发布开源模型 Inkling Small:276B 总参数(12B 激活)稀疏 MoE、Apache 2.0 许可、支持文本/图像/音频输入与百万级上下文。Artificial Analysis 智能指数 40(旗舰 Inkling 为 41),SWE-bench Verified 80.2% 反超旗舰的 77.6%,Terminal Bench 2.1 达 64.7%。权重已上 Hugging Face,可通过 Tinker API 微调;限时 5 折 API 定价(输入 $0.58/百万 token),部署最低需 4×B300 或 8×H200。
阅读全文
3. 企业 Agent 基建五强:编排、安全、审计、权限齐上阵
VB Transform 2026 上五家创业公司瞄准企业 Agent 基础设施:BAND 构建多 Agent 编排层(兼容 A2A/MCP 协议,支持 8–20 小时自主工作流,人类可随时加入”对话空间”);Conifers 将网络防御组件全面 Agent 化,遏制时间从 7 小时缩至 12 分钟、复杂调查 4 分钟内完成;Raindrop AI 为生产 Agent 建立审计日志,用强化学习平台做修复前模拟与线上 A/B 验证;Arcade 则为 Agent 提供细粒度安全权限。Agent 规模化的”水电煤”正在成形。
阅读全文
🌐 Hacker News 热门讨论
4. 字节跳动 Seedance 2.5:单次生成 30 秒视频,多模态参考大升级
字节 Seed 团队发布新一代视频生成模型 Seedance 2.5:单次生成从 15 秒提升至 30 秒并支持多轮续写,可一次输入最多 30 张图片、10 段视频、10 段音频作为参考素材;新增时间戳级精准编辑、绿幕与镜头控制能力,面向影视广告级创作,主打”一镜到底”长叙事。已在即梦 AI、豆包 Pro 上线,API 即将通过 BytePlus ModelArk 开放。HN 119 分。
官方博客 | HN讨论
5. Cursor 用量页”隐藏”费用信息引众怒
HN 295 分热帖:Cursor 用量窗口从美元金额悄然改为 Token 数量,用户无法直观掌握每日花费,质疑计费透明度倒退。帖子 8.9 万浏览量、88 赞、49 条回复,官方随后恢复 Usage 页的 Cost 列。事件折射出 AI 编程工具的定价与计费透明度正成为用户核心关切,也提醒工具厂商:成本可见性是信任的基础。
论坛讨论 | HN讨论
6. 微软开源 Flint:面向 AI 时代的可视化语言
微软发布 Flint——为 AI 时代设计的可视化语言与图表框架(HN 251 分)。它让 LLM 更容易生成精确、可编辑的数据可视化,降低 Agent 产出图表的出错率与”幻觉式”图表问题,被视为 AI 原生数据分析与 Agent 报告能力的重要基础组件。
项目主页 | HN讨论
7. Lean 内核健全性 Bug #14576 事后分析
Lean 语言作者 Leo de Moura 发布内核健全性 Bug 的完整事后分析(HN 105 分)。该 Bug 影响形式化验证工具链的可信根基,修复与复盘过程对依赖证明助手与 AI 辅助数学推理的团队极具警示意义——“验证器本身也需要被验证”,形式化方法 + AI 的组合仍需审慎。
阅读全文
8. MIT Sloan 研究:问对问题,AI 财务建议表现不俗
MIT Sloan 发布研究:只要用户提出正确的问题,AI 给出的财务建议质量出人意料地好(HN 98 分)。研究聚焦人机协作下的提问框架设计,对金融领域 Agent 产品与提示词工程有直接参考价值——答案质量的上限往往取决于问题设计的质量。
阅读全文
⭐ GitHub Trending 热门项目
9. TencentCloud/TencentDB-Agent-Memory — 腾讯云开源团队级 Agent 记忆中枢
当日新增 227 星,总星 10,288。把对话、文档、代码转化为四类可复用记忆资产(聊天记忆等),作为团队级记忆中枢供多个 Agent 共享,直击”Agent 记忆碎片化、难以跨会话复用”的痛点,是 Agent 从单机走向组织协作的关键组件。
仓库
10. huggingface/speech-to-speech — 开源本地语音 Agent 框架
当日新增 442 星,总星 10,202。用开源模型构建本地语音 Agent,覆盖语音识别、合成与对话全链路,推动语音交互 Agent 从云端 API 走向本地部署与隐私可控,边缘语音助手落地门槛进一步降低。
仓库
11. bytedance/deer-flow — 开源长周期 SuperAgent 框架
总星 78,721,当日新增 209。支持研究、编码、创作的长周期 SuperAgent 框架,内置沙箱、记忆、工具、技能与子 Agent 机制,是目前最活跃的开源 Agent 框架之一,持续吸引开发者围绕”自主长任务执行”做二次开发。
仓库
12. microsoft/TRELLIS.2 — 结构化潜空间 3D 生成
当日新增 107 星,总星 9,920。用原生紧凑的结构化潜变量做 3D 生成,相比传统方法在几何与纹理一致性上更优,是 3D 资产生成管线的重要进展,为游戏与影视内容生产提供新的自动化路径。
仓库
13. zhaoxuya520/reverse-skill — 安全技能路由包连续霸榜
昨日上榜的 AI 逆向/渗透测试技能路由包今日再度暴涨 1,320 星(总星 11,902),AI 自动路由 + 按需自举工具链 + 自动进化知识库,支持 Claude Code、Kiro、Cursor、Cline 等主流编码客户端。安全 Agent 工具链的热度不减,连续两日霸榜 GitHub Trending。
仓库
🛡️ Anthropic 动态
14. Frontier Red Team:调查三起真实世界网络安全事件
Anthropic Frontier Red Team 公布对网络安全评估中三起真实世界事件的调查,聚焦 AI Agent 在攻防场景中的实际能力边界与风险评估方法。结合 Conifers 等创业公司动态,企业级 Agent 安全正从”理论讨论”走向”实战验证”,红队方法论将成为 Agent 产品的标配。
Anthropic News
📝 编辑点评
今日最核心的信号是 AI 价格战全面升级:OpenAI 将 GPT-5.6 Luna 直降 80%,叠加谷歌 Gemini 3.6 Flash/3.5 Flash-Lite 与 Anthropic Opus 5 同价策略,竞争焦点已从”性能军备竞赛”转向”单位智能成本”。对产品研发团队而言,Agent 类应用的边际成本正在快速下降,架构选型与成本模型值得重新评估。
第二个关键词是 开源模型的小型化路径:Inkling Small 用 1/4 参数逼近旗舰并在 SWE-bench 上反超,印证了稀疏 MoE + 激活参数优化的有效性——“小而强”正成为开源生态对抗闭源旗舰的新叙事,也让企业自部署门槛显著下探(虽然仍需多卡 GPU)。
第三个趋势是 Agent 从 Demo 走向生产的基础设施竞赛:记忆(腾讯云 Agent-Memory)、编排(BAND)、安全(Conifers、Anthropic 红队)、审计(Raindrop AI)同时在发力,叠加字节 deer-flow 与 HF speech-to-speech 的开源推进——Agent 规模化落地所需的”水电煤”正在快速补齐,这也是下一阶段产品研发的主战场。