AI 行业日报 | AI Industry Daily 2026-05-22 日报 / 2026-05-22 生成 08:22 CST

AI 行业日报

模型与工具能力 · 产业基础设施 · 应用商业化 · 研究开源 · 资本监管 | Data Source: aihot.virxact.com
API耗时: 1s 精选条目: 52 条 焦点: 8 条 快讯: 0 条
Executive Summary

今日AI行业呈现多维度能力突破态势。腾讯正式开源Hy-MT2多语言翻译模型,33种语言互译性能超越参数规模大数十倍的模型,1.8B轻量版本甚至超越主流商业API。美团LongCat团队发布LongCat-Video-Avatar-1.5音频驱动数字人框架,实现精准唇形同步与长视频身份一致性。Runway推出Aleph 2.0Edit Studio创作工具,整合生成、编辑与后期制作流程。Stability AI发布Stability Audio 3.0模型家族,可生成最长6分钟专业级歌曲。

行业商业化进程加速,Anthropic预计第二季度营收达109亿美元,运营利润5.59亿美元,有望成为首个盈利AI实验室。Meta启动万人重组,裁员8000人同时调配7000名员工至AI相关职位,显示巨头向AI转型的决心。Google推出Gemini for Home全栈解决方案赋能智能家居生态,腾讯发布操作系统层级AI助手"马维斯"覆盖多平台。安全合规方面,Claude新增28项工具集成,Datasette Agent提供对话式数据查询能力。

后续需关注Hy-MT2模型在多语言场景的实际应用效果、Anthropic商业化策略的可持续性、各大厂AI助手产品的市场接受度,以及Google智能家居生态的合作伙伴响应情况。算力需求激增背景下的成本控制能力将成为企业AI转型的关键变量。

重点

今日核心进展

1. 腾讯开源Hy-MT2多语言翻译模型
X:腾讯混元 (@TencentHunyuan) · 15 小时前 · 模型与工具能力
腾讯正式开源Hy-MT2多语言翻译模型,支持33种语言间的无缝互译。其7B与30B-A3B版本在开源模型中达到最先进的翻译性能,超越了许多参数规模大数十倍的模型。更具突破性的是,1.8B轻量级版本性能超越微软等主流商业API,并凭借腾讯AngelSlim 1.25-bit极量化技术,仅需440MB存储空间,即可在主流手机芯片上本地运行,推理速度较前代提升1.5倍,显著降低了高质量AI翻译的部署门槛
能力进展基础设施新发布
2. LongCat-Video-Avatar-1.5:升级版音频驱动数字人视频生成框架
美团 LongCat:HuggingFace 新模型 · 15 小时前 · 模型与工具能力
美团LongCat团队发布了LongCat-Video-Avatar-1.5,一个专注于音频驱动数字人视频生成的开源框架。其核心升级在于采用Whisper-Large音频编码器,显著优化了唇部动态的流畅度与自然度。该版本实现了精准的唇形同步、全身时序稳定性以及长视频中的身份一致性,并能泛化应用于动漫、动物及多人交互等复杂场景。通过基于DMD2的步蒸馏技术,模型仅需8步即可高效推理。团队还构建了一个
能力进展新发布
3. Aleph 2.0 与 Edit Studio
Runway:Changelog(网页) · 5 小时前 · 模型与工具能力
正式发布 Aleph 2.0 及配套的 Edit Studio 创作工具。此次更新实现了创作流程的全面整合,将内容生成、编辑与后期制作集中于统一平台。新版本显著优化了多模态内容的处理效率,并提供了从构思到成品的一站式解决方案,旨在为创作者提供更流畅、集成的数字内容制作体验。
能力进展新发布
4. 谷歌DeepMind在亚太启动AI气候加速器
Google DeepMind:Blog(RSS) · 4 小时前 · 产业与基础设施
亚太地区经济增长迅速,但极易受到气候变化影响,且现有绿色技术发展速度跟不上环境风险的增长。为此,Google DeepMind宣布启动首届专注于"AI for the Planet"的加速器计划。该计划为期三个月,面向亚太地区的初创企业、研究团队和非营利组织,旨在利用前沿人工智能技术解决自然、气候、农业和能源等领域的挑战。入选组织将获得专家指导、定制化支持,并可集成Google AI的前沿模型。计
能力进展基础设施新发布
5. Stability AI 推出音频模型 Stability Audio 3.0,可生成最长 6 分钟专业级歌曲
IT之家(RSS) · 昨天 23:42 · 模型与工具能力
Stability AI 推出 Stability Audio 3.0 音频生成模型家族,包含四款不同规格模型,参数从45900万到27亿。小型模型专注设备端运行,可本地生成两分钟以内的音频;中型和大型模型支持创作超过6分20秒的完整音乐,
能力进展新发布
6. Datasette Agent
Simon Willison 博客 · 4 小时前 · 应用与商业化
Datasette Agent是Datasette推出的首个可扩展AI助手,为用户提供对话式界面以查询数据,并支持通过插件生成图表。该工具基于其LLM Python库构建,是LLM与Datasette整合的重要成果。目前提供图表生成、AI图像创建和沙箱代码执行等官方插件。它既可运行于Gemini 3.1 Flash-Lite等云端模型,也支持通过LM Studio连接本地开源模型,具备可靠的工具调
能力进展基础设施新发布
7. Claude现已支持更多安全合规工具
Claude:Blog(网页) · 6 小时前 · 应用与商业化
Anthropic宣布为Claude企业版及平台新增28项安全与合规工具集成。这些集成均通过Claude Compliance API实现,允许企业安全团队统一获取Claude的对话内容与活动事件,从而将其纳入现有的DLP、SIEM等监控与合规流程。新增合作伙伴包括Cloudflare、CrowdStrike、Microsoft Purview等28家供应商,覆盖数据安全、身份验证等多个关键领域,
能力进展基础设施监管/资本
8. v2.1.147版本更新
Claude Code:GitHub Releases(RSS) · 3 小时前 · 应用与商业化
本次更新引入了`Workflow`工具,支持确定性多智能体编排(默认关闭)。将`/simplify`命令重命名为`/code-review`,现可报告代码正确性问题并支持生成GitHub PR内联评论。改进了自动更新器(增加重试与错误报告)、大文件diff渲染性能,并优化了提示历史记录以避免重复条目。修复了多个关键问题,包括企业登录限制未生效、Windows下的PowerShell工具与终端闪烁问
能力进展监管/资本新发布
能力

模型与工具能力

1. 腾讯开源Hy-MT2多语言翻译模型
X:腾讯混元 (@TencentHunyuan) · 15 小时前
腾讯正式开源Hy-MT2多语言翻译模型,支持33种语言间的无缝互译。其7B与30B-A3B版本在开源模型中达到最先进的翻译性能,超越了许多参数规模大数十倍的模型。更具突破性的是,1.8B轻量级版本性能超越微软等主流商业API,并凭借腾讯AngelSlim 1.25-bit极量化技术,仅需440MB存储空间,即可在主流手机芯片上本地运行,推理速度较前代提升1.5倍,显著降低了高质量AI翻译的部署门槛
能力进展基础设施新发布
https://x.com/TencentHunyuan/status/2057384034544804136
2. LongCat-Video-Avatar-1.5:升级版音频驱动数字人视频生成框架
美团 LongCat:HuggingFace 新模型 · 15 小时前
美团LongCat团队发布了LongCat-Video-Avatar-1.5,一个专注于音频驱动数字人视频生成的开源框架。其核心升级在于采用Whisper-Large音频编码器,显著优化了唇部动态的流畅度与自然度。该版本实现了精准的唇形同步、全身时序稳定性以及长视频中的身份一致性,并能泛化应用于动漫、动物及多人交互等复杂场景。通过基于DMD2的步蒸馏技术,模型仅需8步即可高效推理。团队还构建了一个
能力进展新发布
https://huggingface.co/meituan-longcat/LongCat-Video-Avatar-1.5
3. Aleph 2.0 与 Edit Studio
Runway:Changelog(网页) · 5 小时前
正式发布 Aleph 2.0 及配套的 Edit Studio 创作工具。此次更新实现了创作流程的全面整合,将内容生成、编辑与后期制作集中于统一平台。新版本显著优化了多模态内容的处理效率,并提供了从构思到成品的一站式解决方案,旨在为创作者提供更流畅、集成的数字内容制作体验。
能力进展新发布
https://app.runwayml.com/generate?mode=edit
4. Stability AI 推出音频模型 Stability Audio 3.0,可生成最长 6 分钟专业级歌曲
IT之家(RSS) · 昨天 23:42
Stability AI 推出 Stability Audio 3.0 音频生成模型家族,包含四款不同规格模型,参数从45900万到27亿。小型模型专注设备端运行,可本地生成两分钟以内的音频;中型和大型模型支持创作超过6分20秒的完整音乐,
能力进展新发布
https://www.ithome.com/0/953/086.htm
产业

产业与基础设施

1. 谷歌DeepMind在亚太启动AI气候加速器
Google DeepMind:Blog(RSS) · 4 小时前
亚太地区经济增长迅速,但极易受到气候变化影响,且现有绿色技术发展速度跟不上环境风险的增长。为此,Google DeepMind宣布启动首届专注于"AI for the Planet"的加速器计划。该计划为期三个月,面向亚太地区的初创企业、研究团队和非营利组织,旨在利用前沿人工智能技术解决自然、气候、农业和能源等领域的挑战。入选组织将获得专家指导、定制化支持,并可集成Google AI的前沿模型。计
能力进展基础设施新发布
https://deepmind.google/blog/were-launching-the-google-deepmind-accelerator-program-in-asia-pacific-to-tackle-environmental-risks
2. Anthropic即将成为首个盈利的AI实验室
The Decoder:AI News(RSS) · 9 小时前
根据《华尔街日报》报道,Anthropic正接近实现其首个盈利季度,预计第二季度营收达109亿美元,运营利润为5.59亿美元。该公司在去年夏季时还预计最早在2028年才能盈利。主要增长动力来自编程工具和Claude的代理功能使用,其需求一度超过了可用的算力容量。这一转变标志着Anthropic可能成为业界首个实现盈利的领先AI研发机构。
能力进展基础设施
https://the-decoder.com/anthropic-is-about-to-become-the-first-profitable-ai-lab
3. Meta万人重组:裁员与AI转型并举
X:Rohan Paul (@rohanpaul_ai) · 昨天 03:13
Meta启动大规模裁员,计划削减约8000个岗位。与此同时,约7000名员工将被调配至新的AI相关职位。此次调整并非单纯的削减成本,更是公司围绕AI进行内部结构重塑的关键举措,重点将资源集中于AI基础设施、基础模型的构建以及AI技术的商业化,旨在打造从模型训练、产品开发到实现盈利的完整链条。
能力进展基础设施
https://x.com/rohanpaul_ai/status/2057177976492720363
4. 冲刺 9 月上市,OpenAI 最快本周五提交 IPO 招股书草案
IT之家(RSS) · 昨天 06:45
据CNBC报道,OpenAI预计最快本周五递交首次公开募股(IPO)招股书草案,这标志着公司向资本市场迈出关键一步。首席执行官萨姆·奥尔特曼设定最早于2026年9月上市的目标。公司正与高盛和摩根士丹利合作,借助这两家投行的资源推动上市申报和承销安排。此前,埃隆·马斯克针对OpenAI的诉讼失利后,上市障碍消除,进程明显加速。OpenAI目前私募估值超过8500亿美元,若顺利推进,可能成为公开市场历
监管/资本新发布
https://www.ithome.com/0/953/090.htm
5. 首部100%AI生成电影亮相戛纳,剑指2026院线
X:可灵 Kling AI (@Kling_ai) · 21 小时前
AI电影项目RAPHAEL在戛纳亮相。该片由Mateo AI Studio与韩国MBC C&I的AI内容实验室联合开发,全程使用Kling AI视频模型进行制作,旨在实现独特的视觉效果与差异化的观影体验。项目计划于2026年登陆院线,其大规模制作旨在证明纯AI电影制作的工业可行性,标志着AI原生院线电影新趋势的开端。
能力进展
https://x.com/Kling_ai/status/2057295321831539054
6. Gemini与XPRIZE联合举办全球黑客松
X:Google AI for Developers (@googleaidevs) · 昨天 02:28
用Gemini构建,改变世界🌍 我们正与@xprize合作,发起一场全球黑客松,旨在利用我们全新的智能体工具解决现实世界的挑战。 点击加入:https://www.geminixprize.com/
能力进展
https://x.com/googleaidevs/status/2057166550243872920
7. 英伟达 2027 财年第一财季归母净利润 583.21 亿美元,同比增长 211%
IT之家(RSS) · 昨天 04:25
英伟达2027财年第一季度业绩创新高,营业总收入达816.15亿美元,同比增长85%。净利润为583.21亿美元,同比激增211%。数据中心业务是核心增长引擎,营收达752亿美元,同比大增92%。公司毛利率提升至74.9%,并宣布了800亿美元股票回购及提高季度股息。展望第二季度,公司预计营收为910亿美元。
基础设施
https://www.ithome.com/0/953/088.htm
8. 加州州长纽森签署首创性行政令,为应对AI可能带来的劳动力市场冲击做准备
X:Rohan Paul (@rohanpaul_ai) · 4 小时前
加州州长纽森签署行政令,首次将AI引发的失业问题正式列为公共政策议题,要求各部门研究遣散费、就业保险及员工持股等保障措施。该命令认识到AI可能渐进式替代岗位任务,而非一次性取代整个职位,因此计划建立新的劳动力数据看板,以更早捕捉行业受到的冲击。政策核心在于探讨如何将AI带来的生产力红利,通过股权、薪酬支持等方式在企业与员工间进行更公平的分配。同时指出,单纯的职业培训可能无法解决被AI彻底取代的岗位
监管/资本
https://x.com/rohanpaul_ai/status/2057555054387949848
9. SpaceX与Anthropic合作提供大规模AI算力服务
X:Elon Musk (@elonmusk, xAI) · 昨天 06:35
正如最近与@AnthropicAI扩大合作所展示的,@SpaceX正在大规模提供AI算力服务。 我们正在与其他公司进行类似合作的讨论。 随着时间的推移,特别是通过轨道数据中心,我们预计将以极高的规模提供AI服务。
基础设施
https://x.com/elonmusk/status/2057228707606196434
10. 谷歌的人工智能正遭到操纵。这家搜索巨头正在悄然反击
Hacker News 热门(buzzing.cc 中文翻译) · 昨天 00:20
谷歌的AI系统正面临被操纵的风险。为应对这一挑战,这家科技巨头已悄然启动防御措施,以保护其AI生成内容的结果免受恶意干扰。此举旨在确保搜索和AI服务的可靠性与可信度,反映了当前人工智能安全领域日益增长的对抗性问题。谷歌在未公开宣传的情况下,正在通过技术手段加强对其AI系统的防护。
监管/资本
https://www.bbc.com/future/article/20260519-google-tackles-attempts-to-hack-its-ai-results
11. 商汤连续十年领跑中国计算机视觉市场
X:商汤 SenseTime (@SenseTime_AI) · 21 小时前
商汤科技被IDC连续十年评为中国计算机视觉市场第一。其关键驱动因素包括:主导推进CV 2.0架构演进,原生嵌入生成式AI能力;海外市场扩展至12个国际区域,服务超500家企业客户并保持高留存率;以年度经常性收入增长为锚点实现盈利性增长;并从项目制交付转型为高度可扩展的AI平台。这一十年市场领导地位为其引领计算机视觉与生成式AI的融合浪潮奠定了基础。
https://x.com/SenseTime_AI/status/2057289342654300586
12. Intuit将裁员逾3000人,以重新聚焦人工智能
Hacker News 热门(buzzing.cc 中文翻译) · 19 小时前
软件公司Intuit宣布将裁员超过3000人,作为其战略重组的一部分。此次裁员旨在将公司资源重新聚焦于人工智能(AI)领域的发展,以适应技术趋势并提升长期竞争力。裁员规模约占其全球员工总数的10%。
https://techcrunch.com/2026/05/20/intuit-to-lay-off-over-3000-employees-to-refocus-on-ai
13. FSD正式登陆中国大陆市场
X:小互 (@xiaohu) · 22 小时前
FSD来了… 官宣进入大陆…
https://x.com/xiaohu/status/2057279976467218765
应用

应用与商业化

1. Datasette Agent
Simon Willison 博客 · 4 小时前
Datasette Agent是Datasette推出的首个可扩展AI助手,为用户提供对话式界面以查询数据,并支持通过插件生成图表。该工具基于其LLM Python库构建,是LLM与Datasette整合的重要成果。目前提供图表生成、AI图像创建和沙箱代码执行等官方插件。它既可运行于Gemini 3.1 Flash-Lite等云端模型,也支持通过LM Studio连接本地开源模型,具备可靠的工具调
能力进展基础设施新发布
https://simonwillison.net/2026/May/21/datasette-agent
2. Claude现已支持更多安全合规工具
Claude:Blog(网页) · 6 小时前
Anthropic宣布为Claude企业版及平台新增28项安全与合规工具集成。这些集成均通过Claude Compliance API实现,允许企业安全团队统一获取Claude的对话内容与活动事件,从而将其纳入现有的DLP、SIEM等监控与合规流程。新增合作伙伴包括Cloudflare、CrowdStrike、Microsoft Purview等28家供应商,覆盖数据安全、身份验证等多个关键领域,
能力进展基础设施监管/资本
https://claude.com/blog/compliance-api-security-partners
3. v2.1.147版本更新
Claude Code:GitHub Releases(RSS) · 3 小时前
本次更新引入了`Workflow`工具,支持确定性多智能体编排(默认关闭)。将`/simplify`命令重命名为`/code-review`,现可报告代码正确性问题并支持生成GitHub PR内联评论。改进了自动更新器(增加重试与错误报告)、大文件diff渲染性能,并优化了提示历史记录以避免重复条目。修复了多个关键问题,包括企业登录限制未生效、Windows下的PowerShell工具与终端闪烁问
能力进展监管/资本新发布
https://github.com/anthropics/claude-code/releases/tag/v2.1.147
4. Codex实现全天候跨设备安全操控Mac
X:OpenAI Developers (@OpenAIDevs) · 5 小时前
Codex随时随地,无处不在。 现在您的Mac无需解锁,Codex即可使用您的电脑。 通过手机,Codex可以安全地使用您Mac上的应用程序,即使屏幕关闭且处于锁定状态。 https://developers.openai.com/codex/app/computer-use#locked-use
能力进展监管/资本新发布
https://x.com/OpenAIDevs/status/2057536706778378692
5. 发布 Kotlin版ADK与Android版ADK 0.1.0:在Android及其他平台构建AI Agent
Google Developers Blog(RSS) · 7 小时前
Google发布了面向开发者的新工具包:Kotlin版ADK与Android版ADK 0.1.0。这两个工具包旨在帮助开发者构建AI Agent。其中,Kotlin版ADK将代理工作流引入后端项目开发;Android版ADK则专注于移动端应用,提供了构建AI代理所需的特定功能。此次发布为开发者提供了在Android生态及更广泛平台创建AI应用的官方工具基础。
能力进展新发布
https://developers.googleblog.com/adk-kotlin-android-building-ai-agents
6. 腾讯张军官宣操作系统层级 AI 助手"马维斯"正式上工,Windows、Mac、安卓端同步上线
IT之家(RSS) · 昨天 07:28
腾讯于5月21日发布了操作系统层级AI助手"马维斯",支持Windows、Mac和安卓平台同步上线。该助手具备文档归类解析、图片智能识别处理、系统维护等功能,并强调与操作系统深度集成,可调度不同模型处理任务,部分功能可在离线状态下使用。腾讯表示"马维斯"能完成市面主流Agent的大部分工作,并具备桌面操控手机应用等能力。这是继3月WorkBuddy和"龙虾"产品矩阵后,腾讯推出的又一AI助手产品。
能力进展新发布
https://www.ithome.com/0/953/096.htm
7. Google Stitch更新:AI设计助手实现全流程构建
X:Google AI for Developers (@googleaidevs) · 昨天 05:18
Google推出了其AI设计伙伴Stitch的多项重要更新。新功能支持实时流式构建设计,允许用户在不中断流程的情况下直接进行编辑和互动反馈。Stitch现已能够导入现有代码库或Design.md文件,基于实际生产组件进行设计以保持品牌一致性。同时,工具新增了动态界面生成功能,并可将设计项目直接导出为可分享的线上URL,简化了从原型到生产的部署流程。该工具现已面向全球用户开放。
能力进展新发布
https://x.com/googleaidevs/status/2057209295763300785
8. ChatGPT现已支持在PowerPoint中直接创建编辑演示文稿
X:ChatGPT (@ChatGPTapp) · 3 小时前
你是否曾这样想过:我真的不想做这个PPT。 好消息:ChatGPT现在可以直接在PowerPoint中创建和编辑演示文稿。 在PowerPoint中直接构建、更新、理解和优化演示文稿,同时保持幻灯片可编辑。 目前处于测试阶段,我们期待您的反馈 👀
能力进展新发布
https://x.com/ChatGPTapp/status/2057560276384563560
9. Viggle推出3D格斗派对游戏Fight Anyone 3D
X:Viggle AI (@ViggleAI) · 5 小时前
介绍Fight Anyone 3D🥊一款3D派对格斗游戏,可能是上班时玩起来最爽的游戏。 上传任何人的照片 → 一个可玩的3D格斗角色,带有语音、个性+招牌动作,由Viggle自研游戏引擎+模型打造。 公测期间100%免费+赠送20张礼品卡。玩得越多,赢得越多! 和同事对战。和朋友对战。和任何人对战。链接+教程+更多内容见下方推文串 ↓
能力进展新发布
https://x.com/ViggleAI/status/2057541072419520634
10. Codex周四更新:Appshots功能上线
X:OpenAI Developers (@OpenAIDevs) · 5 小时前
又是Codex周四,我们带来了更新。 首先是Appshots,一种将你工作上下文引入Codex的新方式。 在Mac上,按Command-Command即可将应用窗口附加到Codex线程。Codex会获取窗口的截图和文本,包括屏幕上不可见的内容。 Appshots已在Mac各计划中推出,企业版访问权限即将上线。
能力进展新发布
https://x.com/OpenAIDevs/status/2057530207976989179
11. 推出 Gemini for Home 赋能服务提供商与硬件合作伙伴
Google Developers Blog(RSS) · 7 小时前
Google 通过推出全栈 Gemini AI 解决方案扩展其智能家居生态系统。该方案集成了先进的摄像头智能、自然语言查询功能和日常活动摘要能力。它为服务提供商和硬件制造商提供了现成的参考设计与API,使其无需大量研发投入即可构建主动式、品牌化的智能家居服务。该计划旨在超越基础设备控制,迈向能够理解情境并实时响应用户需求的AI原生智能家居。
能力进展新发布
https://developers.googleblog.com/empowering-service-providers-and-hardware-partners-with-gemini-for-home
12. Shoplift by PixVerse快速生成平台原生广告视频
X:PixVerse (@PixVerse_) · 8 小时前
无需工作室,无需编辑队列。 将产品URL粘贴到Shoplift by PixVerse,几分钟内即可发布平台原生广告视频 --专为持续进行创意测试的DTC团队打造。 免费早期访问:https://shoplift.pixverse.ai 转发+关注+回复=300积分(仅限72小时)
能力进展新发布
https://x.com/PixVerse_/status/2057492991036588306
13. 在OpenCode中使用Grok
xAI:News(网页) · 昨天 08:00
xAI宣布,其SuperGrok或X Premium订阅用户现可在开源编程工具OpenCode中使用Grok模型。OpenCode提供终端或独立桌面应用两种形式,用户连接Grok账户后,即可调用驱动xAI终端编程代理的Grok Build模型进行开发。该集成通过xAI Grok OAuth实现认证接入,官方表示未来将推出更多开源代理及集成方案。
能力进展新发布
https://x.ai/news/grok-opencode
14. OpenClaw 2026.5.19版本发布
X:OpenClaw (@openclaw) · 昨天 04:53
OpenClaw 2026.5.19 🦞 📱 Android Talk Mode 实现实时化 🍎 Mac 设置界面更清爽 🔐 xAI 登录支持无头模式 🧵 Telegram 话题功能更稳定 大版本更新,简短公告。 https://github.com/openclaw/openclaw/releases/tag/v2026.5.19
能力进展新发布
https://x.com/openclaw/status/2057202955581809093
15. Gemini扩展应用连接,支持更多服务
X:Gemini (@GeminiApp) · 4 小时前
Gemini现在可以连接更多应用,包括@OpenTable、@Canva和@Instacart。 无论您是预订餐厅、制作传单还是订购杂货,Gemini不仅能查找信息,还能通过连接的应用帮助您无缝采取行动。
能力进展新发布
https://x.com/GeminiApp/status/2057550225863246236
16. 合作伙伴如何运用Opus强化网络安全
Claude:Blog(网页) · 6 小时前
多家企业正利用Claude Opus模型强化网络安全防御。Wiz通过其Red Agent,每周对超过15万个生产资产进行持续渗透测试,发现数千个高风险漏洞且误报率为零。Palo Alto Networks在不到三周内完成了相当于一年的渗透测试工作量。埃森哲将安全测试覆盖率从约10%提升至80%以上,涉及1600个应用和50万+个API,扫描周期从3-5天缩短至1小时内。应用主要围绕三个方向:开展大
能力进展监管/资本
https://claude.com/blog/how-our-partners-are-putting-opus-to-work-for-cybersecurity
17. V8.1新增反向提示功能
X:Midjourney (@midjourney) · 昨天 03:38
今日小幅更新。许多用户要求为V8模型恢复"反向提示"功能(旧版本已有),我们称之为--no标志。该功能现已在V8.1中上线!如果您想从图像中排除某些元素(例如人物),可以尝试使用--no people。玩得开心!
能力进展新发布
https://x.com/midjourney/status/2057184157869199429
18. ChatGPT移动端支持Codex,实现跨设备协作
X:OpenAI Developers (@OpenAIDevs) · 昨天 00:54
你的笔记本电脑可以留在家里。 通过ChatGPT移动应用使用Codex,随时随地回答问题,之后还能在电脑上继续同一对话。
能力进展新发布
https://x.com/OpenAIDevs/status/2057142816497906045
19. GPT-5即将发布
X:ChatGPT (@ChatGPTapp) · 昨天 03:16
GPT-5即将发布 🚢
能力进展新发布
https://x.com/ChatGPTapp/status/2057178633249394819
20. Krea 2 推出 LoRA 微调系统
X:Krea AI (@krea_ai) · 9 小时前
为 Krea 2(测试版)引入 LoRA。 我们迄今最强大的微调系统;现在你可以用惊人的精度,在 Krea 2 上训练你自己的特定风格、对象或角色。 了解其工作原理 👇
基础设施新发布
https://x.com/krea_ai/status/2057468861583347774
21. MiniMax语音模型新增600余种声音
X:MiniMax (@MiniMax_AI) · 昨天 03:10
600多种由MiniMax Speech 2.8 Turbo驱动的新声音现已登陆Together AI @togethercompute 🎙️✨ 立即体验:https://voicefinder.together.ai/minimax--speech-2.8-turbo
能力进展
https://x.com/MiniMax_AI/status/2057177048356180296
22. Gemini每日简报助你高效规划一天
X:Gemini (@GeminiApp) · 7 小时前
用Daily Brief开启高效一天。 Gemini现在能主动将最重要的事项整理成易于理解的待办清单,让你在早餐结束前就为一天做好准备。
能力进展
https://x.com/GeminiApp/status/2057500470147698936
23. AI视频一致性始于动作之前
X:PixVerse (@PixVerse_) · 昨天 23:00
AI视频的一致性始于动作之前。 对于这个15秒的烹饪短片,我们首先在PixVerse中生成了一个清晰的角色分镜。 然后将其用作视频的参考。 相同的角色。清晰的故事节点。 镜头指导。动作细节。 转发 + 关注 + 回复 = 分镜工作流
能力进展
https://x.com/PixVerse_/status/2057114262145818752
24. Replit企业版现已开放自助购买
X:Replit (@Replit) · 8 小时前
Replit Enterprise现已支持自助服务! 几分钟内即可: - 购买Replit Enterprise - 配置SSO + SCIM - 与团队开始协作开发 无需合同谈判,无需等待。
新发布
https://x.com/Replit/status/2057491954825674942
25. 上下文压缩技术提升搜索效率与准确性
X:Perplexity (@perplexity_ai) · 昨天 01:26
我们已将查询感知压缩技术投入生产,以实现更快、更清晰、更准确的搜索。 更好的上下文优于更多的上下文。 我们的系统可将上下文令牌最多削减70%,同时提升回答质量。
https://x.com/perplexity_ai/status/2057151002105753950
研究

研究与开源进展

1. ZCube:超大规模大模型推理的网络优化
智谱:研究(网页内嵌数据) · 昨天 03:51
针对超大规模大模型推理,ZCube网络架构通过取消Spine层、将Leaf交换机分组并全互联等创新设计,有效解决了推理网络的拥塞问题。该架构在集群实测中,实现了交换机与光模块资本支出减少33%、GPU平均推理吞吐提升15%,同时将首token延迟的P99值大幅降低40.6%,在降低成本的同时显著提升了推理性能。
能力进展基础设施
https://www.zhipuai.cn/zh/research/160
格局

观点、资本与监管

1. 核算OpenAI和Anthropic最新动态背后的数学
Gary Marcus:The Road to AI We Can Trust(RSS) · 6 小时前
OpenAI与Anthropic近期相继发布重要产品更新。Claude 3.5 Sonnet在多项基准测试中超越GPT-4o,同时宣布API价格下调50%。Anthropic披露其模型训练成本年均增长约3.2倍,而OpenAI被曝已通过企业服务实现单季度超10亿美元营收。两家公司在技术突破与商业化竞赛中,正通过精密的成本核算与性能权衡重塑行业格局。
能力进展基础设施新发布
https://garymarcus.substack.com/p/checking-the-math-behind-openai-and
2. 构建云端智能体的经验总结
Cursor Blog · 12 小时前
云端智能体已从本地智能体的简单扩展,发展为具备独立环境、可并行无人值守处理长任务的系统。构建的核心经验在于:完整的开发环境是输出质量的关键,这需重建大量基础设施;可靠性方面,团队从自研架构迁移至Temporal平台,将可靠性提升至99.9%以上,该平台每日处理超5000万次操作,支撑超40%的代码拉取请求;同时,实现了智能体循环、机器状态与对话状态的解耦,以适应复杂的跨环境协作。
能力进展基础设施
https://cursor.com/blog/cloud-agent-lessons
3. 开源Suno技能:一键生成任意风格AI音乐
X:Vista (@vista8) · 21 小时前
这是基于Suno AI音乐生成工具的技能实现,可通过简单指令按用户需求生成不同风格的歌曲(例如德语空灵风格)。该技能订阅费用为每月10美元,支持高度自定义的风格生成。技术层面已优化,新增近6000个音乐风格检索以提升准确性,并可通过谷歌CDP免登录直接调用。项目已开源,提供GitHub仓库地址与安装指令,降低了创作门槛。目前AI生成音乐在艺术性上仍与人工制作存在差距,但实现了快速、灵活的创作可能。
能力进展新发布
https://x.com/vista8/status/2057287459759698400
4. 开源插件为Codex App增添高级功能
X:Vista (@vista8) · 昨天 23:41
一个开源项目允许用户增强Codex App的功能。即使通过API登录,也能通过安装插件的方式启用Computer Use特性并添加Goal指令。项目还支持界面自定义,例如调整为类似Chrome浏览器的顶部Tab样式,并可设置任务开始和完成的提醒音效。相关开源项目地址已在评论区提供。
能力进展新发布
https://x.com/vista8/status/2057124658927812758
5. OpenRouter自动路由缓存机制说明
X:OpenRouter (@OpenRouter) · 昨天 23:56
提示💡 你无需担心自动路由(以及所有单独模型)的缓存未命中问题 OpenRouter会将你的会话固定在一个模型/提供商上,直到缓存过期
能力进展新发布
https://x.com/OpenRouter/status/2057128446300737702
6. Cloudflare首席执行官谈如何决定用人工智能取代哪些员工
Hacker News 热门(buzzing.cc 中文翻译) · 5 小时前
Cloudflare首席执行官在《华尔街日报》撰文,分享其公司用AI替代部分员工的决策逻辑。该文于2026年5月21日发布,引发了技术社区的广泛讨论,在Hacker News上获得100个点赞。
基础设施新发布
https://www.wsj.com/opinion/how-i-choose-which-cloudflare-employees-to-replace-with-ai-40a197e5
7. 游戏开发门槛被AI大幅降低
X:阿易 AI Notes (@AYi_AInotes) · 16 小时前
Grok展示了AI深度介入游戏开发的全新工作流。通过"提示词生成角色图→图片转动画视频→自动拼接成Spritesheet→导入引擎"四步流程,将传统需要美术与动画师耗时数天的工作,在几分钟内完成。这标志着AI不再仅生成静态内容,而是能实时生成可直接导入Unity或Godot等游戏引擎的可运行资产。该技术极大压缩了游戏原型的迭代周期,将反馈循环从"天"缩短至"秒",使得独立开发者也能快速实现创意,显
能力进展
https://x.com/AYi_AInotes/status/2057371332359201103
8. 谷歌高级副总裁曼尼卡:AI短期内不会摧毁就业市场
IT之家(RSS) · 16 小时前
谷歌高级副总裁詹姆斯·曼尼卡近日表示,AI短期内不会摧毁就业市场,也不同意"大规模失业"的激进预测。他援引其2017年参与的麦肯锡报告指出,自动化将同时导致岗位减少、新岗位出现以及现有岗位被重新定义。他认为当前争议在于这三种情况的占比,而非是否发生。曼尼卡批评AI行业放大了公众焦虑,这种恐慌可能削弱技术价值。他强调,AI最大的影响是改变工作内容与方式,而非让职业消失。
https://www.ithome.com/0/953/469.htm
9. SpaceX的无限野心:AI企业集团
Tomer Tunguz 博客(VC 分析) · 昨天 08:00
SpaceX在提交S-1文件后,展现为一家AI时代的企业集团。公司由三大业务构成:Starlink(星链)、太空业务与AI业务。2025年总营收达187亿美元。其中,星链是绝对的核心与现金引擎,贡献了61%的营收并实现39%的营业利润率。太空业务收入占比22%,而AI业务(含X平台与xAI)虽仅占17%且处于巨额投入阶段,但代表了未来的战略方向。整体上,星链的强劲盈利为公司的太空探索与AI雄心提供
https://www.tomtunguz.com/spacex-s1-analysis