AlchainHust / 花叔, op7418 / 歸藏(guizang.ai), oran_ge / Orange AI | GLM-5.2 发布并登顶 Design Arena,开源权重模型
智谱AI发布并开源GLM-5.2模型,支持100万token上下文和思考力度控制,在Design Arena评测中升至第一,Elo分数达1360,超越Claude Fable 5。模型采用IndexShare稀疏注意力机制降低计算量约2.9倍,API定价与GLM-5.1相同,以MIT许可证开源。
op7418 / 歸藏(guizang.ai) | SpaceX以600亿美元估值收购Cursor
SpaceX以全股票交易方式、600亿美元估值收购AI编码工具Cursor。Cursor仅几十人团队,此前已与SpaceX AI联合训练模型数月,合作成果将发布在Cursor和Grok Build中。
op7418 / 歸藏(guizang.ai) | Midjourney 宣布首款硬件产品发布
Midjourney将于2026年6月17日在旧金山发布首款硬件产品,同步直播。
op7418 / 歸藏(guizang.ai) | Framer 上线 Agent 能力
网页构建工具Framer上线Agent能力,但其推出速度被认为太慢。
No Priors Podcast | Satya Nadella: Microsoft's Next Ambitions With AI
微软CEO Satya Nadella在No Priors Podcast中介绍微软在AI领域的下一步雄心和规划。
openai-codex-releases | OpenAI Codex Rust v0.141.0-alpha.4 预发布
OpenAI Codex发布Rust版本v0.141.0-alpha.4预发布版。
OpenAI X | OpenAI 发布模拟部署安全研究
OpenAI发布新研究方法,通过模拟部署使用去标识化用户请求来预测模型在真实世界中的行为,该方法已扩展到代理部署场景。
OpenAI X, OpenAI YouTube | OpenAI 评估方法演进与播客讨论
OpenAI公开讨论评估方法局限性(基准饱和、被游戏化),并在播客中由研究负责人Tejal Patwardhan分享内部视角:模型能力进步速度超预期,开发中转向长周期自主任务评估,认为2026年将是“非常疯狂的一年”。
ChatGPT X | ChatGPT iOS 拍照上传改进
ChatGPT iOS应用推出大幅改进的拍照和上传照片方式,强调速度提升。
OpenAI X, thsottiaux / Tibo | Codex 欧洲功能扩展上线
Codex正在欧洲(EEA、英国、瑞士)推出新功能,包括Computer Use、Chrome扩展、个性化记忆和Chronicle;此前容量问题已修复。
claude-code-releases | Claude Code v2.1.179 发布
Claude Code发布v2.1.179版本,修复多个连接中断、滚动、沙箱和界面问题,主要提升稳定性和WSL2环境下的用户体验。
Anthropic X | Anthropic 发布领域专家与AI编程成功率研究
Anthropic发布新研究:领域专家在使用AI编程时成功率更高,但中高级用户之间差距不大,表明领域熟练度足以胜任编程,挑战了仅有深度编程专家才能用好AI代码工具的常见认知。
Claude Devs X | Claude Managed Agents 博客发布与推广
Anthropic/Claude官方开发者账号发布Claude Managed Agents博客,介绍企业如何将AI代理投入生产,涵盖凭证管理、沙箱隔离、可观测性等挑战,并附有案例研究和入门指南。
Anthropic X | Anthropic 发布Claude Code经济研究框架与工作追踪
Anthropic发布最新经济研究,提出追踪Claude Code扩展的框架,关注用户画像、任务价值变化及领域专长对会话成功的影响,并宣布引入新指标实时追踪工作性质变化,纳入Anthropic经济指数。
canghe / 苍何 | 苍何发布Codex实战指南 CodexGuide
作者苍何在GitHub开源《Codex实战指南》(CodexGuide),按四层结构(认识入口、跑通任务、建立方法、团队沉淀)组织,包含桌面端CLI、手机端远程控制的教程和13个实战案例。
rwayne / Roland.W | 腾讯workbuddy与ima知识库打通
腾讯企业协作工具workbuddy已与ima知识库打通,可组合形成知识库售卖方案。
Thariq | Slack 支持HTML附件渲染
Slack更新后支持渲染HTML附件,而非仅显示难读的原始文本,解决了用户分享Claude生成的HTML文件的需求。
vista8 / 向阳乔木 | Figma Chrome 插件发布,支持网页元素提取
Figma推出Chrome插件,可将任意网页元素转换为可编辑图层面板并直接粘贴到Figma中继续编辑,极大简化了仿站流程。
vista8 / 向阳乔木 | Codex 快速开发音乐 App 示例
作者利用Codex在机场等候时间快速开发了一个支持离线播放AI生成音乐的个人App。
wadezone / Koda | 英区PayPal注册教程
Koda分享英区PayPal详细注册教程,涵盖准备、注册、开卡和风险提示,强调英区比美区风控宽松。
wadezone / Koda | Codex 复刻前端页面展示
Koda展示使用Codex的/goal命令、CDP和Chrome插件,仅通过提示词就能1:1复刻知名产品首页,包含复杂动效。
canghe / 苍何 | 苍何分享AI辅助视频制作经验
作者苍何用AI辅助制作8分钟视频,AI参与脚本、自动分镜剪辑和封面设计,粗糙剪辑耗时约5小时,优化后有望缩短至4小时。
rwayne / Roland.W | 小红书赚钱能力与粉丝量不成正比分析
Roland.W指出在小红书上赚钱的关键是内容品类选择和变现方式,而非粉丝数量,列举粉丝千人均月入十万和十万粉丝月入几千的反差案例。
rwayne / Roland.W | 12个暴利行业共同点分析
作者列举医美、口腔、眼镜等12个暴利行业,认为其共同点是利用人们恐惧和焦虑(怕老、怕丑、怕落后等)来盈利,成本低但收益高。
智谱AI今天正式发布并开源了GLM-5.2模型。该模型支持100万token上下文,引入了IndexShare稀疏注意力机制,可将计算量降低约2.9倍。在Design Arena评测中,GLM-5.2以Elo分数1360超越Claude Fable 5,登顶榜首。模型采用MIT许可证开源,API定价与GLM-5.1保持一致。这意味着一条此前被认为难以走通的路线——通过稀疏注意力实现高性能开源模型——得到了有力验证。如果你正在评估模型选型或成本控制方案,GLM-5.2的出现提供了一个重要的新选项:它不仅性能领先,而且开源权重和一致的API定价意味着更低的部署门槛和更可控的长期成本。IndexShare机制的思路也可以迁移到你团队内部的推理优化工作中,尤其是那些需要处理长文档或大规模上下文的场景。
Anthropic官方开发者账号发布了一篇深度博客,聚焦企业如何将AI代理从实验阶段推进到生产环境。文章详细覆盖了团队在此过程中面临的关键挑战——凭证管理、沙箱隔离、可观测性,并附有多个企业案例研究和一份入门指南。这篇博客的价值在于,它将“代理生产化”这一模糊概念拆解为一系列可操作的工程决策。如果你所在的团队正在或计划将AI代理集成到核心业务流程中,这里提供的案例和方案可以直接作为架构参考。更值得关注的是,文中对凭证管理和安全隔离的处理方式,可以迁移到你所负责的任何涉及外部API调用的系统设计中。
Anthropic发布了一项新的经济研究,核心是提出一个追踪Claude Code扩展影响的框架。该框架关注三个维度:用户画像的变化、任务价值的重新分布,以及领域专长对成功使用AI编码工具的影响。Anthropic还宣布将这些新指标纳入其经济指数,以实现对工作性质变化的实时追踪。这份研究改变了“AI工具对所有开发者影响相同”的朴素判断。对于技术管理者而言,它提供了一个分析团队中不同角色如何被AI工具赋能的工具。你可以将这个框架应用到自己的团队中,观察哪些类型的任务和哪些团队成员从AI工具中受益最多,从而更精准地分配资源和调整培训方向。
OpenAI今天公开了一项新的安全研究方法:通过模拟部署(使用去标识化的用户请求)来预测模型在真实世界中的行为。研究表明,模拟部署能将评估意识降低到接近真实生产流量的水平,且该方法已成功扩展到代理部署场景。这项研究的核心价值在于,它提供了一种在模型公开发布前就能预判其真实表现和潜在风险的工程手段。如果你负责模型的发布或更新流程,这套方法论可以直接启发你的预发布评估设计。将模拟部署引入到你的测试流程中,也许能在很大程度上减少发布后才发现意外问题的尴尬和损失。
OpenAI内部研究负责人Tejal Patwardhan在一期播客中坦率地讨论了当前评估体系的瓶颈:基准测试趋于饱和、容易被游戏化。她透露,OpenAI正在将评估策略转向长周期的自主任务,因为模型在持续任务和复杂工作流中展现出的能力已经超出了实验室内的预期。她的判断是:2026年将是“非常疯狂的一年”。这期播客值得所有从事AI产品评估或开发的人从头看到尾。它打破了一个常见的认知:模型能力增长放缓。实际上,能力增长的方式正在从“单点突破”转向“长周期自主任务”,而当前的评估体系滞后于此。如果你正在设计你的产品评测指标,现在是重新思考评估维度的时候了——从短周期、单一维度的基准,转向更接近真实使用场景的长周期、多步骤任务。
作者苍何在GitHub开源了一份名为《Codex实战指南》(CodexGuide)的系统化教程。该指南按四层结构组织:认识入口、跑通任务、建立方法、团队沉淀。内容涵盖桌面端CLI操作、手机端远程控制,并包含13个从实际项目中提炼的实战案例。这份指南不仅是一份工具手册,更是一套将AI编码工具嵌入团队工作流的方法论。如果你所在的团队正在尝试普及Codex或类似的AI编码工具,第3层和第4层——“建立方法”和“团队沉淀”——直接回答了“如何让整个团队而非个别人用好它”的问题。其中的案例可以成为你内部培训的素材,而整体结构可以作为你制定团队AI工具体验的框架。
据多方消息,SpaceX以全股票交易方式收购了AI编码工具Cursor,交易估值为600亿美元。Cursor团队仅有几十人,但此前已与SpaceX的AI团队联合训练模型数月,合作成果将分别发布在Cursor和Grok Build中。这不仅是AI编码工具领域迄今为止最大的一笔并购,更是对“AI编码工具能否成为独立商业实体”这一问题的有力回答。600亿美元的估值直接资本化了市场对AI编码工具长期价值的判断。对于创业者而言,这是一个清晰的信号:在你专注于构建AI应用时,编码和开发工具本身就是一个足够大的市场。对于技术选型者,这笔交易也意味着Cursor的技术路线和与SpaceX协同下的快速进化,值得持续关注。
开发者Koda展示了一项令人印象深刻的实践:使用Codex的/goal命令,结合CDP协议和Chrome插件,仅通过一条提示词就1:1复刻了某知名产品的首页页面,包括其中的复杂动效。他附上了提示词的视频截图,证明了复刻的精确度。这个案例改变了“复杂的交互式前端无法通过单一提示词生成”的认知。如果你是一名前端开发者或产品设计师,这条内容直接打开了你的想象力:未来,从设计稿到可交互页面的差距可能被压缩到一次对话中。更具体地说,这种“提示词 + CDP + 浏览器插件”的组合思路,可以迁移到你自己的原型验证工作中,将UI复刻和效果测试的成本降到几乎为零。
Figma今天推出了一款Chrome插件,核心功能是将任意网页元素一键转换为可编辑的图层面板,并直接粘贴到Figma中继续编辑。这意味着,过去需要手动截图、抠图、重建的设计过程,现在可以通过一个浏览器插件瞬间完成。对于UI设计师和需要频繁参考竞品页面的人来说,这个工具改变了工作流的天花板:从“看一个页面,然后凭记忆和截图去复现”,变成了“直接把页面结构和元素拿到编辑器里修改”。一个可迁移的判断是:任何“从外部获取信息 + 在内部工具中重建”的重复流程,都可能被类似的“提取-注入”工具所取代。你可以开始关注自己的工作中是否也存在这样的低效链条。
今日暂无内容。