AlchainHust / 花叔、op7418 / 歸藏、oran_ge / Orange AI、vista8 / 向阳乔木 | DeepSeek V4 Pro 0813 正式版发布
今日最重磅消息:DeepSeek V4 Pro 0813 正式版发布。流传的测试成绩显示其性能接近或超越 Opus 4.8/Fable 5,且性价比极高,已可在 OpenCode Go 中使用。多位独立账号同日实测了网站开发、设计风格模仿和 3D 游戏生成等任务,效果尚可。
op7418 / 歸藏、vista8 / 向阳乔木、wadezone / Koda | Grok 4.6 模型发布
xAI 同日发布 Grok 4.6,性能较 4.5 显著提升,输入每百万 token 2 美元、输出 6 美元,Twitter Premium+ 会员可免费使用。用户对比测试认为其一次成功率略优于 DeepSeek V4 Pro,但 DeepSeek 价格更低。
claude-code-releases | Claude Code v2.1.229 版本发布
新增远程控制会话恢复命令、插件市场命令源和流式保活机制,并修复多个崩溃问题,工具稳定性进一步提升。
vista8 / 向阳乔木 | 腾讯微信团队发布 WeLM 大模型
腾讯微信团队发布大型语言模型家族 WeLM,强调以资源效率为核心。与 Grok 4.6 等模型同日发布,引发社区关注,但性能、定价等关键细节尚未披露。
Claude Blog / Claude | Claude Cowork 集成至 Chrome 侧边栏并支持跨设备同步
Anthropic 官方宣布 Claude Cowork 现集成到 Chrome 侧边栏,会话可跨桌面、网页和移动端同步,并新增针对提示注入的防御机制。该功能对 Max 和 Team 计划用户立即开放,Pro 用户将在未来几周内获得。
Nate Herk - AI Automation | Claude Code 创建者分享精简配置建议
Claude Code 创建者 Boris Churnney 在访谈中建议,现代模型如 Opus 5 不需要过多技能、系统提示和指令,应转向更高层次的任务描述和目标设定。对优化 AI 编程工作流具有实践指导价值。
a16z YouTube / Y Combinator YouTube | Y Combinator 频道发布 AI 相关访谈
发布两期涉及 AI 的访谈节目:一期由 a16z 频道讨论 AI 时代创始人心理,另一期邀请 Chelsea Finn 探讨机器人学前沿技术,适合作为有深度的行业内容信号。
rwayne / Roland.W | 豆包AI开始收取佣金
据社交媒体消息,豆包 AI 开始向用户或合作伙伴收取佣金,涉及商业化变现模式变化,对内容创作者和平台合作方可能产生实际影响,具体细节待披露。
8 月 13 日,DeepSeek V4 Pro 正式版(0813)发布,随即在技术社区引发连锁反应。多个独立信源在同一天集中转发并实测了这一模型:流传的测试成绩显示其性能已接近甚至超越 Opus 4.8 与 Fable 5,而价格却保持在远低于竞争对手的水平。用户实测覆盖了网站开发、设计风格模仿和 3D 游戏生成等任务,整体评价为"效果尚可"——考虑到其定价,这一表现构成了极强的性价比信号。值得注意的是,该模型已可在 OpenCode Go 中直接使用,意味着从发布到进入实际工具链的间隔被压缩到了几乎为零。社区将这一天称为"疯狂星期三",因为同日还有 Grok 4.6 等重磅发布,模型竞争烈度可见一斑。
这条信息值得深读的原因在于它同时改变了两个判断:第一,高性能模型的定价锚点正在被重新定义,DeepSeek V4 Pro 在接近顶级模型性能的同时保持价格优势,意味着"高性能"与"高成本"之间的绑定关系正在松动;第二,模型选型的决策框架需要从"哪个模型最强"转向"在特定任务和预算约束下哪个模型最合适"。对于任何依赖大模型 API 的团队或个人,这是一个重新评估模型组合和成本结构的时机。可迁移的判断是:当一个新的高性能低价模型出现时,不要只看基准分数,而要在自己的真实工作负载上做一次并行测试——社区评测显示"一次成功率"比基准分数更能预测实际体验。
Anthropic 官方宣布 Claude Cowork 集成至 Chrome 侧边栏,并且桌面、网页、移动端共享同一个会话——这意味着你在浏览器里交给 Claude 的任务,可以回到桌面继续推进,对话历史、技能和自定义指令都会随账号同步。该功能对 Max 和 Team 计划用户立即开放,Pro 用户将在未来几周内获得。更值得留意的是官方同步发布的提示注入防御机制的说明:浏览器代理可能被页面中隐藏的指令欺骗,Anthropic 明确表示已构建防御策略,但仍建议用户对高权限操作保持警惕。这是首批由主流 AI 厂商就浏览器代理安全风险做出系统性回应的官方说明之一。
这篇官方博客值得细读的原因在于它把"浏览器自动化"从一个实验性功能推向了可依赖的工作流基础设施。它改变的判断是:此前浏览器代理类工具的最大障碍不是能力而是安全性与状态连续性——页面上下文丢失、会话断裂、注入攻击风险都让实际使用成本居高不下。现在跨设备同步与防御机制同时落地,意味着把重复性网页操作(数据整理、表单填写、信息核对)委托给 AI 代理的门槛显著降低。可迁移的启发是:评估任何 AI 代理工具时,安全性设计(而非单纯的能力上限)应作为一票否决项;"对话能否跨设备延续"则是判断一个工具是否真正融入工作流的关键指标。
a16z YouTube | Y Combinator CEO on Founder Psychology in the Age of AI
Y Combinator CEO on Founder Psychology in the Age of AI
时长:51:28
Joe Rogan / PowerfulJRE | Joe Rogan Experience #2538 - Joe DeRosa
Joe Rogan Experience #2538 - Joe DeRosa
时长:2:41:27
Nate Herk - AI Automation | 3 Secret Ways Claude Code’s Creator Actually Uses It
3 Secret Ways Claude Code’s Creator Actually Uses It
时长:11:56
Why Not TV | T1 vs JDG半决赛现场!我真的在努力控温了!
T1 vs JDG半决赛现场!我真的在努力控温了!
时长:9:57
Y Combinator YouTube | Chelsea Finn: This is the State of the Art in Robotics
Chelsea Finn: This is the State of the Art in Robotics
时长:58:18
只回答一个问题:如果今天要 build,有没有新的产品方向值得优先考虑?
今天没有足够新的产品/需求/收入信号形成新的 Top 5 build choices。
最近几天已经反复出现过的方向已隐藏;没有必要把同样的 5 个方向换顺序再推一次。