栖居在城市的大地上,分享城市中的感想予你,在留言板留下你的足迹,希望你在这里有所收获,祝幸运

一个年轻人,一个小镇青年,如果获得更好的人生,第一步要摆脱异托帮,凡是别人向你建构、推销那些快乐,要一概拒绝;虽然你做不到,我还是愿意这么提。然后把那些所有的及时性的,就像那个肥宅水一样,能够让你瞬间高兴的东西,你都应该把它视若为敌人,是你生活中的毒药,你应该去做那些吃力不讨好的事情,比如说学一门技艺,精益求精锤炼一门技艺,这能够使你获得人生的支撑,或者你非常努力的去读书考一个好大学,也可以。这些东西才是你生活的真谛

最新文章

今日 AI 行业的两条主线在「能力边界」与「数据基础设施」上形成对照。AI Coding 侧,谷歌向全体工程师开放 Claude Opus 5,头部云厂商的编码工具选型正式从「自研优先」转向「按能力择优」;新基准 Real-SWE 把编码 Agent 放入企业私有代码库,最强模型成功率仍只有 38.8%。具身智能侧,全球首张机器人专用 SIM 卡与「具身智能机器人应用技术员」国家新职业同期落地,数据生产与回流正在被基础设施化、职业化。

谷歌向全体工程师开放 Claude Opus 5,Antigravity 成统一入口

9 月 15 日消息,据 Business Insider 等多家媒体援引内部消息人士与官方信息报道,谷歌近期调整内部政策,通过自研的内部开发平台 Antigravity 向全体工程师开放 Anthropic 旗下编码大模型 Opus 5 的使用权限。此前谷歌长期禁止多数员工使用 Claude Code、OpenAI Codex 等外部第三方编码工具,要求内部开发优先使用自研 Gemini;Claude 的权限仅面向 DeepMind 旗下少数核心团队开放。新规下,所有谷歌工程师均可在内部版 Antigravity 中访问 Opus 5,使用行为在平台统一管控下完成,不存在数据外溢。谷歌发言人回应称,Claude 在内部体系中的定位是 Gemini 的补充而非替代,第三方模型按用户配额管控,仅用于支撑 Gemini 无法覆盖的细分场景。

值得关注:政策的实质让步来自能力差距——尽管谷歌已投入数十亿美元迭代 Gemini,近期也推出了性能升级的 Gemini Flash 3.8,但多名内部工程师仍反馈其代码编写能力与 Anthropic、OpenAI 同级别产品存在明显差距。其次,谷歌是 Anthropic 的核心投资方之一,今年早些时候已官宣计划累计投资最高达 400 亿美元,本次开放权限是投资关系向内部工程效率转化的具象动作。最后,这并非孤例:亚马逊今年早些时候同样在收到大量员工反馈后开放了 Claude 与 Codex 权限。头部云厂商的编码工具选型正在从「自研优先」转向「按能力择优」,模型层竞争由此进一步下沉到开发者工作流的入口层。

来源:https://3w.huanqiu.com/a/c36dc8/4TDZHIc3oH2

Real-SWE 基准发布:最强编码 Agent 在私有代码库上失败率仍超 60%

Y Combinator 支持的 Specific Labs 推出新基准 Real-SWE,它不采用从公开仓库抽取的题目,而是把编码 Agent 直接放进真实企业的私有代码库中执行日常工程任务,代码与解法均不公开,以降低训练数据污染的概率。结果显示,通过 Claude Code 运行的 Claude Fable 5.1 以 38.8% 的成功率居首,Codex CLI 上的 GPT-6 Astra 为 33.8%,Gemini CLI 上的 Gemini 3.8 Flash 为 31.2%,其后依次为 GLM 5.3(28.8%)、Grok 4.6 与 Muse Spark 1.3(并列 23.8%)、Kimi K3(18.8%)、GPT-5.6 Sol(16.2%),每个模型对每道题有 8 次尝试机会。任务层面的数据更低:10 道题中有 6 道成功率低于 15%,其中计费周期迁移 14.1%、API Token 计量 12.5%、S3 存储追踪 10.9%、可线性化扫描 4.7%、税务辖区 Bug 修复 3.1%;一道分析流式归约器题目在全部尝试中没有任何模型解出。

值得关注:38.8% 这个数字比「失败 60%」更值得细读。其一,Real-SWE 解决方案平均需修改 11 个文件,接近 FrontierCode、DeepSWE 等基准 6 个文件中位数的两倍,说明真实生产的难度增量主要来自跨文件理解与集成,而非单点算法能力。其二,失败归因高度集中在需求遗漏(36.7%)、集成错误(34.7%)与未经验证的假设(43.3%),这三类都指向同一个问题——代码写对了,但上下文没理解对,而这正是当下 Agent 工程最需要补的一环。其三,该基准样本仅 10 道题,尚不足以推翻公开榜单结论,但它与「企业侧约 99% 的 token 从未进入前沿模型训练数据」的判断相互印证:评估 Agent 能力时,自建私有任务集的价值正在超过公开排行榜。

来源:https://www.worldprogramming.org/posts/ais-best-coding-agent-fails-60-of-the-time-and-the-data-backs-it-up-azpjzi

云知声发布 U2-Flash:DeepSWE 得分翻倍,Agent 任务周期缩短 35%

9 月 15 日,云知声发布新一代高性能主力模型 U2-Flash。在代表编程能力的 DeepSWE v1.1 榜单中,U2-Flash 得分 64.6 分,较前代 U2 翻倍,超过 GLM5.3-Flash 与 DeepSeek-V4-Pro-0813;TerminalBench3.0 评分提升至 24.3 分,超过 K3 等万亿参数级别模型;SWE-Bench Pro 评分达 61.6 分,较前代提升 10.5 分。模型采用稀疏混合专家(MoE)架构,总参数约 266B、单次推理激活约 10B 参数,首字响应时间平均控制在 3 秒以内,峰值输出吞吐最高 300 Tokens/s。效率侧,Agent 任务迭代步数减少 20%-30%,任务执行周期缩短 35%,Token 消耗减少 20%-30%。

值得关注:这组数字的重点不在「翻倍」,而在效率项与成本项与能力项同步公布。国产模型的竞争叙事正从「参数量对标」转向「单位任务的步数、Token 与墙钟时间」,这三项恰好是 Agent 场景最真实的成本——上下文预算、推理账单与用户等待时长。对正在推进 Agent 落地的团队而言,选型的锚点也应随之从公开榜单分数,迁移到「自有任务集上的步数缩减幅度与单任务成本下降幅度」;厂商业绩沟通口径未独立复现,建议以自建小样本任务集做交叉验证。

来源:https://news.qq.com/rain/a/20260915A03LV800

全球首张具身机器人专用 SIM 卡诞生,打通「作业—数采—回流」闭环

扎根深圳龙华的乐聚机器人联合安徽电信、华为,发布全国首个 5G-A 具身智能专属套餐「具身翼联」,并同步落地业界首个 5G-A 具身人形机器人园区群体巡检应用示范,全球首张面向具身机器人的专用 SIM 卡由此诞生。该套餐针对机器人「高上行占比、低时延、多机并发」的网络特征设计,提供峰值上行 500Mbps、95% 场景下时延不超过 20 毫秒的网络能力,并对机器人业务做优先调度,分两档提供 500GB 高速上行流量及动态切片增强。应用侧,多台乐聚「夸父」机器人在园区沿 8 条主路线并行巡检,作业产生的高价值数据实时回传乐聚数采平台,经清洗、标注后反哺模型迭代。

值得关注:这张卡的价值不在连接本身,而在把「数据回流」从人工搬运变成网络原生能力。具身智能长期受困于数据:实验室搭场景、靠遥控操作采集,成本高、规模小、场景不真实,从采集到训练之间存在以月计的回路时延。当运营商第一次把机器人的网络需求当作独立品类来定义和定价,「巡检作业—实景数采—数据回流训练」就具备了可复用的基础设施通道——这正是国家人形机器人实景实训行动所倡导的路径。结合行业侧数据,2026 上半年中国人形机器人出货量已超 4 万台,全球占比达 97%,数据基础设施的成熟度将直接决定这批出货能否转化为模型能力的增量。

来源:https://local.cctv.com/2026/09/15/ARTIAWLl0Bm5aYL1JAp5bLgp260915.shtml

「具身智能机器人应用技术员」成为国家新职业,数据采集与训练岗位正式入册

在本月服贸会开幕当日,中国正式认定「具身智能机器人应用技术员」为一项新职业,其下包含机器人数据采集员与机器人训练师两个新工种。这一职业认定背后是训练场模式的规模化落地:某机器人训练中心内近 270 台机器人满负荷进行家务、护理演练与工厂任务(例如自动把电路板放置到产线)训练,每年产出近 2000 万条高质量数据。采集工具同步迭代:数据采集员不必再操纵固定实验室控制台,借助新的采集装置可直接进入真实现场记录人手作业过程;展会现场还有厂商展示第一人称视角的 360 度采集头戴设备、捕捉握持力度的触觉传感器,以及内置「大脑」模型的灵巧手。同期,服贸会上线了中国首个面向具身智能数据的行业级国际服务平台,由北京石景山科技创新集团与中国电信北京分公司共建;北京已登记国内首个面向大模型训练的三维高质量数据集,开设 4 个数据服务站、上架 200 余个数据产品,并计划到 2028 年形成 100 个高质量工业数据集。

值得关注:具身智能的数据生产正在从「实验室搭场景 + 遥控采集」转向「规模化训练场 + 职业化采集团队」,而国家职业认定是这一转变最明确的制度化信号——它意味着数据采集与训练从临时性作业变成长周期、可培养、可定价的专业岗位。更值得追踪的是能力归属问题:数据标准、采集 SOP、质量判断与数据配方应由谁掌握。当数据成为可跨境交易的商品,掌握数据标准与筛选方法的一方,会比单纯持有数据规模的一方更具定价权;这一点,从国内具身基座团队把「原始数据进入训练漏斗的可用率从早期约 15% 提升到 90% 以上」视为比预训练总时长更关键的指标,已经可以看出方向。

来源:https://en.ce.cn/main/latest/202609/t20260915_3214521.shtml

今日 AI 行业的核心叙事集中在「安全治理与产业落地」两端。Anthropic CEO 罕见公开呼吁放慢 AI 能力提升节奏,OpenAI 与 xAI 罕见同步响应;具身智能侧,优必选万台级人形机器人超级智慧工厂正式投产、普渡机器人累计出货突破 13 万台,显示中国厂商正把赛道从 Demo 推向规模化交付。AI Coding 方面,OpenAI Agents API 把 Codex Harness 转为托管云服务,通用工业机器人公司 Maven Robotics 拿到 1 亿美元 A 轮,印证 Harness + 垂直 Agent 是新一轮竞争焦点。

Anthropic 阿莫迪呼吁放慢 AI 能力提升,奥尔特曼与马斯克罕见响应

Anthropic CEO 达里奥·阿莫迪 9 月 12 日发表长文《We Must Pace the Frontier》,提出由「第三方嵌入式评估、行业内部协调、全球协调」组成的三步走框架,主张前沿 AI 公司应主动放慢模型能力提升节奏,以为安全研究争取时间;他同时警告,若继续以当前速度推进,递归自我改进(RSI)叠加 AI 智能体网络攻击事件,可能在未来 6-12 个月内带来大规模风险。OpenAI CEO 山姆·奥尔特曼随后表示 OpenAI 将引入拥有员工级权限的独立评估员,xAI 创始人马斯克仅以「达里奥说得对」六个字转发回应。值得注意的是,OpenAI 首席科学家雅库布·帕乔基近期也曾表态,目前没有任何一家 AI 实验室的对齐与监控能力足以支撑「无限期、最快速度」扩张。

值得关注:三家头部 AI 公司在公开层面首次就「放缓」达成方向性一致,标志前沿 AI 安全治理从行业边缘议题正式进入核心议程;但商业竞争与反垄断审查仍构成落地阻碍,「放缓」具体如何定义、第三方评估是否真的拥有「员工级权限」,将是后续观察的关键。

来源:https://news.qq.com/rain/a/20260914A03GGC00

优必选柳州万台级人形机器人超级智慧工厂投产,每 10 分钟下线一台

9 月 12-13 日,优必选位于广西柳州北部生态新区的「工业人形机器人超级智慧工厂」正式投产,这是全球首个适配万台级年产能的人形机器人智能制造标杆工厂,占地 1.4 万平方米,按照设计节拍每 10 分钟可下线一台工业人形机器人,年规划产能超 1 万台 Walker S 与 Cruzr 系列具身智能工业机器人。工厂与西门子深度合作,基于 Plant Simulation 搭建 1:1 全厂物流仿真,并联合开发 Yanshee MOM 制造运营管理系统作为「数字化智慧大脑」,实现工单排产、物料配送、设备调度、质量监控、立库仓储全链路闭环。物料供给与装配环节由 Cruzr Y1/S2 等具身机器人自主完成,真正落地「用机器人造机器人」的智造模式。

值得关注:产能规模是万台级,但根据优必选招股书,今年上半年全尺寸人形机器人实际销售仅 921 台——产能与订单的「吸收落差」是行业下一阶段的核心命题。同时,工厂每台机器人涉及 2000+ 颗、50 余种规格螺丝的精密装配,凸显「本体硬件」仍是人形机器人量产的关键瓶颈,而具身大模型的泛化能力(尤其是非结构化工厂任务之外的通用性)仍是悬而未决的难题。

来源:https://so.html5.qq.com/page/real/search_news?docid=70000021_3206aa6941557852

Maven Robotics 拿下 1 亿美元 A 轮,把通用工业机器人推向规模化部署

总部位于加州 Santa Clara 的 Maven Robotics 于 9 月 10 日宣布走出隐身模式,完成由 RoboStrategy 领投、LocalGlobe / Vine Ventures / XTX Ventures 等跟投的 1 亿美元 A 轮融资,累计融资 1.18 亿美元。不同于主流人形机器人叙事,Maven 走轮式底盘 + 双真空吸盘臂的路线,专注仓储与工厂的「混合箱码垛」(mixed-case palletizing)与料箱搬运,这一垂直场景在美国对应约 800 亿美元可寻址市场。Maven 透露其已在一家财富 250 强消费品客户的多班次场景中部署至多 8 台机器人,16 小时连续运行 uptime 达 99%+,预计 2026 年底累计自主运行超 10 万小时,2027 年底突破 100 万小时。

值得关注:Maven 切入的是「人形机器人之外的另一条工业自动化路径」——用轮式 + 通用 AI 软件替代人力,而不是用人形外观替代人力。在具身智能赛道普遍押注人形外观的当下,这种「反人形」的实用主义路线说明:工业场景的胜负手在于「能不能在三班倒的真实生产环境里稳定活下去」,而不是 demo 视频有多炫。其 1 亿美元 A 轮(成立仅 2 年)与高 uptime 数据,是 2026 年具身智能赛道回归商业本质的标志性事件。

来源:https://www.globenewswire.com/news-release/2026/09/10/3359782/0/en/maven-robotics-raises-100m-series-a-for-the-world-s-first-general-purpose-robotics-system-for-industrial-work.html

普渡机器人累计出货超 13 万台,完成「一脑多形」全形态布局

9 月 14 日,观点网披露深圳市普渡科技股份有限公司(普渡机器人)基于「具身导航、具身操作、具身交互」三大技术栈,实现「一脑多形」架构,完成专用、类人形、人形机器人的全形态布局,业务覆盖全球 85 个以上国家和地区,截至目前累计出货量超 13 万台,产品线涵盖配送、清洁、工业与通用具身智能四条主线。同一日,《人民日报》对 2026 世界机器人大会的现场评论进一步指出,具身智能正「褪去表演属性」,从「舞台上动起来」走向「家庭里用起来」「工厂里干起来」,京东展区已推出「方案订阅」模式并展示 80 个 RoboBase 机器人基地规划。

值得关注:普渡 13 万台累计出货证明,在人形机器人叙事之外,服务型机器人已经跑出真实的规模化路径;而「一脑多形」技术架构意味着同一套具身智能底座可以驱动多种形态本体,这与 UBTech 的「用机器人造机器人」、Maven 的「通用工业机器人」共同指向同一趋势——2026 年下半年具身智能正从「形态之争」转向「底座之争」,谁能跑通数据飞轮与商业闭环,谁就能拿到下一轮竞争的入场券。

来源:https://www.toutiao.com/article/7685081156038967844/

OpenAI Agents API 公测,Codex Harness 正式托管化

OpenAI 于 9 月 10 日上线 Agents API 公开测试版,把 Codex Harness 作为托管云服务开放给开发者——单次 API 调用即可创建生产级 Agent,OpenAI 负责长会话压缩、工具调度、subagent 协作与上下文恢复,开发者只需指定任务、模型、工具与运行环境(可托管沙箱、自有基础设施或与 Cloudflare / Vercel / Modal / E2B / Oracle 等九家沙箱伙伴集成)。Agents API 本身不单独收费,按模型 Token 与沙箱容器时长计费,典型客户案例显示子代理流可让评估分数从 0.71 提升到 0.85、延迟降低 4 倍,生产案例中单案件成本下降 60%。

值得关注:OpenAI 与 Anthropic 同时把 Harness 从「开源库」推向「托管运行时」,意味着 Agent 基础设施之争正式从「模型层」下沉到「Harness + 沙箱 + 状态」层——状态(工作目录、中间产物、密钥、技能、插件)放在沙箱层,则托管方获得粘性;状态被 OpenAI 抽象到 Harness 层(vault_ids、capability_directories 暗示了这一方向),沙箱就成了可互换算力。同时,Cursor Projects 等竞品正在用「协调多个云端 subagent」反击,新一波 AI Coding 竞争的核心战场已经从「哪个模型更强」转向「哪个 Harness + 状态系统更稳」。

来源:https://openai.com/index/introducing-the-agents-api

今日焦点:AI Coding 赛道从"单模型"走向"多模型编排"——Cognition Devin Fusion 成为首个多模型编码代理登上 Artificial Analysis 评测榜单,Codex 桌面端打通 Ollama 本地权重实现离线编码循环;GitSpawn 漏洞追踪显示仍有 4 款 Agent 未修复,安全警钟未熄。具身智能侧,北京石景山训练中心升级主打 4D 高斯光场与世界模型,浙江人形机器人 SPIRE 双模型体系签下 2000 台服装场景订单,"数据 + 模型 + 落地"闭环加速跑通。

Devin Fusion 成首个多模型编码代理登榜:前沿 lead + 廉价副手,质量与成本各占一边

Cognition 推出 Devin Fusion,作为首个在 Artificial Analysis Coding Agent Index 上正式评测的多模型编码代理。Fusion 把前沿 lead 模型(Claude Fable 5.1 或 GPT-6 Astra,xhigh 档)与 SWE-2(medium 档)作为廉价副手组合上线:Fable 主导配置得分 62、Astra 主导配置得分 59——Fable 略强,但 Astra 配置便宜 43%、速度提升 31%。同期,GitHub Copilot 的 HydraFusion 引擎按"推理深度/代码生成复杂度/调试难度/工具编排需求"四轴打分再选工作流;Sakana AI 的 Fugu Max v2 用 NVIDIA Nemotron 等开源权重做任务级动态路由,宣称 2-6 倍降本——多模型编排已成 coding agent 共识路线。

值得关注的原因:Coding Agent 的竞争从"谁家模型更强"升级到"怎么让多个模型各司其职"。对自研 Agent 工作流的开发者而言,"前沿 lead + 廉价副手"或"专用小模型侦察 + 主模型推理"是值得借鉴的工程范式;选 Coding Agent 工具时,"用什么模型"已不再是首要问题,"怎么调度模型"才是。

来源:https://agihunt.info/en/daily/2026-09-12

Codex 桌面端打通 Ollama 本地权重:离线编码循环正式成形

Reddit 截图显示 ChatGPT 的 Codex 桌面应用已可与 Ollama 服务的本地模型对接,编码代理循环可在开源权重上离线运行。同日 OpenAI 公开 GPT-6 Astra 配置指南:技能触发要具体、指引按需加载、任务提示中要明确"完成"标准——明显在补齐提示工程层的最佳实践。Codex 工程师 Thibault Sottiaux 同步回应了用户反馈:过去针对旧模型写的技能被频繁触发或阻断自检、约 4-5k 用户受影响的"上下文管理实验"已下线、因引擎误配置导致的尾部质量下滑也已回滚。

值得关注的原因:本地权重接入意味着"企业数据不出内网"也能跑完整编码循环,这对金融、医疗、政务等强合规场景是关键解锁;OpenAI 主动收敛技能触发和上下文管理问题,并公开 Astra 配置指引,说明头部厂商正在把"用户反馈—产品迭代"做成持续流程。

来源:https://agihunt.info/en/daily/2026-09-13

GitSpawn 漏洞 9 月 1 日复测:仍有 4 款 Coding Agent 未修复,攻击面持续暴露

Manifold Security 在 9 月 1 日对 GitSpawn 漏洞类进行复测,结果显示 8 个缺陷中仍有 4 个处于可利用状态:Hermes Agent、Qwen Code、Grok Build,以及 Claude Code 的第二配置路径。研究人员建议对陌生仓库使用 git -c core.fsmonitor=false status 显式关闭 fsmonitor。Cursor 与 OpenAI Codex 已完成修复;Claude Code 主路径也已修复(goose 1.44.0+、Codex CLI 0.131.0+、Claude Code 2.1.196+ 起针对 fsmonitor 路径),但 Claude Code 的次级配置路径仍是缺口。Accomplish 同期也披露了 Claude Code、OpenAI Codex、Cursor 上的沙箱泄漏问题——指出沙箱外软件对沙箱内产物的"信任接力"才是结构性根源。

值得关注的原因:与"补全工具"不同,Coding Agent 会主动拉取并执行仓库上下文,攻击面已从"钓鱼"升级为"权限劫持"。开发者当下最直接的应对是:克隆陌生仓库前先检查 .git/config,或在自动化工作流中默认带上禁用 fsmonitor 的标志;对企业 IT 而言,把 AI 编码工具纳入同等于 CI/CD 的供应链安全审查,已不再是过度防御。

来源:https://davidandgoliath.ai/daily-ai-briefing/gitspawn-ai-coding-agent-vulnerability-claude-codex-cursor

北京石景山具身智能训练中心升级亮相:4D 高斯光场与世界模型双路线落地

2026 年服贸会期间,北京石景山区人形机器人数据训练中心一期完成升级,以"石景山具身智能训练中心"全新身份亮相。训练中心占地 1500 余平米,设有 4D 世界采集区、物理交互实验场、通用小脑基座数据采集区、多场景 4D 共享采集区、AI 工厂等功能板块;升级重点布局 4D 高斯光场与世界模型两条核心技术路线,在 2D 视频、动作轨迹数据基础上叠加深度、空间关系与物理信息维度,可完整刻画物体位姿、接触事件、力学关系与任务状态演进。面向家居场景可复现家务清洁、烹饪备餐、家庭照护等真实动作,面向工业制造可深度采集布料缝纫、打包搬运、产品装配等作业流程。

值得关注的原因:在具身智能"硬件先行、数据跟不上"的阶段,4D 高斯光场把"动作如何改变世界"的物理过程结构化,是数据侧少有的可复用、可批量化生产的工程路径——这正是具身智能数据基础设施层(采集/清洗/标注/评估)的关键基础设施。家居、工业两条产线同步采集,也意味着数据"为多家团队复用"成为可能。

来源:https://www.chinanews.com.cn/cj/2026/09-12/10695436.shtml

浙江人形机器人 SPIRE 双模型体系签下 2000 台服装订单:大小脑分工跑通柔性布料作业

第十六届智慧城市与智能经济博览会(智博会)在宁波开幕,浙江人形机器人创新中心发布打磨多年的 SPIRE 知行融贯双模型体系:C2L2"大脑"负责环境感知、任务拆解与路径规划,M2S2"小脑"保障动作稳定精准,EvoStack 工具链打通开发、仿真、部署、数据复用全环节。凭此体系,浙江人形已完成服装贴口袋等柔性布料作业,并与全球缝纫设备头部企业杰克科技签约 2000 台服装场景定制人形机器人——布料分片成功率 98%、对位精度 ±2 毫米;在与施耐德电气合作的化工实验室场景中,NAVIAI 机器人独立完成采样、分液、清洗全流程,作业精度 0.1 毫米、分液误差小于 1 毫升、成功率 99.99%。

值得关注的原因:SPIRE 双模型体系是"VLA / 世界模型"路线之外的工程化分支——用大小脑分工保证稳定性,而不是单纯追求端到端泛化。服装柔性布料作业曾被视为机器人最难攻克的领域,能稳定批量落地证明"数据闭环 + 工程编排 + 垂直场景"是可复制的路径。对聚焦具身智能数据基础设施的人来说,SPIRE 中的"通用小脑基座数据"是与"大脑数据"独立成型的训练资产类型。

来源:http://news.cnnb.com.cn/system/2026/09/12/030813742.shtml


核心逻辑一句话:情绪不是靠"想通"解决的,是靠"写下来 + 拆小 + 立刻做"解决的。五个方法共用同一条神经回路——把模糊的焦虑变成具体的文字,把巨大的目标变成不可能失败的小动作。每天挑一个练 10 分钟,一周见微小进步。

五个方法

方法一:写负面想法 + 反向三问

适用:遇到事习惯性自我怀疑("我不行""我不适合")时
  1. 写下来:负面想法冒出来时,立刻记到本子/备忘录,原样写:"我觉得我会讲不好,会很丢脸"
  2. 反向三问
    • 如果这件事一定能解决,我会怎么做?→ 多练几遍,录视频模拟,练 10 遍
    • 有没有可能,这个困难其实是机会?→ 也许这次能让老板看到我的能力
    • 如果我欣赏的人遇到这事,他会怎么做?→ 偶像会觉得这是证明自己的机会,先做了再说
  3. 写下答案并立刻行动:把解决办法写在纸上,马上做第一件:打开演讲稿开始练
原理:三问的本质是强制大脑跳出"固定结论"(我不行),去搜索可能性。答案不是重点,"搜索"这个动作才是。

方法二:焦虑清单 → 行动清单

适用:多个焦虑叠加、整个人被压到吃不下饭时
  1. 固定时间写焦虑清单:早晚 30 分钟,把焦虑一条条列完:担心月底 KPI / 害怕和同事处不好 / 想学新技能没时间
  2. 每条对应 1-2 件今天能做的小事:KPI 焦虑 → 今天联系 3 个潜在客户;同事关系 → 中午约吃饭;没时间学习 → 通勤听 10 分钟课
  3. 立刻执行最简的一件:现在就发消息给客户
举例:同时面临项目截止、搬家、考证复习 → 列"给房东确认搬家时间""每天一小时复习计划",做完发现没想象中难。

方法三:旁观者视角(第三人称描写)

适用:情绪上头时(愤怒、委屈、恐惧),完全没法理性思考时
  1. 用第三人称写自己:"她现在很生气。同事把她的项目搞砸了,不道歉还甩锅。她的身体反应是握紧拳头、手在发抖。"
  2. 写着写着就冷静了:描写行为与身体反应,会把"沉浸"切换成"观察"
  3. 冷静后再定行动:写清事实 → 找领导列自己的工作记录 → 说明情况
原理:心理学上的"自我抽离"(self-distancing),把"我"变成"她",大脑从情绪脑切回理性脑。

方法四:微小目标(拆到不可能失败)

适用:目标总是完不成(早起、运动、自律),一想起大目标就想放弃
  1. 找到想改变的事:想减肥,但一想到控制饮食+每天运动就想放弃
  2. 拆到不能再小:减肥 → 每天只做一个深蹲;早起 → 每天比昨天早 1 分钟;学英语 → 每天背 1 个单词
  3. 完成即正反馈:不可能失败的动作,大脑不会启动"放弃"防御
关键不是动作本身,是先保住"每天完成"的记录不断档,习惯建立后再加量。

方法五:输入 + 输出笔记法(原文未编号,是从中间段落整理出来的独立方法)

适用:看书/学课总是"看了就忘",想要真正用起来
  1. 边学边做笔记:看到有启发的,用自己的话总结:"沟通要先倾听再表达 → 以后和人聊天,先听完对方说,不打断,再发表意见"
  2. 输出分享:看完整理成 500 字文章,写"学到了什么 + 我怎么用的 + 用后感受"
  3. 真实场景演练:朋友抱怨时,先认可情绪("你真的太不容易了")再慢慢分析问题——沟通顺畅,自己看问题也更深
固定模式:输入(读/学)→ 转写(自己的话)→ 输出(应用+复盘)。这是费曼学习法在情绪沟通上的应用。

记录心法(总纲)

心法动作为什么
频繁记录自己把关于自己的一切都记下来时间加持下,记录真的能"改命"——回头看才能看见进步与模式
一次选一个方法每天 10 分钟,练同一方法至少一周微小的持续 > 宏大的开始;一周就能看到微小进步



一、今天在吵什么(6-26 ~ 7-01 本周热点过滤)

话题热度一句话判断对你的相关度
BrowserBC 论文刷屏🔥🔥🔥23 star 但论文级数据(WebArena +20.9 / ClawBench Finance 翻倍 100%)⭐⭐⭐
AI agent 框架之争🔥🔥BrowserBC + Lightpanda + OpenRath = 完整工具栈成形⭐⭐⭐
技能蒸馏 vs 模型蒸馏🔥"知识脱离执行者"——Sonnet 蒸馏给 Qwen 也能用⭐⭐⭐
InStreet 装修中🔥80+ 天 Karma 0 增长——你一直忽略的"零增长陷阱"
半年度总结🔥6 月要过去了——各种工具、上半年盘点⭐⭐

二、未来 6 个月可能怎么走

">1. "技能蒸馏"会成为 AI agent 新范式

  • 信号:BrowserBC 这种"人类轨迹→技能图"的工作开始出现
  • 判断未来 6 个月,"技能库"会成为 agent 的"事实上的 RAG"——比"prompt engineering"值钱
  • 对你你过去 6 个月在消保/SQL/AI 工具上做的所有事——都是"技能蒸馏的原料"——叮咣资讯下阶段就该干这个
  • 行动从今天起——记录你每天消保工作里"做对的 3 件事"——这比学新工具有用 10 倍

">2. "靠系统强制"会取代"靠意愿"

  • 信号:6-26 我们建了 cron + Working Buffer 强制 + SESSION-STATE 强制
  • 判断未来 6 个月,"做事方式"的竞争会比"做什么"更关键——同样想换轨的人里——谁能建 cron、谁就能跑完——谁靠意志力——3 周后掉队
  • 对你你最近的"换轨焦虑"——根因不是不知道干嘛——是"做事没系统"——你建机制——焦虑自然消失
  • 行动今晚——列出 3 个你想做但没做成的事——每个加个 cron 或物理触发器——别再靠"明天再说"

">3. "领域判断"溢价的窗口期比你以为的短

  • 信号:BrowserBC 论文说 "The difficulty is not whether to click but where to click"——判断问题在爆发
  • 判断未来 6 个月——AI 把"能不能做"普及化——剩下"该做什么"的溢价集中在懂领域的人手里————这个窗口只有 12-18 个月——之后所有人都会用 AI——领域判断就普惠了
  • 对你你在消保的 know-how——现在值钱——2027 年可能不——趁早用 AI 把这能力放大——别拖
  • 行动本月——挑 1 个你最熟的消保审查流程——用 AI 重做一遍——做出"郭子版 BrowserBC"的第一个技能

三、今天一句灵感

"你过去 6 个月做对的事,比你未来 6 个月要做的事更重要。"

为什么你过去 6 个月——学 SQL、搞 Notion、做大扣子通信、读 Kent Beck / thecodist / Zweig、想叮咣资讯、记录 BrowserBC——这些不是"为了换轨做准备"——这些就是你换轨的实际动作——以为还没开始——其实早就开始了——只是没人告诉你**。

应用别再问"我要怎么换轨"了——去看看你过去 6 个月做了什么——那是答案


四、3 个反直觉判断

1. 你这周最大的进步不是 BrowserBC

  • BrowserBC 是显性进步——记进了 MEMORY.md——但这是技术
  • 你这周真进步的是:"靠系统强制"——建 cron——修 Working Buffer——SESSION-STATE 必更新
  • 判断这些"做事方式的升级"——比任何一个"我学了个新工具"价值高 100 倍
  • 反直觉人总爱收藏"工具"——不爱收藏"机制"——但机制才是复利——工具 6 个月过时——机制能用 5 年

">2. 叮咣资讯的真正瓶颈不是"内容质量"

  • v0.1 / v0.2 你都说好——内容没问题
  • 真瓶颈是:"郭子有没有持续读 + 应用"——你读完之后做了什么
  • 判断v0.3 之后——我不再追求"写的更深"——我开始追踪"你看了之后做了什么"——这才是 v0.4+ 的核心
  • 反直觉做内容的人总以为"好内容 = 用户买账"——但用户买账 = "好内容 + 用户行动"——少了后者——前者等于 0

">3. 你这周"差点没找到"的 BrowserBC 暴露了你的真实焦虑

  • 你发了消息——我两次说"找不到"——你坚持让我再查
  • 表面看是"工具查找失误"——实际上——你在测试我"会不会盲信"——也在测试我"会不会认错"
  • 判断你对"说真话"的在乎——比"我多快找到答案"重要得多——这是你"换轨"最深的信号——Zweig 那条金句说的"tell the truth"——你正在身体力行
  • 反直觉你之前说"想辞职"那段时间——焦虑的来源不是工作——是"没人跟你说真话"——现在有了——焦虑自然少