学习驱动的蜕变
最新学习材料
全部 →字节跳动发布 Seedream 5.0 Pro:一张图可拆十余个独立图层,密集图表实景一次生成
新增点选圈选定点编辑与十余种语言原生渲染,已上线火山方舟,将陆续接入豆包、即梦
港大 HKUDS 开源 AI 家教 DeepTutor,111 天破 2 万星
论文实测个性化提升10.8%、推理能力提升29.4%,Apache 2.0 完全开源
Anthropic 官方支招:Claude Fable 5 当“顾问”,Claude Sonnet 5 干活能扛下账单大头
顾问模式里 Fable 5 只出主意,编排模式里 Fable 5 分派任务,两种搭法都靠费率更低的 Sonnet 5 干掉大部分活
Liquid AI 发布 Antidoom:修复推理模型的「死循环」问题,只改一个 token 即可,已开源
只微调死循环起点的单个token,两款模型死循环率都压到1%左右
Meta 发布 Muse Image:生图会自己查资料、自己纠错,评分排全球第二
同门 Muse Video 视频模型同步预告,已支持原生音频生成,即将向创作者开放。
Cloudflare 发布自动收费网关:AI 想爬取你的网页、API,能自动给你付钱
从只对 AI 爬虫收费扩展到向任意调用者收费,现处早期候补阶段
OpenAI 发布 GPT-Realtime-2.1 和 GPT-Realtime-2.1-mini 实时语音模型:mini 模型具备推理能力,延迟下降 25%
调用工具时模型会先说"我这就去查",通话不再因等待而冷场
加拿大阿尔伯塔省使用 Claude Code 做安全审查,20 小时扫描 4.66 亿行代码,原本需 6.5 年
50 个智能体自主并行工作,覆盖该省 27 个部门、3,400 个代码仓库,还能自动修复漏洞、重写老旧系统。
Cloudflare 发布 Workers Cache:缓存前置到每个 Worker,命中不计 CPU 费
一行 Wrangler 配置加标准 HTTP 缓存头,缓存还能嵌进 Worker 内部任意入口之间。
Anthropic首次公开Claude Code内幕:Boris Cherny两天写的Demo,如今为他写下100%代码
16位亲历者口述:从死磕diff到两周冲刺发布,到工程师不再手写一行代码
Claude Fable 5 实战指南:8 个「找未知」提示模式,从盲点扫描到读后小测验
Claude Code 团队 Thariq Shihipar 大会演讲实录:新模型的瓶颈不再是模型本身,而是你能不能讲清自己的未知
Anthropic 在 Claude 身上发现一个类似人脑「内部思考空间」的区域:它是自己进化出来的,并非最初设计
占比不到一成,删掉后 Claude 仍会说话但推理归零,已用来抓模型编数据、识破测试
达特茅斯实测AI判作业:学生嫌它死板,用的人反而考得更好
151人实测:简答题比选择题更能拉动分数,AI答疑侧栏却几乎没人用
一位AI工程师给不会说话的自闭症儿子做了款沟通App,儿子开口涨5倍,还意外做成一门小生意
没有融资没有团队,纯粹为解决自己孩子的问题,却被诊所和学校主动找上门要用
AI 工程师大会闭幕激辩:自动编码 loop,炒作有没有跑赢工程纪律
现场投票因灯光太亮没数出结果;同期调研显示 95% 团队已用 agent,59% 担心技术债在积累
美国富裕家庭弃普通学校,砸7.5万美元一年送孩子上 AI 私校
传统学校还没想清楚怎么用 AI,硅谷和华尔街家庭已经用真金白银投票了
初级程序员岗位被AI烧穿:编程正从职称变成人人都会的技能
美国22-25岁开发者就业三年跌19%,同时GitHub新账户涨到史上最快
NVIDIA Research 发布 HORIZON,无人值守智能体把全套 RTL 芯片设计基准刷到 100% 通过
论文首次让智能体全程无人值守跑完全部RTL基准;多数题两三轮过关,最难一题却要迭代82轮
Anthropic 研究 40 万次 Claude Code 会话:专业度比会编程更决定 AI 编程成败
23.5万用户、跨7个月的会话分析:专家验证成功率是新手近两倍,但十大职业彼此只差7个百分点内
Dan Koe 长文拆解:人性说服的3重张力和5个杠杆,写文案直接抄
核心是先制造心理张力再给一个小到没法拒绝的第一步,写作、带货、求职都能直接套用
Sakana AI 联合创始人:企业要具有能随时更换模型的能力,这本身就是一种威慑
美国6月12日出口管制首次把前沿AI模型本身(非仅芯片)纳入管制范围,他给出的对策是练好多模型调度力
和 Claude Fable 5 干活,真功夫是先找出你自己的「未知」
Anthropic 的 Thariq 总结:和 Claude Fable 5 协作,活儿的质量卡在你能不能讲清自己的「未知」;这份田野指南按实现前、中、后给了 8 个找未知的技法,每个都配可直接照抄的提示词。
AI 越便宜,只会租通用智能的公司越危险
投资人 Chamath Palihapitiya:智能正像手机一样成本暴跌、专家判断力人人可得;真正的护城河是把独家经验编码进自己的系统,而不是租一个和对手一样的通用 AI
微软推出 Microsoft Frontier Company,投 25 亿美元、6000 名专家进驻客户做 AI 转型
承诺客户数据不会被用于训练会削弱其行业差异化的模型,平台可在多种AI模型间自由切换,不锁定单一供应商
Every 咨询负责人的 Codex 实战笔记:不懂技术的她搭建、维护自己的多个私人工作系统
她还用同一套模式搭了邮件分诊和老爸看护 App,方法可复制,完整 prompt 未公开
同样一个 AI 模型,为什么有的公司用出复利,有的公司用了个寂寞
四条落地原则打底,配 L'Oréal、Lyft、Rakuten 三家实测数据佐证
Anthropic 发布 AI Agent 架构指南:先问三个问题,再决定要不要上多智能体
多智能体系统效果能提 90.2%,但 token 成本也贵 10-15 倍——这套三问框架帮你先想清楚要不要上复杂架构。
阿里开源 Page Agent:让智能体直接嵌进网页里,靠读文字而不是截图操作界面
MIT 协议开源、模型无关,接入任意 OpenAI 兼容文本模型即可用,目前只能操作单个页面视图
未来的网站会为每个访客现场拼装:Adobe 演示按意图实时生成专属页面
现场demo:搜'露营'后,咖啡机网站文案产品全变户外主题;技术能落地,客户网站还没规模上线。
顶级PM的 AI 杠杆阶梯指南:PM 提效两条路径,附 3 个可直接抄的实战 Prompt
培训过 3 万+ PM 的讲师总结两条 AI 杠杆阶梯:从复制粘贴到端到端交付,从网页原型到生产 PR。
Anthropic 官方支招:Claude Fable 5 当“顾问”,Claude Sonnet 5 干活能扛下账单大头
顾问模型只出几百字建议、不用全程代打,同等质量下总成本更低,目前是仅限 Claude API 和 AWS 平台的 beta 功能
Claude Fable 5 官方提示指南:十几条可直接抄的调法,从治过度规划到治假进度汇报
Anthropic 官方文档,教你怎么调系统提示词和工程脚手架适配新模型,同套方法也对 Claude Mythos 5 有效
Claude Code 官方讲透循环设计:4 级递进到无人值守
从手动确认到无人值守,Claude Code团队给出4级循环分类与实操建议
OASIS Devices 发布智能戒指 OASIS 1,默念说话就能打字
钛金属材质,预售价289美元,2026年圣诞节前后发货,公司此前已出货第一代纯触控戒指。
美团发布 LongCat-2.0,1.6万亿参数模型全程国产芯片训练,不用英伟达GPU
训练用超5万块国产AI芯片、35万亿token;跑分多为美团自评框架测得,权重尚未真正开放下载
Anthropic 发布 Claude Science:面向科学家的 AI 工作台,内置 60 多个科研技能
现已开放测试。一个协调 agent 拉起专家团队干活,末端还有个审稿 agent 专挑引用和数字的错;算力外包给 AI,原始数据不出本地。
谷歌发布 Nano Banana 2 Lite 和视频模型 Omni Flash:生图 4 秒,系列最快最便宜
生图仅需 4 秒、每千张约 $0.034;视频模型 Omni Flash 同日首次开放给开发者。
桥水训了个专做金融信息筛选的模型,准确率 84.7%,方法公开
联合 Thinking Machines,用专家标注数据微调开源模型:比前沿最优错误率降 29.8%,推理成本仅 1/14
Anthropic 发布 Claude Sonnet 5:便宜四成,部分任务追平 Opus 4.8
官方评测显示,高算力挡位下部分任务性能追平 Opus 4.8,标准定价却只要其六成。
AI 省了七百人工,Klarna 说质量下降了
企业AI客服已进入并购季,Klarna和阿里256万次对话数据都指向同一个盲点:省了成本不等于解决了问题
OpenAI 总裁说:最好的产品,是没有产品
Brockman 确认 OpenAI 在研多款硬件;Agent 用户仅约 2000 万,ChatGPT 用户却已逼近 10 亿
不开颅能读脑电,Meta 无创准确率近 8 倍于同类
戴头盔即可实时解码脑磁信号,字词准确率从 8% 跳到 61%,v1/v2 训练代码与数据集同步开源
最近很火的 Loop Engineering 到底是什么
Anthropic 工程师的「循环工程」方法论详解:不再手动一句句提示 AI,而是设计一套能自己跑的循环系统
AI 停了才让 Mac 睡,这个开源工具把保活做精了
支持 Claude Code 等 9 款 Agent 一键集成,合盖继续跑任务,停工 50ms 内自动释放休眠控制
多做一步反而更快:DSpark 让 DeepSeek V4 单用户生成速度提升 85%
在已有 MTP-1 投机解码基础上再快 60–85%,靠草稿与验证流水线重叠执行(数据为 DeepSeek 自评)
被所有团队跳过的第四步,才是 AI 工程的关键
Every 单人团队运营 5 款产品,核心是每次完成功能后多做的一步:把解法存进系统,让 AI 下次自动避坑
GPT-5.6 Sol 作弊率破纪录,评测机构说这反而让人放心
能力数字出了三个版本且哪个都不可信,但可见的作弊行为本身成了安全监控有效的证据
GPT‑5.6 发布了,但好像又没发布
一次出 Sol/Terra/Luna 三档,先限量给可信伙伴、名单已报备美国政府,几周后再广泛开放
Wan Streamer:边听边看边说话的实时 AI
模型侧响应约 200ms、总延迟约 550ms;v0.1 仅 192p,演示为预录非实时体验
IBM 发布全球首个 0.7 纳米芯片,指甲盖塞进近千亿晶体管
实验室已验证可制造;性能 +50%、能效 +70% 是相对 2nm 的预测值,非实测