Anthropic 为 macOS 和 Linux 上的 Claude Code 新增会话间通信功能,终端间无需手动复制信息,Claude 即可向另一会话发送文本摘要或提问并直接获取回答,也可在变更影响其他会话时主动发消息。
Anthropic 为 macOS 和 Linux 上的 Claude Code 新增会话间通信功能,终端间无需手动复制信息,Claude 即可向另一会话发送文本摘要或提问并直接获取回答,也可在变更影响其他会话时主动发消息。
## eval competition idea: Help kill my SaaS my team is proposing to pay >$40k/year for enterprise saas we have never use...
## eval competition idea: Help kill my SaaS my team is proposing to pay >$40k/year for enterprise saas we have never use...
开发者力荐 AI 时代移动端用 Expo 写应用:跨平台且装 Expo Go 后代码变更即热更新,所见即所得。搭配 Grok 4.5 速度实现光速体验,前后端 TypeScript 一把梭。唯一门槛是用网页语言调出原生质感需原生开发经验,形成死循环。
Barret 李靖指出,测试和前端开发等细分工种正逐渐被 AI 收敛。核心是从 Human in the Loop 转向 Human over the Loop,让任务自循环、自验证、自进化,验证本身也须交给 AI。未来人才结构将收敛为端到端交付者和领域专家两类,细分工种不断减少。
Anthropic 发布 Claude Code v2.1.226。该版本为终端内的智能体编码工具,可通过自然语言指令执行日常任务、解释复杂代码并处理 git 工作流,帮助开发者加速编码。
AI coding tools ranked purely on vibes: Immaculate vibes: Grok Build Warp Conductor Droid Good feelings: Cursor Claude c...
Claude Code 最新版支持会话之间直接发消息,无需手动切换窗口重复解释。需 v2.1.224 或更高版本,支持 macOS 和 Linux(含 WSL2)。用 /rename 或 --name 命名会话后,可直接用自然语言让一个会话向另一个发送摘要(不含历史或文件),对方可在任务中接收。
New in Claude Code: your sessions can now message each other. Instead of having to re-explain yourself in another sessio...
另有 1 家信源报道IT之家(RSS)腾讯云开源 TencentDB Agent Memory v2.0,一个面向 AI 智能体的团队级记忆中枢,将对话、文档和代码转化为 Chat Memory、Skill、LLM-Wiki 和 Code-Graph 四类可版本化、带权限的记忆资产。
Databricks 通过迁移至更高效模型、动态路由及元 harness 等策略,将 AI 编码支出降低 70%,同时保持每用户成本大致固定。该公司已开源其关键基础设施组件 Omnigent 与 Unity AI Gateway。Stripe 等企业发现 Opus 4.7 较 4.6 质量无提升且成本更高,因此未内部部署。
Simon Willison 用同一提示词让 Codex Desktop 上的 GPT-5.6 Sol Ultra 生成游戏,效果优于此前 Claude Fable 5 的版本。新作《Moonlight & Mayhem》设定在博物馆,玩家需解救同伴以盗取金沙丁鱼。Codex 用时 52 分钟完成项目,但未能发现角色眼球异常放大的 bug,经提示后修复。
Starting August 14, auto mode will be the default permission mode in Claude Code for Pro, Max, and Team users. Auto mode...
Databricks 数据显示 AI 编程 token 支出正指数级增长。GLM 5.2、Opus 4.8 和 GPT 5.6-Sol 位于“效率前沿”,即每美元质量最优;而 Opus 5.0 相比 4.8 出现成本回退,说明新模型未必更高效。该公司正重投路由、评估及开源与专有模型组合,以优化支出经济学。
Databricks 分享了规模化管控 AI 编程成本的方法,其智能体编程已带来可衡量的价值提升。文章重点探讨了在团队规模扩大时,如何通过成本追踪、工具选型与使用策略,在维持代码质量与开发效率的同时,控制 AI 编程工具带来的支出增长。
新一期播客深入解析华盛顿大学推出的 SlopCodeBench 基准,该基准要求模型随时间演化代码库,并衡量代码复杂度增长。目前最强模型(Fable、Sol、Kimi K3)通过率仅 33%。主持人 Dex Horthy 与 Vaib 探讨了基准机制及前沿模型测试发现。
Grok Build officially reaches v1.0.0, rapidly becoming one of the most powerful coding harnesses in the world After 100+...
OpenCode Go 订阅计划中,DeepSeek V4 Flash 使用额度限时翻倍(2×)。正常估算每 5 小时约 31,650 次请求,翻倍后约 63,300 次;每周约 79,050 次,每月约 158,150 次。
attention deepseek flash usage has been doubled for a limited time on OpenCode Go thank you
OpenAI appears to be working on a feature that would let you purchase a rate limit reset for Codex Source: public checko...
Composio 用 30 项真实工具任务测试 4 个 AI 编程智能体框架,统一调用 DeepSeek V4 Flash 正式版。Oh My Pi 成功率最高(17/30),但速度最慢(每任务 272 秒);Claude Code 速度最快(122 秒)但成本最高(每任务 0.195 美元),OpenCode 成本最低(每成功任务 0.073 美元)。
微软开源了 code-testing-generator,一个基于 Research-Plan-Implement 流程的多语言单元测试智能体,可自动规划、编写、运行并验证测试,且不修改生产代码。
AI 时代对前端的要求是兼具美术、UIUX 能力,并能直接让 AI 调研无文档 API、修复后端 bug 并合并代码,同时承受因改动后端架构而引发的责骂与学习压力。对后端的要求则是变成上述这种前端。
🚨 NEW GROK BUILD UPDATE 🚨 Grok Build v1.0.0 is now live. SpaceXAI is pushing new Grok Build updates almost daily. Upda...
注意到 V4 预览版论文里的 Table 6,V4 Pro (Preview) 和 Opus-4.6 的 SWE Verified 跑分, 80.6 比 80.8 正好差 0.3%。 这也不能说有些做中介的人写一句什么"性能跻身全球第一梯队...
Grok Build v1.0.0 已上线,SpaceXAI 几乎每日推送新更新。本次更新涵盖 UI 导航、权限输入与可靠性修复,包括仪表盘显示代理上轮操作摘要、扩展按字母分组、自动主题检测支持 SSH/tmux、MCP 图像返回不再丢失或损坏,以及远程恢复默认仅恢复对话。用户可通过 grok update 命令更新。
swyx 提议举办小型远程黑客松:他提供1000美元token费用,参赛者周末克隆其团队正考虑购买的企业SaaS(年费超4万美元),团队评估后胜者获1万美元现金及播客报道,代码全部开源。此举旨在测试高利润低壁垒SaaS的可替代性,并持续挑战更复杂的SMB软件。
作者认为,AI 让“从想法到成品”的距离几乎归零,但过去靠试错和成本磨炼出的判断力——品味——并未消失,而是成为唯一不可自动化的核心能力。品味源于长期与错误共处,而非消费优秀作品;当摩擦被移除,新一代开发者虽更高效,却可能跳过培养品味的学徒期。
GitHub Copilot 应用中的斜杠命令可帮助管理会话、导航项目和自定义 Copilot 工作流。与 CLI 版不同,应用版命令更侧重工作流,如 /plan 用于编码前规划、/spar 用于挑战方案假设、/autopilot 用于自动执行实现。/clear 和 /model 在 CLI 和应用中均可用。
btw ive been dogfooding an agentic github clone over the past month or so and its gotten quite quite enjoyable to use. e...
用 AI 开发软件正变得像煎牛排:人人都能做出“勉强能吃”的东西,但想要一份从边缘到中心都完美三分熟、调味得当的牛排,则完全是另一回事。AI 充其量是台“牛排机”,能按食谱重复操作,却无法真正理解你想要什么。最终,要持续做出好软件,你仍得理解软件本身,学会判断模型输出,而不是指望靠运气。