GPT-6 Astra演示:从3D应用到专业工作流据公开演示,GPT-6 Astra已能生成可运行的Mac应用和游戏,并处理3D重建、数学证明、医学科普、电路设计与数据分析。不过相关案例缺少统一测试条件,是否达到AGI仍需在正式开放后通过长任务实测验证。2026-09-0494 浏览
GPT-6 Astra性能与定价解析据现有材料,OpenAI发布GPT-6 Astra,重点强化计算机操作、软件工程、科学推理与复杂工作流能力。本文整理其主要基准成绩、API定价、开放范围、Codex上下文机制及专业场景表现,并说明评测结果的适用边界。2026-09-04100 浏览
GPT-6 Astra发布消息核查网传文章声称OpenAI发布GPT-6 Astra,并给出ARC-AGI、网络安全、科研与电脑操作成绩。核查发现,材料缺少官方公告、系统卡、基准方法和可复现结果,多个结论不能据此成立。本文梳理主要疑点,并提供企业评估AI代理能力与安全风险的核查清单。2026-09-04101 浏览
Claude Code 跨会话通信教程Claude Code v2.1.224 起支持独立会话互发纯文本消息。本文介绍版本检查、会话命名、在线对象查询与自然语言传话,并说明本机及跨机器通信路径、权限边界、平台限制、消息队列,以及它与 Agent Teams 的区别。2026-09-0486 浏览
Claude Computer Use支持后台操作Claude 在 macOS 桌面端测试后台 Computer Use,面向 Pro 与 Max 用户,可让 Cowork 和 Claude Code 在不抢占鼠标与前台窗口的情况下执行跨应用任务。本文梳理其效率价值、适用场景,以及静默操作带来的权限、误操作和敏感数据风险。2026-09-0391 浏览
OpenAI Astra触及关键网络安全门槛OpenAI披露Astra已达到Preparedness Framework的Critical网络安全门槛,在漏洞利用测试中表现突出并发现两个未知漏洞。其Token效率、安全拒绝率和审批遵从性也优于Sol,公众版本将采用更严格的权限与风险控制。2026-09-02113 浏览
goose:开源本地 AI Agent,集成 70+ 工具goose 是一款开源本地 AI Agent,支持桌面端、CLI 和 API,可接入 OpenAI、Anthropic、Ollama 等 15+ 模型服务,并通过 MCP 连接 70+ 工具。它还能将 Claude Code、Codex、Gemini CLI 作为执行后端,用 Recipe 固化流程,用 Subagent 并行任务。适合需要模型可替换、流程可复用的开发者。2026-09-0147 浏览
开源 OpenBot:让每个 AI Agent 拥有专属电脑OpenBot 是 CopilotKit 推出的开源 AI Agent 平台。它给每个 Agent 分配独立容器、浏览器和专属工作区,所有操作先审计后执行,支持人工接管和组件式 UI,解决 AI 操作不透明、难审计问题,适合企业级可干预场景。2026-09-0147 浏览
MiniMax Design 发布:H3 视频生成创作工作流MiniMax 官方发布创作工作台 MiniMax Design,将开源视频模型 H3 接入从需求理解、分镜规划到自动剪辑的完整流程。实测显示,它支持电商种草、杂志风 MV、3D 导演台等场景,通过 Agent 驱动实现批量生产,标志着视频 Agent 从套壳走向原厂深度适配。2026-09-01108 浏览
GitHub 1.2万星标的AI旅行规划神器TREKTREK 是一个 GitHub 1.2 万星标的开源旅行规划工具,支持地图行程编排、机票酒店预订导入、费用 AA 分账、打包清单、多人实时协作,还内置 MCP 服务可让 AI 帮忙规划行程。Docker 一条命令即可自托管,数据完全由自己掌控。2026-09-0144 浏览
Paperclip:一条命令搭起多智能体 AI 公司Paperclip是73k Star的开源多智能体平台,把Claude Code、Codex、Cursor等代理当成员工统一管理,支持目标对齐、心跳调度、预算控制、组织架构、移动端监控。一条命令可本地部署,适合搭建AI一人公司。2026-08-3065 浏览
Claude Code 更新:受限模式与跨会话协作Claude Code v2.1.248 发布,新增 --restricted 受限模式,通过移除敏感工具、文件隔离和配置忽略来增强安全;同时引入 SendMessage 与 ListAgents API 实现跨会话消息通信,修复 OAuth 令牌刷新等问题,适合代码审查、教学和企业安全场景。2026-08-2971 浏览
DeepSeek发布多模态视觉模型,首批解读DeepSeek正式发布多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp,API已开放调用。该模型支持读取图片、截图、图表中的文字与视觉信息,纯文本能力与V4-Flash一致,多模态Agent能力接近Opus-4.8。本文梳理模型细节、图片格式、接口调用方式、Token计费与消息限制,帮助开发者快速上手。2026-08-2953 浏览
实测Qwen3.8-Flash:性能比肩Opus 4.6,价格仅为1/40实测 Qwen3.8-Flash:125B MoE 模型,每个 Token 仅激活 6B,支持 1M 上下文。实测能生成可玩 3D 游戏、完整 3D 场景和科技产品官网,输入每百万 Token 仅 0.8 元,输出 2.7 元,缓存命中 0.1 元,比 DeepSeek-V4-Flash 便宜,不到 Opus 4.6 的 1/40。2026-08-2946 浏览