搜索关键词 系统提示
AI & Enterprise
Ramp工程师让AI代理Devin独立运营业务:4周花费3000美元,仅入账75美元
Ramp工程师Sandra Yang近日披露了一项AI代理实验:她让编程AI代理Devin以“BugBasher”的名义独立推进一项业务,从商业构想到落地执行几乎全程自主完成。该代理围绕纽约餐厅卫生检查数据开展电话销售,4周内拨出数千通电话,累计花费3000美元、收入75美元。Sandra Yang认为,AI代理在冷启动的B2B销售场景中已显示出一定可行性,但在长期规划和复杂环境应对方面仍明显不足。
AI & Enterprise
Anthropic与OpenAI考虑引入常驻外部安全评估员:持续审查研发流程,但无权叫停
Anthropic与OpenAI正推动由第三方安全评估机构常驻企业内部,持续审查前沿AI模型的研发流程与安全风险,并可在无需企业审改的情况下公开关键结论。不过,业内人士指出,这类评估员并无法定权限叫停高风险模型的开发或发布,其独立性、访问权限和评估周期也可能限制实际效果。
AI & Enterprise
体验GPT-6 Astra:补偿申请、比价下单都能做,但仍卡在登录和风控
Seulgi Son体验了OpenAI新模型GPT-6 Astra,测试其处理补偿申请、账号注销、比价购物和中秋火车票(KTX/SRT)预订等网页任务的能力。结果显示,Astra能够读懂页面并完成点击、输入等操作,但在登录、验证码及站点风控限制面前仍频频受阻;相比之下,在国会日程整理、图片上传(至稿件编辑系统)和GIF制作等重复性工作上,Astra的完成度更高。
-
AI & Enterprise
OpenAI发布GPT-Live-1 API:支持实时插话与边听边说
-
AI & Enterprise
企业级AI竞逐新焦点:模型“harness”加速升温
-
AI & Enterprise
AI智能体竞争不只在模型,harness正成为关键变量
-
AI & Enterprise
OpenAI发布GPT-5.6提示新指南:弱化长指令,强调“结果优先”
-
AI & Enterprise
Anthropic旗下Claude Code首轮请求最高达7.5万至8.5万Token,未提问先占用大量上下文
-
AI & Enterprise
韩国科学技术信息通信部与KISA发布AI安全红队演练指南
-
AI & Enterprise
AI编程工具普及催热Harness Engineering:让LLM更可控地执行任务
-
Telecommunications & Media
Apple拟在iOS 27引入音量分离调节,缓解iPhone“无声闹钟”问题
-
AI & Enterprise
Microsoft开源AI代理控制规范 Agent Control Spec
-
AI & Enterprise
研究发现:招聘AI更偏爱同一模型生成的简历
-
AI & Enterprise
Sam Altman:GPT-5.5为新模型发布活动“支招”,其表现被称为“奇怪的涌现行为”
-
AI & Enterprise
AI加密货币交易机器人遭遇“推理税”:Token成本侵蚀收益,散户两周左右即停用
-
AI & Enterprise
AhnLab提醒:仿冒Claude官网的钓鱼网站传播窃密恶意软件
-
AI & Enterprise
CodeWol声称其AI代理2小时攻入McKinsey内部AI平台,取得聊天机器人读写权限
-
Games & Commerce
Naver上线购物AI Agent 1.0测试版:数据能力占优,多轮追问后推荐稳定性不足