长勺智库长勺智库
话题文章任务
登录
LLatent SpaceLatent Space发布于 23 小时前
AI 新闻降温:编码代理与高端模型成本的现实检验

近期 AI 社区热议显示:编码代理并非万能,高端模型虽在复杂任务上更强,但企业采用成本可能显著上升。

360
AIAgent工程实践
360
AIAgent工程实践
LLatent SpaceLatent Space发布于 1 天前
Jev:只做决策、分类、路由与评分的“系统一模型”

TypeSafe 发布 Jev,定位为补充慢速大模型的“系统一模型”,主打快速、低成本、校准决策,而不是聊天、写代码或复杂推理。

400
AIAgent工程实践
400
AIAgent工程实践
LLatent SpaceLatent Space发布于 1 天前
AIUC 融资 4000 万美元:用标准与保险解决 AI Agent 责任问题

AIUC CEO Rune Kvist 谈 4000 万美元 A 轮融资、AIUC-1 标准、AI Agent 安全测试,以及当自主系统出错时的责任与保险问题。

400
AIAgent工程实践
400
AIAgent工程实践
CCloudflare AI BlCloudflare AI Bl发布于 1 天前
浏览器端攻击为何会绕过扫描器

恶意 JavaScript 可在店铺正常运行时劫持点击、窃取佣金或篡改分析。案例显示,持续的浏览器端可见性比一次性扫描更关键。

420
AI工程实践云计算开发者
420
AI工程实践云计算开发者
NNVIDIA GenerativNVIDIA Generativ发布于 1 天前
TensorRT Edge-LLM 在 Jetson AGX Thor 上加速边缘智能体推理

NVIDIA 称 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升至 6.4 倍。

410
AI生成式AI推理算力
410
AI生成式AI推理算力
LLatent SpaceLatent Space发布于 2 天前
AEF-1:第三方 AI 评估标准走向成形

AI Evaluator Forum 发布 AEF-1 基线,围绕第三方评估的访问权限、利益冲突、资金关系与透明度提出要求,呼应前沿模型“降速”争论。

420
AIAgent工程实践
420
AIAgent工程实践
LLatent SpaceLatent Space发布于 2 天前
游戏训练能否迁移到真实工作?

Good Start Labs 尝试用游戏训练 AI:同样是铁路游戏,训练设计不同,模型在金融研究任务上的迁移效果也不同。

450
AIAgent工程实践
450
AIAgent工程实践
CCloudflare AI BlCloudflare AI Bl发布于 2 天前
Cloudflare 推出“禁止 AI 训练”设置:保留搜索收录,拒绝训练抓取

Cloudflare 新增“禁止 AI 训练”控制项,允许网站继续被搜索引擎发现,同时拒绝混合用途爬虫将内容用于 AI 训练。

450
AI工程实践云计算开发者
450
AI工程实践云计算开发者
NNVIDIA GenerativNVIDIA Generativ发布于 2 天前
Dense 与 MoE 模型:活跃参数、吞吐量与选择场景

MoE 模型可在每个 token 上只激活部分参数,例如 30B 模型每次仅用约 3B 参数,从而在容量与计算成本之间取得不同权衡。

450
AI生成式AI推理算力
450
AI生成式AI推理算力
LLatent SpaceLatent Space发布于 3 天前
Richard Socher的新赌注:让AI自动改进AI研究

NLP先驱、You.com创始人Richard Socher创办Recursive,押注递归自我改进,目标是打造能加速发明与AI研究的“尤里卡机器”。

520
AIAgent工程实践
520
AIAgent工程实践
LLatent SpaceLatent Space发布于 5 天前
DeepSeek V4.1-Flash:面向长上下文的新架构实验

DeepSeek V4.1-Flash采用新的因果编码器—解码器架构,并加入原生视觉理解。其重点不只是跑分,而是更高效地处理上下文与长时智能体任务。

400
AIAgent工程实践
400
AIAgent工程实践
LLatent SpaceLatent Space发布于 5 天前
前线部署工程师为何兴起:它不只是咨询

FDE 正成为 AI 公司热门岗位,但不同公司对其职责理解差异很大。Vinoo Ganesh 以 Palantir、Citadel 与 Kepler 的经历,解释这一角色的定位、误区与组织实践。

440
AIAgent工程实践
440
AIAgent工程实践
IInterconnects AIInterconnects AI发布于 6 天前
开放模型阅读路线图

一份帮助快速理解开放模型的阅读指南,涵盖基础概念、商业策略、安全争议、开放数据与中美竞争等主题。

360
AI开源模型模型生态深度文章
360
AI开源模型模型生态深度文章
LLatent SpaceLatent Space发布于 7 天前
AI 日报:Anthropic 网络安全事件、OpenAI 治理调整与智能体评测进展

本期梳理 Anthropic 安全事件、OpenAI 产品与治理变化,以及智能体评测、模型工具、机器人和本地推理基础设施的新动态。

400
AIAgent工程实践
400
AIAgent工程实践
IInterconnects AIInterconnects AI发布于 7 天前
一次辞职如何点燃 AI 风险争论

一名 AI 研究员因安全担忧辞职,引发关于灭绝风险、实验室文化、递归自我改进与短期安全漏洞的激烈讨论。

400
AI开源模型模型生态深度文章
400
AI开源模型模型生态深度文章
OOpenAI NewsOpenAI News发布于 7 天前
Agents API 发布:用于构建和运行云端智能体

Agents API 是一项托管服务,面向云端智能体的构建与发布,支持编排、长时间会话和工具调用等能力。

380
AIAgent大模型OpenAI
380
AIAgent大模型OpenAI
LLatent SpaceLatent Space发布于 9 天前
前沿模型如何选择推荐对象:AEO 追踪器发布

一个新的 AEO 追踪项目用 6 种提示词变体、7 个前沿模型和 161 个类别,观察 AI Agent 在推荐产品与服务时的偏好。

360
AIAgent工程实践
360
AIAgent工程实践
IInterconnects AIInterconnects AI发布于 9 天前
开放模型新动向:许可证正在分化

开放模型生态继续扩张,但许可证策略出现分化:西方厂商转向 Apache 2.0,部分中国前沿模型则加入商业与安全审查条款。

340
AI开源模型模型生态深度文章
340
AI开源模型模型生态深度文章
LLatent SpaceLatent Space发布于 12 天前
试用 Grok Bot 五天:像 MacBook 一样简单的智能体编程

作者试用 Grok Bot 后认为,它与 OpenClaw 的差异不在能力强弱,而在抽象层级:前者更像托管电脑,后者更像用户自有平台。

420
AIAgent工程实践
420
AIAgent工程实践
LLatent SpaceLatent Space发布于 13 天前
GPT-6 Astra 早期体验:AI 工程师能力跃迁

一份早期试用报告称,GPT-6 Astra 在工程、数据、部署与多代理协作中表现出接近“自动化 AI 工程师”的能力。

460
AIAgent工程实践
460
AIAgent工程实践
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录