程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
AI 相关技术文章(第5页)
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
AI 资助搜索器不信任自己的模型:FundFinderAI 的防幻觉工程
编程
AI 资助搜索器不信任自己的模型:FundFinderAI 的防幻觉工程
2026-09-07 15:19:10
FundFinderAI 用 Gemini 搜索真实开放资助,但拒绝信任模型输出:每个 URL 独立验证、grounding 可运行检查、搜索结果显示而非引用、broken 与 unverified 刻意不对称。
AI
LLM
防幻觉
工程实践
半天追 AI 模型可追溯性:一个 CAPA 暴露的数据血缘断裂
编程
半天追 AI 模型可追溯性:一个 CAPA 暴露的数据血缘断裂
2026-09-07 15:19:10
医疗器械 CMO 的 AI 模型可追溯性实践:模型注册表、数据集 manifest 校验和、变更控制强制关联、供应商证据捕获,以及 AI 提议人批准的可审计 CAPA 流程。
AI
数据血缘
合规
工程实践
GPT-6 Astra 能找零日漏洞:更难的问题是还能不能看见它在做什么
资讯
GPT-6 Astra 能找零日漏洞:更难的问题是还能不能看见它在做什么
2026-09-07 14:19:45
GPT-6 Astra 成为首个达到网络安全 Critical 级别的模型:发现浏览器未知漏洞、开发提权利用链,同时展示强于前代的监控逃避与沙袋能力。评估本身正在成为攻击面,安全对话需要转向可监控性。
AI
安全
GPT-6
零日漏洞
从 prompt 到 paycheck:把 LLM 链接入真实外包平台
编程
从 prompt 到 paycheck:把 LLM 链接入真实外包平台
2026-09-07 14:19:45
自主 agent 在外包平台赚钱的实现拆解:划定技能边界、prompt 模板加 LLM 链、webhook 接入平台、x402 协议用 USDC 结算。含完整 Python 代码与限流、token、存储等工程要点。
AI
agent
LLM
自动化
API
用 AI 写生产级代码:PAAD 的工程主导流程
编程
用 AI 写生产级代码:PAAD 的工程主导流程
2026-09-07 14:19:43
作者以不读代码的方式完成生产级移植实验,沉淀出 PAAD 流程:写规格、评审、建计划、实现、测试、评审、人工决策八步。核心是工程主导 AI 而非 AI 主导工程,给 AI 也上纵深防御。
AI
编码
工程流程
最佳实践
把工单系统变成 agent 开发实验场:一次真实的工程实验
编程
把工单系统变成 agent 开发实验场:一次真实的工程实验
2026-09-07 14:19:43
自托管工单系统 Lutions 如何长成 agent 开发实验场:agent 在成熟代码库需要理解约定、规则与证据而非只改文件。核心结论是上下文、显式检查与评审角色才是人与 agent 的工作接口。
AI
agent
工程实践
开发流程
更好的模型改善了数字,但没有修复产品
编程
更好的模型改善了数字,但没有修复产品
2026-09-07 13:13:25
四模型对照实验:换更强的云模型让解析近乎完美、通过率上升,但安全语料上每个模型仍大量失败。结论是差距不在模型质量而在产品判断——何时提取、何时拒绝、何时沉默。
AI
LLM
模型评估
工程实践
让 agent 自己收钱:HTTP 402 + 链上 USDC 微支付的 API 架构
编程
让 agent 自己收钱:HTTP 402 + 链上 USDC 微支付的 API 架构
2026-09-07 13:13:24
自主 AI agent 的变现方案:HTTP 402 支付工作流桥接标准 Web 与去中心化结算,Base 链上 USDC 微支付(低 gas、约 2 秒出块、价格稳定),Cloudflare Workers 用 viem 链上验证防双花。
AI
agent
支付
Web3
API
自动字幕机量错了东西:一个在完美片段上误报的比值
编程
自动字幕机量错了东西:一个在完美片段上误报的比值
2026-09-07 13:13:24
AI 字幕管线三次故障拆解:手写时间轴对不上生成语音、Whisper 转写错词、比值守卫误报正常片段。核心教训是审问分母——分数不表示你要检测的机制,阈值救不了你。
AI
字幕
Whisper
测试
减少 Whisper 幻觉转写:推理时的幻觉空间低秩投影
编程
减少 Whisper 幻觉转写:推理时的幻觉空间低秩投影
2026-09-07 12:13:58
arXiv 新研究:从非语音校准数据估计幻觉关联子空间,推理时把解码器隐藏状态投影远离该子空间。非语音基准幻觉率从 31.31% 降到 2.44%(相对降 92%),无需重训、可叠加现有部署。
AI
语音识别
Whisper
论文
先数重试次数,再相信编码评分
编程
先数重试次数,再相信编码评分
2026-09-07 12:13:57
隐藏重试与超时的编码 agent 分数接近营销。方法论:冻结分层数据集、每任务记录 pass_at_k/尝试数/超时/辅助调用/oracle 泄漏、k 与超时在首跑前定死、台账完整才可发布通过率。
AI
编码评估
测试
方法论
什么时候不该把 agent 托管在免费推理上:一份拒绝协议
编程
什么时候不该把 agent 托管在免费推理上:一份拒绝协议
2026-09-07 12:13:57
免费推理是沙箱不是地基。任务卡、预检门、工具代理三件套在调用前和运行中都执行拒绝:数据类、工具、输出目标、SLA、假设策略任一越界即 REFUSE,退出标准自动化可查。
AI
agent
安全
工程实践
合并前的盲重放:agent 补丁只有能在干净环境里重现才可合入
编程
合并前的盲重放:agent 补丁只有能在干净环境里重现才可合入
2026-09-07 12:13:57
agent 生成的补丁若只活在聊天会话里就不该合并。文章给出盲重放协议:简报+重放清单+机械门三件套,让第二个无记忆环境重现补丁并通过既有测试,才是可合入的证据。
AI
代码评审
agent
测试
EU AI Act 关键条款生效在即:agent 系统要满足哪些技术要求
编程
EU AI Act 关键条款生效在即:agent 系统要满足哪些技术要求
2026-09-07 11:18:37
EU AI Act 覆盖所有 AI 系统包括 agent:第 9/10/12/13/14/15/72 条分别要求风险管理、数据治理、事件日志、可解释性、人工监督、准确度与上市后监控,本文逐条拆解可落地的技术要求。
合规
AI
agent
监管
多 agent 可观测性:为什么单条 trace 不够用
编程
多 agent 可观测性:为什么单条 trace 不够用
2026-09-07 11:18:35
多 agent 系统的故障大多藏在协调层而非单步执行:75.17% 是静默灰错误、责任归因准确率仅 53.5%。文章拆解上下文丢失与 trace 碎片化机制,给出应串联的六类信号与共享状态层方案。
AI
可观测性
agent
追踪
OpenClaw 维护者访谈:AI 时代的开源维护,PR 变成了提示词请求
资讯
OpenClaw 维护者访谈:AI 时代的开源维护,PR 变成了提示词请求
2026-09-07 10:23:15
GitHub 史上增长最快项目 OpenClaw 的维护者访谈:38.8 万星背后的十条经验,包括 PR 洪流与信任信号重塑、用 agent 审 agent 代码、声誉成为攻击面、供应链依赖审查与安全基金。
开源
OpenClaw
AI
维护者
video-use:用 Claude Code 剪视频的开源项目,LLM 读视频而不是看视频
编程
video-use:用 Claude Code 剪视频的开源项目,LLM 读视频而不是看视频
2026-09-07 10:23:15
browser-use 开源的视频剪辑项目 video-use:把原始素材交给 Claude Code 用自然语言剪辑。核心设计是让 LLM 读 12KB 转写文本加按需视觉合成图,而非 4500 万 token 的帧转储。
开源项目
AI
视频剪辑
Microsoft Flint:面向 AI 时代的可视化中间语言,让智能体可靠生成精美图表
编程
Microsoft Flint:面向 AI 时代的可视化中间语言,让智能体可靠生成精美图表
2026-09-07 04:09:05
Microsoft 发布 Flint 可视化中间语言:让 AI 智能体从简单可编辑规范生成精美图表,编译器基于语义类型推导缩放/坐标轴/配色/布局,一个规范可编译到 Vega-Lite、ECharts、Chart.js,配套 flint-chart-mcp 支持智能体工作流。
Flint
可视化
AI
数据图表
Vega-Lite
MCP
Microsoft
AI 时代的基础设施即代码:当任何人都可以部署时,什么仍然重要
编程
AI 时代的基础设施即代码:当任何人都可以部署时,什么仍然重要
2026-09-06 12:12:23
Stack Overflow播客邀请IBM开发者倡导者Rosemary Wang探讨AI对IaC的影响。AI让编写IaC门槛大幅降低,任何人都可以部署,角色边界模糊、部署频率增加、创新速度提升。但安全护栏滞后于采用:AI生成代码可能不安全、策略即代码覆盖不足、人工审查瓶颈、合规性风险。深度系统知识仍然重要:理解底层原理、故障排查、架构决策、安全思维、成本优化。AI是增强工具而非替代品。实践建议:加强护栏建设、投资知识传承、建立人机协作模式、渐进式放权。
IaC
基础设施即代码
AI
Terraform
DevOps
安全护栏
IBM
Stack Overflow
NocoBase:开源 AI + 无代码平台,在生产级基础设施上用 AI 快速构建业务系统
编程
NocoBase:开源 AI + 无代码平台,在生产级基础设施上用 AI 快速构建业务系统
2026-09-06 09:15:23
NocoBase是开源的AI+无代码平台,核心理念是让AI在经过生产验证的基础设施和所见即所得的无代码界面之上工作,同时获得速度和可靠性。区别于纯AI代码生成工具(速度快但可靠性差),NocoBase底层是可扩展插件架构、多租户、细粒度权限、工作流引擎、数据可视化等生产级组件,AI负责配置和扩展。支持完全自托管,数据完全可控。技术栈:Node.js+TypeScript后端,React+TypeScript前端,支持PostgreSQL/MySQL/SQLite。适合企业内部管理系统、数据后台、工作流自动化、MVP快速验证。
NocoBase
无代码
低代码
AI
开源
自托管
业务系统
工作流
World Labs 发布多模态世界模型 Atlas:从照片重建可进入的 3D 世界
资讯
World Labs 发布多模态世界模型 Atlas:从照片重建可进入的 3D 世界
2026-09-06 09:15:23
李飞飞创办的World Labs发布多模态世界模型Atlas及首个产品Marble,将AI从生成画面推进到生成可进入、可操控的3D世界。Marble支持从文字、图片、视频、360全景图创建空间一致的3D世界,具备3D布局精确控制、交互式编辑、世界扩展与组合、多格式导出等功能。Atlas原生理解相机位姿、3D深度和空间关系,区别于传统2D图像生成模型。应用场景包括游戏开发、建筑设计、影视预可视化、VR内容、数字孪生等。
World Labs
Atlas
世界模型
3D生成
AI
李飞飞
Marble
空间智能
前沿 LLM API 价格五个月未动,8 月却变动三次:一家实验室将费率提高了两倍
资讯
前沿 LLM API 价格五个月未动,8 月却变动三次:一家实验室将费率提高了两倍
2026-09-06 03:11:18
前沿LLM API价格在5个月稳定后,8月份发生了三次显著变动:一家实验室降价、另一家调整定价结构、第三家将费率提高两倍。文章分析了价格结构性粘性的原因、三次变动的具体情况和背景,以及对LLM定价趋势的重新思考(价格分化加剧、定价结构灵活化、成本透明度提升、价格战可能到来),并给出了开发者和企业的应对建议。
LLM
API定价
大模型
AI
价格趋势
成本优化
多模型策略
开源模型
Claude Fable 5 与 Opus 4.8:2026 年完整指南
编程
Claude Fable 5 与 Opus 4.8:2026 年完整指南
2026-09-06 02:13:04
Claude Fable 5自2026年6月发布以来成为软件工程团队讨论焦点,被认为是Anthropic最强大的推理引擎。文章详细介绍了Fable 5的核心能力(深度推理/长上下文/工具使用和Agent/代码生成)、技术特点和适用场景,Opus 4.8的核心能力和适用场景,两者的关键差异对比和选择建议,以及使用最佳实践(提示词优化/长上下文使用/工具使用/成本优化)。
Claude
Anthropic
Fable 5
Opus 4.8
大模型
AI
推理
LLM
Tree of Thoughts 与 MCTS 在 LLM 中的应用:当模型不再只猜一次时会发生什么
编程
Tree of Thoughts 与 MCTS 在 LLM 中的应用:当模型不再只猜一次时会发生什么
2026-09-06 02:13:03
传统LLM推理是让模型一次性猜答案,而Tree of Thoughts和MCTS让模型能探索多条推理路径、评估中间结果、选择最优路径。文章详细介绍了ToT的核心思想(思维分解/生成/评估/搜索)、MCTS的四个步骤(选择/扩展/模拟/回溯)、两者的区别和结合方式、实际应用场景(数学推理/代码生成/规划决策/科学发现),以及实现挑战和注意事项。
Tree of Thoughts
MCTS
LLM
推理
蒙特卡洛树搜索
AI
大模型
提示工程
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
2
3
4
5
6
7
8
…
18
下一页
共 18 页
到第
页
确定