Techub News 消息,AI 搜索公司 Perplexity 发布了内部研发的 Rust 检索与排序引擎 Photon,以取代其此前分叉的开源引擎。Photon 现已处理所有生产流量,并为其搜索 API 中的新「快速搜索」模式提供支持。Perplexity 报告称,其单次调用 p50 延迟为 160 毫秒,p95 延迟为 230 毫秒。 Photon 将检索和排序的 p99 延迟从约 800 毫秒降至约 65 毫秒,同时使用的服务机器数量比旧内容节点减少了约 20%。该引擎作为托管 API 提供,用户可通过在 POST /search 中设置 search_type:「fast」来使用,每 1000 次请求费用为 1 美元,但引擎本身不开源。 Perplexity 还推出了与 Photon 搭配、为智能体工作流优化的「快速搜索」模式。在 6 个基准测试的 3554 项任务中,该模式以 59.73 美元的预估模型加搜索成本取得了 64.3% 的得分,而默认预设的成本为 187.60 美元,前者便宜约 68%。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,AI 搜索公司 Perplexity 发布了内部研发的 Rust 检索与排序引擎 Photon,以取代其此前分叉的开源引擎。Photon 现已处理所有生产流量,并为其搜索 API 中的新「快速搜索」模式提供支持。Perplexity 报告称,其单次调用 p50 延迟为 160 毫秒,p95 延迟为 230 毫秒。 Photon 将检索和排序的 p99 延迟从约 800 毫秒降至约 65 毫秒,同时使用的服务机器数量比旧内容节点减少了约 20%。该引擎作为托管 API 提供,用户可通过在 POST /search 中设置 search_type:「fast」来使用,每 1000 次请求费用为 1 美元,但引擎本身不开源。 Perplexity 还推出了与 Photon 搭配、为智能体工作流优化的「快速搜索」模式。在 6 个基准测试的 3554 项任务中,该模式以 59.73 美元的预估模型加搜索成本取得了 64.3% 的得分,而默认预设的成本为 187.60 美元,前者便宜约 68%。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。