我想知道解决这个问题的惯用方法(目前会抛出死锁错误),递归分支的次数未知,所以我不能简单地关闭通道.

http://play.golang.org/p/avLf_sQJj_

我通过传递一个指向一个数字的指针,并使其递增,使其工作,我还研究了使用同步等待组.我没有觉得(也许我错了),我想出了一个优雅的解决方案.我看到的围棋例子往往简单、聪明、简洁.

这是https://tour.golang.org/#73米围棋环法自行车赛的最后一次练习

你知道"围棋程序员"是如何做到这一点的吗?任何帮助都将不胜感激.我正试着从一开始就学好.

推荐答案

您可以扩展解析url上发送的结果,并包括找到的新url的数量,而不是涉及sync.WaitGroup个.在主循环中,只要有东西要收集,你就会继续阅读结果.

在您的示例中,找到的URL数量将是生成的GO routine 的数量,但它不一定是.我个人或多或少会产生固定数量的获取 routine ,这样您就不会打开太多HTTP请求(或者至少您可以控制它).那么您的主循环不会改变,因为它并不关心如何执行抓取.这里重要的事实是,您需要 for each url发送一个结果或错误-我已经修改了这里的代码,所以当深度已经是1时,它不会产生新的 routine .

此解决方案的一个副作用是,您可以轻松地在主循环中打印进度.

以下是操场上的示例:

http://play.golang.org/p/BRlUc6bojf

package main

import (
    "fmt"
)

type Fetcher interface {
    // Fetch returns the body of URL and
    // a slice of URLs found on that page.
    Fetch(url string) (body string, urls []string, err error)
}

type Res struct {
    url string
    body string
    found int // Number of new urls found
}

// Crawl uses fetcher to recursively crawl
// pages starting with url, to a maximum of depth.
func Crawl(url string, depth int, fetcher Fetcher, ch chan Res, errs chan error, visited map[string]bool) {
    body, urls, err := fetcher.Fetch(url)
    visited[url] = true
    if err != nil {
        errs <- err
        return
    }

    newUrls := 0    
    if depth > 1 {
        for _, u := range urls {
            if !visited[u] {
                newUrls++
                go Crawl(u, depth-1, fetcher, ch, errs, visited)
            }
        }
    }

    // Send the result along with number of urls to be fetched
    ch <- Res{url, body, newUrls}

    return
}

func main() {
    ch := make(chan Res)
    errs := make(chan error)
    visited := map[string]bool{}
    go Crawl("http://golang.org/", 4, fetcher, ch, errs, visited)
    tocollect := 1
    for n := 0; n < tocollect; n++ {
        select {
        case s := <-ch:
            fmt.Printf("found: %s %q\n", s.url, s.body)
            tocollect += s.found
        case e := <-errs:
            fmt.Println(e)
        }
    }

}

// fakeFetcher is Fetcher that returns canned results.
type fakeFetcher map[string]*fakeResult

type fakeResult struct {
    body string
    urls []string
}

func (f fakeFetcher) Fetch(url string) (string, []string, error) {
    if res, ok := f[url]; ok {
        return res.body, res.urls, nil
    }
    return "", nil, fmt.Errorf("not found: %s", url)
}

// fetcher is a populated fakeFetcher.
var fetcher = fakeFetcher{
    "http://golang.org/": &fakeResult{
        "The Go Programming Language",
        []string{
            "http://golang.org/pkg/",
            "http://golang.org/cmd/",
        },
    },
    "http://golang.org/pkg/": &fakeResult{
        "Packages",
        []string{
            "http://golang.org/",
            "http://golang.org/cmd/",
            "http://golang.org/pkg/fmt/",
            "http://golang.org/pkg/os/",
        },
    },
    "http://golang.org/pkg/fmt/": &fakeResult{
        "Package fmt",
        []string{
            "http://golang.org/",
            "http://golang.org/pkg/",
        },
    },
    "http://golang.org/pkg/os/": &fakeResult{
        "Package os",
        []string{
            "http://golang.org/",
            "http://golang.org/pkg/",
        },
    },
}

是的,遵循@jimt建议,并确保访问 map 线程安全.

Go相关问答推荐

Makefile:现有文件上没有这样的文件或目录,不加载环境变量

try 用GitHub操作中的release标签更新version. go文件,但失败了

如何在Golang中使用ECHO服务器实现Socket.IO服务器

什么东西逃到了堆里?

Kafka架构注册表-Broker:Broker无法验证记录

为什么要立即调用内联函数,而不仅仅是调用其包含的函数?

我可以扫描表中每个项目的最高范围键值吗?

我们如何保证取消的上下文会导致 goroutine 终止?

Docker 执行失败并显示cmd/ENTRYPOINT 中的命令未找到

「GORM错误」不支持的数据类型:&[],不正确的模式

Go struct 匿名字段是公开的还是私有的?

Go 中如何调用测试函数?

Golang Oauth2 服务帐户返回空刷新令牌字符串

如何在 Docker 容器中使用私有存储库进行身份验证

如何使用 fyne Go 使用 canvas.NewText() 使文本可滚动

Golang - 客户 Unmarshaler/Marshaler 在指针上具有 nil/null 值

Golang泛型在用作 map 元素时不起作用

如何使用golang操作很长的字符串以避免内存不足

如何在 Unmarshal 中使用泛型(转到 1.18)

如何使用 fyne 避免 GUI 应用程序中的循环依赖?